Genbank accession
QIA28689.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 1,00
Seq2Symm
C3 confidence 0,997
C3 0,997
C1 0,080
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MIGGNRMPEQYLFRDKMYQDLTDPTPKIIQDLDKATGQLTDLPKLSINLEEYKPDGTGVNDSLGALTKAIEKSSLLSKVTSAPVAIELPPGVYRFVKTSDIATPSLICRGGLATIVVEDPYAFIVSSNFMLANVKIISKNTYVKTATMFKPIFKSTVDVENITFDNVTFDSQLSAMDGTVRASQCVNLKAVTNLKLNNIVVKGYRHGFTADGLSKNIKGTKLHFENVELPLYMRGSSPAVTDENYATNIQFSHVSHINTQSQMNNYFKQAGADTFLMEKCDTITITDVISVYPVERTAYLSCCRNAVVNTWNLKNALGIKFVGGSNTATPVETIARNCKVSNVHAVFDDATMTQQGYVAEFYWAKDWSVKNSSITGNSVGSVLVSTMHYIENGLIEDCYGENLKRGFFEYSYVGDIDNPDPTPDIAAGNYTAGVKGLTIRKNTVKNSNTFGGGDGTGYEAIKLRDTAPPAAGTYRYQDIVVEENKIINPTDDYGMSAAGNYCKGLINIDAVKGLRVSNNTVIGHKRLDANSNPVTLPIQVGSNSKDVIVQHEETSRGYDMKFVWGTLYVSSDSKIIVNSIHRNMAIQDTATITVKHDQTNLKTTKDISTAFRISGRTSVSDATDFALPVVGYNLAGYTLPAVFGTVDVATDNGDVGGYTITKAGVIALKANSAAFYVTTVTNAQFALTKDATLPRYLMRYKTGASTNFVINYTINAV
Physico‐chemical
properties
protein length:717 AA
molecular weight: 78100,47330 Da
isoelectric point:6,80320
aromaticity:0,08787
hydropathy:-0,16639

Domains

View on InterPro
QIA28689.1
1 717 aa
STR 45–529 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QIA28689.1
1 717 aa
Domain Start End Length (AA) Confidence
N-terminal 1 62 62 0,9709
Central domain 63 583 522 0,9901
C-terminal 584 717 133 0,9710
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QIA28689.1 [NCBI]
Genbank nucleotide accession
MN940411.1 [NCBI]
CDS location
range 149074 -> 151227
strand +
CDS
ATGATAGGAGGTAATAGAATGCCAGAACAATATCTTTTTCGGGATAAGATGTACCAAGATTTAACTGACCCTACGCCTAAAATCATCCAAGACCTAGATAAAGCAACAGGGCAGTTAACCGATCTTCCCAAGTTATCAATTAACTTGGAAGAGTATAAGCCAGATGGTACAGGTGTAAATGATAGCCTAGGCGCTCTCACAAAGGCGATAGAAAAGTCTAGTCTGCTTAGTAAGGTAACTAGTGCCCCGGTAGCTATCGAGTTACCACCGGGAGTTTACCGCTTTGTAAAAACAAGCGATATAGCAACCCCATCCCTAATTTGTCGAGGAGGTCTTGCTACAATCGTAGTAGAAGACCCTTATGCGTTTATCGTTTCTTCTAACTTTATGCTAGCAAACGTTAAGATTATTTCAAAGAACACATACGTTAAAACTGCTACAATGTTTAAACCTATTTTTAAATCAACTGTAGACGTAGAAAACATTACTTTCGATAACGTTACTTTTGATTCTCAACTGTCTGCTATGGATGGTACGGTTCGTGCTAGTCAGTGCGTGAACTTAAAGGCTGTAACAAACTTAAAGCTAAACAACATTGTAGTAAAAGGGTATCGTCACGGCTTTACAGCAGACGGTCTTTCTAAGAATATTAAAGGTACTAAGCTGCACTTTGAAAATGTAGAATTACCTTTATATATGCGAGGAAGTAGCCCAGCAGTAACGGATGAGAACTATGCTACTAATATTCAGTTTTCCCATGTATCACATATCAATACACAGAGTCAAATGAATAACTACTTTAAGCAAGCGGGAGCGGATACCTTCCTAATGGAAAAGTGTGACACGATCACTATTACAGACGTTATATCTGTATACCCTGTAGAGCGCACAGCTTACTTATCTTGTTGTAGAAATGCTGTTGTTAACACTTGGAATCTGAAAAATGCTTTAGGTATTAAATTCGTAGGTGGGAGCAACACAGCTACTCCGGTAGAAACAATTGCTAGAAACTGTAAAGTATCAAATGTTCATGCTGTATTCGATGATGCTACCATGACTCAACAAGGTTACGTTGCAGAGTTTTATTGGGCAAAAGATTGGTCAGTTAAGAACTCATCTATTACAGGTAACAGCGTAGGCTCCGTTCTTGTGTCTACTATGCATTACATCGAGAATGGTTTAATTGAGGATTGTTACGGAGAGAACTTAAAGCGTGGTTTCTTCGAGTACTCCTATGTAGGAGACATCGACAACCCAGACCCAACCCCTGATATTGCAGCAGGAAACTATACAGCAGGTGTTAAGGGGCTTACTATTCGTAAAAATACGGTTAAGAACTCTAATACGTTTGGTGGAGGAGACGGAACAGGTTACGAAGCAATCAAACTTCGAGACACAGCACCTCCGGCTGCTGGTACGTATCGCTATCAAGATATTGTAGTAGAGGAAAATAAAATTATTAATCCTACAGATGATTATGGTATGTCTGCTGCTGGAAATTACTGTAAAGGGCTTATTAACATTGACGCTGTTAAAGGTTTACGTGTTAGCAATAACACTGTAATCGGACATAAGCGCTTAGATGCTAATAGCAACCCAGTTACTCTACCAATTCAAGTCGGGTCTAACTCTAAGGATGTCATTGTTCAGCATGAAGAAACATCCCGTGGGTACGATATGAAGTTTGTATGGGGTACTTTATATGTATCTTCTGACTCTAAGATCATAGTTAACTCTATTCACCGTAATATGGCAATCCAAGACACTGCTACTATTACAGTGAAGCACGATCAAACGAACCTGAAGACAACTAAAGATATTTCTACAGCCTTCCGTATCTCAGGTAGAACTAGTGTCTCAGACGCTACAGACTTTGCATTACCTGTTGTCGGCTATAACTTAGCAGGATACACACTGCCTGCTGTGTTTGGTACGGTAGATGTCGCTACAGATAACGGGGATGTAGGCGGGTATACGATCACTAAAGCAGGAGTTATAGCTCTCAAGGCAAACTCTGCTGCTTTCTATGTTACCACTGTCACTAATGCACAGTTTGCATTAACTAAAGACGCTACGTTACCTAGATACCTTATGCGATATAAAACAGGAGCTAGTACAAATTTTGTTATTAACTACACAATCAATGCAGTTTAG

Genome Context

Tertiary structure

QIA28689.1
ESMFold structure
Source ESMFold
pLDDT 67.7
Oligomeric state monomer