Genbank accession
XCH40339.1 [GenBank]
Protein name
tail protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect2
Probability 0,42
Seq2Symm
C1 confidence 0,999
C1 0,999
C3 0,030
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MYPIPCFFLTLSGGGTEPLPPGSVKKIAFTRDQTTGIKRSMAILLTDGRLYAQGDNAWGECADGTVSPFYDHWNLAAQGVADVFGAGKAFVVKYNSGGWQFCGDLSQFTGSGGIYVTWTSFPSSITGTVALADLASVSGANGNTLWLMTNGRLYGSGTNSNGCLGANNTNIFSTPRSISASCLRAFSLNACVTYLNNVGTARVCGMTYSINGTTTTQTQSFIDVAVAPTTNVDTGITAPVYVKEWMSNESNSIAIGSYAADDNDNYLFCRNIVPGFTTSTYVKVSDFGPFTDFRVIDGGQSRFFIADNVLYGIGDVPRNLGLGTTDSTQVSTPTPVPVPTGKDWDLSKLTYIADMKGNTLTSGGTFGHWMVYDNNLYYTGFSYGFFNSNDTSYVFVNVPESSFEGTTADAITTGSIPYAIKGSKGQMTWTVEPANAEIYDISFTSSAPNIATVDSNGIMTFLEEGSFDITMTAKTGSGDDAKTLTDTSGGYVSIFSVTTDSVPAKQVGDVFVFMDKNSPDYTPGPNIIGMEFSPANVDTSFIDGEFTTTDPSVVEVSPDGYLTCIASGDCRCGVRLIYREGQVEAFDDSYVSVLEPTATIPPDGGGIIT
Physico‐chemical
properties
protein length:609 AA
molecular weight: 64658,02850 Da
isoelectric point:4,23692
aromaticity:0,11494
hydropathy:-0,04860

Domains

View on InterPro
XCH40339.1
1 609 aa
STR 11–393 · STR 407–487 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

XCH40339.1
1 609 aa
Domain Start End Length (AA) Confidence
N-terminal 1 86 86 0,2157
Central domain 87 427 342 0,8577
C-terminal 428 609 181 0,0645
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
XCH40339.1 [NCBI]
Genbank nucleotide accession
PP856721 [NCBI]
CDS location
range 97789 -> 99618
strand -
CDS
ATGTATCCTATTCCTTGCTTTTTCCTGACTCTCTCAGGTGGCGGGACTGAACCACTACCACCAGGAAGTGTTAAGAAAATTGCATTCACAAGAGATCAGACCACAGGCATCAAGAGGTCTATGGCAATTTTGCTGACAGACGGAAGACTTTATGCTCAGGGTGACAACGCCTGGGGCGAGTGTGCGGATGGAACCGTGAGTCCATTTTACGATCACTGGAATCTTGCTGCTCAAGGTGTTGCTGATGTCTTTGGTGCTGGTAAGGCATTTGTTGTAAAATACAACAGCGGCGGTTGGCAGTTCTGTGGAGATCTGTCACAATTTACCGGAAGTGGTGGTATTTATGTCACATGGACAAGCTTCCCATCTTCCATCACAGGAACTGTAGCCCTTGCAGACCTCGCAAGTGTTTCTGGCGCGAACGGGAACACCTTGTGGCTCATGACTAATGGCAGATTGTATGGTAGTGGAACAAACTCCAACGGATGCTTGGGTGCAAACAACACCAACATCTTCTCAACACCACGTTCTATAAGTGCTTCTTGCCTGAGAGCTTTCAGCCTAAACGCTTGCGTTACTTATTTAAATAACGTAGGGACTGCTCGTGTCTGCGGGATGACATATAGCATCAACGGAACAACAACCACCCAGACACAAAGTTTTATAGATGTGGCTGTTGCTCCCACCACAAATGTAGATACAGGGATCACAGCCCCTGTTTATGTGAAAGAGTGGATGTCGAACGAGTCCAACAGCATTGCCATCGGTTCTTATGCAGCAGATGATAACGACAATTACCTGTTTTGTAGGAATATTGTACCTGGGTTTACAACATCTACATATGTGAAGGTAAGTGATTTTGGTCCTTTCACTGATTTTCGTGTTATAGATGGTGGTCAGTCAAGATTCTTCATCGCTGATAATGTGTTGTATGGTATCGGAGATGTGCCTAGAAACCTTGGTCTTGGAACTACTGATTCTACGCAAGTGTCCACCCCAACACCTGTTCCAGTTCCTACAGGGAAAGATTGGGACCTGAGTAAGCTTACTTATATTGCAGATATGAAGGGAAACACCCTTACAAGTGGTGGTACTTTCGGTCACTGGATGGTGTACGACAACAACCTTTACTATACAGGGTTTAGTTACGGATTCTTTAATTCAAACGACACCTCTTATGTGTTTGTAAACGTGCCGGAGTCATCGTTTGAAGGAACGACAGCAGATGCTATCACCACGGGTTCAATTCCATATGCAATAAAAGGGTCGAAGGGTCAGATGACTTGGACGGTAGAGCCTGCTAATGCGGAGATTTACGATATTTCGTTCACATCAAGTGCTCCTAATATCGCAACTGTCGATTCGAACGGGATCATGACATTCCTTGAAGAGGGTAGCTTTGACATCACAATGACTGCTAAAACAGGGTCGGGCGATGATGCAAAGACACTCACTGACACCTCTGGTGGTTATGTTTCCATCTTCTCGGTGACCACAGATTCCGTACCTGCAAAACAGGTCGGTGATGTTTTCGTGTTCATGGATAAGAACAGTCCAGACTACACACCCGGTCCAAACATTATCGGTATGGAGTTCTCTCCTGCGAATGTTGATACCAGCTTTATAGATGGGGAATTCACTACGACAGATCCAAGTGTTGTAGAGGTTAGTCCTGACGGATACCTGACCTGTATCGCATCAGGTGATTGCCGTTGTGGTGTGCGCCTTATCTACAGAGAGGGTCAAGTTGAAGCATTCGATGATTCATATGTCTCGGTTCTTGAACCTACAGCAACAATCCCACCAGACGGTGGTGGGATCATCACCTAA

Genome Context

Tertiary structure

XCH40339.1
ESMFold structure
Source ESMFold
pLDDT 78.5
Oligomeric state monomer