Genbank accession
YP_005098229.1 [GenBank]
Protein name
tail protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,89
Seq2Symm
C3 confidence 1,000
C3 1,000
C6 0,001
D3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MDYDTSGFPLGSKDPRVLYKNAKNFDYAMNDRESVSWVDRFGVSRKTWFGVEQQVNDYLASQGFEPGVLEYVDGSPLTVDRPTQLIQRGDNIYSVKRPASFPVNLTGNWATDQNLLVAQVDRTLQDTLATSAGAGMIGYRERTVADRLNDTANVKDYGAIADGAYHPLSERFATLAEAQAVYPHATALTDSIDWAAYQAAINSGAPHVHAPGGHYVMNRGTLAERDIRYTGDGYATRVDFSLADGPGSCMLTQGELVQIGDLSVSVVKGARTLTFAAAPDLAPGDVVIVYNPANGSWLADRDPYRAGEMWKVHSVSGSTVTIYGNSSSVYLFSEVDVYRMRGVRVSVDQMHFSPSDTYSIAPFKVVFGDGVKVSNYYASDVTLYTGLEVERCFDVSINAVSSPNRSPAVNDEYGITISNCHNFSVYGGYAAATRHAVALGGMDAVCCVPNRHGLIYGMNIEGIDLASDISAGDMHGNADKITYDNCEFRNGVILQGRDATVRNSTVYGVSSTSGEAIYGSEVYGGTYTIENNRFISYGDGASFGIVHISPSSTQREALLIIARNNTFELPNATGSTKVFFLRGRNSPLPISANIDGVHVHMASVAMQCFLFADDSIKSELLSNYLIIDNVYGPFGTSLLYPTTKNANIPTRQMEQSGEVTVTTNGTSTALPASNVSFRYPYSKKPMAVACASGVNGVAFSSLGGQSPVPIVYAVVAASIRPGLVAATSSFTSGERAVVGWRAGIREI
Physico‐chemical
properties
protein length:747 AA
molecular weight: 80298,70030 Da
isoelectric point:5,31794
aromaticity:0,09772
hydropathy:-0,11767

Domains

View on InterPro
YP_005098229.1
1 747 aa
STR 114–702 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_005098229.1
1 747 aa
Domain Start End Length (AA) Confidence
N-terminal 1 191 191 0,9929
Central domain 192 646 456 0,9900
C-terminal 647 747 100 0,9693
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_005098229.1 [NCBI]
Genbank nucleotide accession
NC_016765 [NCBI]
CDS location
range 18680 -> 20923
strand +
CDS
ATGGACTACGATACCAGCGGTTTCCCGCTCGGCTCGAAAGACCCTCGCGTCTTGTACAAAAACGCCAAGAATTTCGACTATGCGATGAATGATCGCGAAAGCGTTTCGTGGGTTGACCGCTTCGGGGTATCTCGCAAGACTTGGTTCGGTGTCGAGCAGCAGGTAAATGACTACCTAGCATCTCAAGGATTCGAGCCAGGCGTCCTGGAGTACGTCGACGGCTCACCGCTGACCGTAGACCGTCCGACCCAACTGATCCAGCGCGGGGACAACATCTACAGCGTCAAGCGCCCGGCATCGTTCCCCGTCAATCTGACCGGGAACTGGGCGACGGACCAGAACCTCCTGGTTGCCCAGGTTGACCGGACGCTGCAAGACACCCTGGCCACCAGCGCTGGCGCCGGGATGATCGGCTATCGCGAGCGCACCGTAGCCGACCGCTTGAACGACACCGCCAATGTCAAGGACTACGGCGCTATCGCAGATGGGGCGTATCACCCGTTGTCAGAGCGGTTCGCTACGCTCGCCGAGGCGCAGGCGGTTTATCCGCACGCCACTGCGCTGACCGACAGTATCGACTGGGCGGCGTATCAGGCGGCAATCAACTCCGGGGCGCCGCATGTGCATGCGCCAGGCGGCCACTACGTCATGAATCGCGGAACTCTCGCTGAGCGGGATATTCGGTATACCGGCGATGGCTATGCTACCCGCGTAGATTTCAGCCTCGCAGATGGCCCAGGTAGCTGCATGCTGACGCAGGGTGAGCTTGTGCAAATCGGCGATCTGTCCGTGAGCGTGGTTAAAGGCGCTCGCACGCTGACATTTGCCGCTGCGCCAGACCTGGCTCCGGGCGACGTGGTCATCGTGTACAACCCCGCCAACGGATCTTGGCTGGCTGATCGCGATCCGTATCGCGCTGGCGAGATGTGGAAAGTCCATTCGGTAAGCGGTAGCACTGTCACGATCTACGGAAACAGCTCGTCGGTGTACCTGTTCTCCGAGGTAGACGTATACCGCATGCGCGGCGTTCGCGTGTCTGTCGATCAGATGCACTTTTCGCCGTCTGACACATATTCCATTGCGCCGTTCAAGGTGGTTTTCGGCGATGGAGTTAAGGTTTCCAACTACTACGCTAGCGATGTCACGCTTTACACAGGGCTAGAAGTAGAACGATGCTTTGACGTTTCGATCAATGCGGTTTCAAGCCCGAACAGATCGCCGGCAGTCAATGACGAATATGGGATTACTATCTCAAACTGCCATAACTTCTCGGTTTACGGCGGTTATGCGGCAGCAACCAGGCACGCTGTCGCGCTTGGCGGAATGGACGCTGTGTGCTGCGTTCCTAACCGTCACGGCCTGATATACGGGATGAACATTGAGGGGATCGACTTAGCGTCGGATATCAGCGCGGGAGACATGCACGGGAATGCCGACAAAATCACATACGACAACTGCGAGTTTCGGAATGGGGTAATTCTTCAAGGGCGCGACGCAACTGTTCGTAACAGCACTGTCTACGGAGTATCCAGCACTTCCGGCGAAGCGATCTATGGATCGGAAGTATACGGTGGCACCTACACCATCGAGAATAATCGATTTATCAGCTATGGCGATGGCGCATCGTTTGGCATCGTCCATATATCGCCAAGTTCCACTCAGCGCGAAGCATTGCTGATCATCGCGCGAAACAATACATTCGAGTTGCCGAACGCCACGGGGTCGACGAAAGTGTTTTTCCTGCGTGGACGCAATAGCCCGCTTCCGATTAGCGCAAACATTGACGGAGTACACGTCCATATGGCATCTGTCGCGATGCAATGTTTCCTATTCGCGGACGACAGCATCAAGTCTGAACTTCTTTCTAACTACCTTATTATTGACAATGTTTACGGGCCATTCGGAACATCATTGCTTTACCCGACAACCAAGAATGCGAACATTCCTACGCGTCAGATGGAGCAGAGTGGGGAAGTAACAGTTACCACTAACGGAACTTCAACGGCTCTGCCGGCTTCCAACGTCAGTTTCCGATATCCATACTCTAAGAAGCCAATGGCGGTAGCCTGCGCATCAGGCGTCAACGGGGTAGCATTTTCTAGCCTTGGGGGGCAATCCCCGGTGCCAATTGTGTACGCCGTTGTCGCTGCTTCTATCCGGCCTGGACTGGTTGCTGCAACCTCTTCTTTCACCTCCGGAGAGCGGGCGGTCGTTGGGTGGAGGGCGGGAATCAGGGAGATATAA

Genome Context

Tertiary structure

YP_005098229.1
ESMFold structure
Source ESMFold
pLDDT 81.5
Oligomeric state monomer