Genbank accession
CAL1776920.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,98
Seq2Symm
C3 confidence 0,999
C3 0,999
D3 0,010
C1 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNILRSFTETVVTTPTDIFPISFEYDEKYDAVHVFLNDVAVEDLGYTVSQVNAVTLKIEPAIPEGTVRIERETDIDKMKYIFDAGALFIDQNVDADFRQIVHSQQEVRDGFIKLRGDVLPLVHGLQEALKQAQEASDAAKEAAKAAEEAAALVSGAVTSVKTIADLKALPTWDGRVVVMQGHTELGKKSTIFRYDATNTDPHNNYSVVKPNTGTGNWLALDTAVYESSQLGCGIAITNNDVLINPLLATSGSITIREELPTTNSINVQSYNDIRGLGTRAGFKYNGPSGTADTLEGRLPVVKLFKDNAKAVSQSRLENLTIHANYKPYVTAVDARYLTGQSKLRELIIRGVTDTSVGLVLNKMWYDKISDVFISGYDPSKPDGSRWGTGVVIESKYSSDPASPDYGAQINALTVDVSCHSLKVGYLIRPNNYIYGLNINTMPTVENCDIGFKMESAPASVDYQVRQSCISAYFENNGIDIQWGTPSTTKARNSKHVWLNCSFDDVHSRIELYEGHHTFIGCKGIKTLVCGQYAQAELINTARPTTITDDYGNVTVRQDPMSQITSGSYQNVRTRSQGMLKLKATVNAGATGTFDLGSVLNTTIASEGQTGLVRILSRRSYDTAPVIAQGVILRKPTGTTFTPIGTVPTGMTISIAGTVLSVSETRGDTKFLDIIFNPD
Physico‐chemical
properties
protein length:678 AA
molecular weight: 73900,40310 Da
isoelectric point:5,52420
aromaticity:0,07670
hydropathy:-0,20044

Domains

View on InterPro
CAL1776920.1
1 678 aa

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAL1776920.1
1 678 aa
Domain Start End Length (AA) Confidence
N-terminal 1 239 239 0,9965
Central domain 240 553 315 0,9894
C-terminal 554 678 124 0,9676
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAL1776920.1 [NCBI]
Genbank nucleotide accession
OZ038334.1 [NCBI]
CDS location
range 34833 -> 36869
strand +
CDS
ATGAATATACTACGCTCATTTACAGAGACAGTGGTGACTACACCTACAGATATTTTCCCTATCAGTTTTGAGTACGATGAGAAATATGATGCTGTACATGTCTTTCTTAATGACGTAGCAGTTGAAGACTTGGGGTACACTGTATCTCAAGTTAATGCTGTTACTCTAAAAATTGAACCGGCTATTCCAGAAGGTACGGTTCGTATTGAACGCGAAACAGACATTGATAAGATGAAGTACATCTTCGATGCGGGTGCGTTATTCATTGACCAGAATGTTGATGCAGATTTTCGACAGATCGTACACTCTCAGCAAGAGGTGCGAGATGGTTTTATTAAACTACGTGGTGATGTATTACCACTAGTACACGGTTTACAAGAAGCTTTGAAACAAGCACAAGAGGCTAGCGACGCTGCGAAAGAAGCTGCTAAAGCTGCGGAAGAAGCTGCTGCGTTAGTTAGTGGTGCAGTTACATCTGTCAAAACTATTGCAGATTTAAAAGCACTACCTACATGGGATGGACGTGTAGTCGTTATGCAAGGTCATACTGAGTTGGGTAAGAAATCCACTATATTCCGCTATGACGCTACTAACACAGATCCCCATAACAACTATTCTGTAGTTAAACCTAATACTGGTACAGGTAATTGGTTGGCTTTAGATACTGCTGTGTATGAAAGTTCTCAGTTAGGATGTGGTATTGCTATTACTAATAACGATGTATTAATTAATCCATTATTGGCTACATCTGGGTCTATTACAATCCGTGAGGAGTTGCCTACTACGAACTCAATCAATGTGCAGAGTTACAACGATATTCGTGGTTTAGGTACACGAGCAGGGTTTAAATATAATGGACCTAGTGGTACTGCCGATACTTTAGAAGGTCGCTTACCAGTTGTTAAACTATTCAAGGATAATGCTAAGGCAGTCAGTCAATCTAGGTTAGAGAACTTAACCATCCATGCAAACTACAAACCTTACGTAACTGCTGTGGATGCTCGATACTTAACAGGTCAGTCTAAGTTACGTGAATTAATTATCCGAGGTGTTACAGATACGTCTGTAGGTTTGGTACTCAATAAGATGTGGTACGATAAAATCAGCGATGTATTTATCAGTGGTTATGATCCTAGTAAACCTGATGGTTCTCGTTGGGGTACTGGTGTGGTTATCGAGTCTAAGTACTCGTCTGATCCTGCATCACCTGACTACGGGGCACAGATCAATGCTTTGACAGTGGATGTATCTTGTCATAGTTTAAAGGTAGGTTACTTAATTCGACCAAATAACTACATCTACGGTTTAAATATTAATACAATGCCTACTGTAGAGAACTGCGACATTGGCTTCAAGATGGAATCTGCACCTGCATCTGTAGATTATCAAGTACGGCAAAGCTGTATTTCTGCGTACTTTGAAAACAACGGTATTGATATTCAGTGGGGTACACCTAGTACCACTAAAGCACGTAACTCTAAACATGTATGGTTGAATTGTTCGTTCGATGATGTTCACTCACGTATTGAGTTGTATGAAGGTCATCATACATTCATTGGCTGTAAAGGTATTAAGACTCTTGTGTGTGGACAGTACGCTCAAGCGGAACTTATTAACACTGCACGACCTACCACTATCACTGATGATTATGGTAACGTAACTGTACGTCAAGACCCTATGTCTCAGATTACATCTGGCTCGTATCAAAATGTACGTACACGTTCTCAAGGTATGCTGAAACTCAAGGCTACCGTCAATGCTGGTGCTACTGGTACGTTTGACTTAGGTTCTGTGTTAAATACTACTATTGCTTCTGAGGGACAGACAGGTTTAGTACGCATCCTATCCAGACGTTCTTATGATACTGCGCCTGTTATTGCACAAGGTGTTATCCTACGTAAGCCTACAGGTACTACATTCACACCTATCGGGACTGTGCCTACGGGTATGACCATTAGTATAGCAGGTACGGTGTTAAGTGTATCTGAAACTAGAGGCGACACAAAGTTTTTAGATATTATTTTTAATCCAGATTAA

Genome Context

Tertiary structure

CAL1776920.1
ESMFold structure
Source ESMFold
pLDDT 83.3
Oligomeric state monomer