Genbank accession
CAM0096759.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect2
Probability 0,97
Seq2Symm
C3 confidence 0,997
C3 0,997
C1 0,164
D3 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSDLDSAIKSINESAVKAENTAGFLDDMSTFDDQSSVTNPNNGQTVASIPKQVKDRTDELFTAAESEINQAVSDAAQSATDAQDAANSIGRYQGLWPDSGGSALKGDTYQTQVSGVETGKYFTALQNTTVDPIDDDVNWRAILSNQSLGGLTSYQAANVSDMIAGRVISGEVIPHADGQVWEWAGYYSPNDGGGNKGVVKLGSHTEDNGIIFSIDSNTYVEADTKDGINVLQFGLIPSDHTTTDRAQAAYNSGVSKVKWPKRDYIIDAVLNGLNGILVKSNTTTIIDAGSTLTAFAPGAAEYAILDAIQQSNVFFYVEGVEFIGDRSTHTGTIGEQGFGIRIGECDRYVIRGGTYRDFWGDGLFIGKFGAPGSPPSTNGYIRGVLCDNNRRQGMSIVVANGLVVEDSKFLNSNGTSPESGVDSEPNLNDLPNYNITFRNCEFSGTGGGFNAPFSDGTSDFHFYKCIFNGKANQALIGDALQFRSDGLHGISTFNECTFNGIVREAENAIFTHCEFIAGDEYLQTVWVFSCTNDTVVKLIDCTILAKGEKRPLSEGGSTLPTTGKKFVRTRFIKQGDQGALFAVNHSSGYSTYTDCELIHQGTVPASDFYFNGTIDGVELVIESVTGDSFFTIGGQSGRYSNVYPIRGTGTPEGVVSAPVGSQFMDLAGSAGNVRFLKESGTGNTGWVSA
Physico‐chemical
properties
protein length:689 AA
molecular weight: 73530,97580 Da
isoelectric point:4,54350
aromaticity:0,09724
hydropathy:-0,26618

Domains

View on InterPro
CAM0096759.1
1 689 aa
STR 216–654 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAM0096759.1
1 689 aa
Domain Start End Length (AA) Confidence
N-terminal 1 240 240 0,9959
Central domain 241 631 392 0,9874
C-terminal 632 689 57 0,9551
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Vibrio phage K99 [NCBI] · taxon 3105818
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAM0096759.1 [NCBI]
Genbank nucleotide accession
OZ196724.1 [NCBI]
CDS location
range 31009 -> 33078
strand +
CDS
ATGAGTGATTTAGACAGCGCTATAAAATCAATTAACGAGTCAGCAGTAAAGGCAGAAAATACCGCCGGCTTTCTGGATGACATGTCTACGTTTGACGACCAATCAAGCGTAACTAACCCAAACAACGGGCAAACTGTTGCGTCTATTCCTAAGCAAGTAAAAGACCGAACAGATGAGTTATTTACCGCTGCTGAGTCTGAAATCAATCAAGCGGTGTCTGACGCAGCACAAAGCGCGACAGATGCGCAAGATGCTGCGAATAGTATTGGAAGATATCAAGGGTTGTGGCCAGATTCTGGTGGTAGCGCATTAAAGGGCGACACATATCAAACTCAAGTTAGCGGGGTTGAGACAGGTAAATATTTTACAGCGCTGCAAAACACAACGGTCGATCCTATTGATGATGATGTTAATTGGCGTGCAATTCTTAGTAACCAATCTTTGGGCGGCCTAACAAGCTACCAAGCTGCTAATGTTTCGGATATGATTGCTGGTAGAGTTATAAGCGGTGAGGTTATTCCTCATGCTGACGGTCAGGTGTGGGAGTGGGCTGGATATTACTCACCCAACGACGGGGGTGGTAATAAAGGCGTTGTGAAATTAGGTTCTCATACTGAAGATAATGGAATTATATTTAGTATAGACTCCAACACATACGTAGAAGCCGATACAAAAGATGGAATAAACGTTCTTCAATTTGGTTTGATTCCATCCGACCACACCACGACGGACAGAGCACAAGCTGCTTATAACTCTGGAGTATCAAAGGTTAAGTGGCCTAAAAGAGATTATATCATTGACGCAGTCTTAAACGGGCTTAATGGGATACTTGTAAAAAGCAACACGACAACCATTATCGACGCAGGATCAACCCTTACTGCATTTGCCCCAGGCGCTGCGGAGTACGCAATACTAGATGCAATACAACAAAGCAATGTTTTCTTTTATGTTGAAGGTGTTGAGTTTATAGGGGATCGAAGTACTCATACAGGAACGATAGGTGAGCAAGGTTTCGGCATACGGATCGGCGAGTGTGACAGATACGTGATTCGTGGTGGCACTTATCGTGATTTCTGGGGGGACGGCTTATTTATCGGTAAGTTCGGCGCTCCTGGAAGCCCTCCATCAACAAATGGGTATATTCGAGGGGTTCTATGTGACAACAACCGTCGACAAGGTATGTCTATTGTTGTTGCTAATGGTCTAGTTGTTGAAGATTCAAAATTCCTAAATAGCAACGGAACATCACCAGAGTCAGGAGTTGATTCAGAGCCTAATCTTAACGATCTCCCTAACTACAACATAACGTTTAGAAACTGCGAATTTAGCGGAACGGGCGGCGGTTTTAACGCCCCATTCTCCGATGGAACCAGTGATTTTCACTTCTACAAATGCATATTCAATGGCAAGGCAAATCAAGCGCTGATTGGGGATGCTCTTCAATTTAGGTCTGATGGGCTGCATGGGATTAGTACATTTAATGAATGTACGTTTAACGGGATTGTTAGGGAGGCTGAAAACGCAATATTTACCCATTGCGAATTCATAGCGGGAGATGAATATTTGCAGACGGTATGGGTGTTCTCATGCACCAACGACACAGTGGTTAAGTTAATAGATTGCACGATACTTGCTAAGGGCGAGAAAAGACCACTAAGTGAAGGTGGTAGCACGCTGCCCACTACGGGTAAAAAGTTTGTTAGAACACGGTTTATTAAGCAGGGCGATCAAGGTGCCTTATTTGCTGTAAATCACTCGTCAGGTTATTCGACATATACAGATTGTGAATTAATCCATCAAGGCACAGTCCCTGCTTCGGACTTTTACTTTAACGGAACAATCGATGGCGTTGAATTGGTTATTGAATCTGTCACTGGCGATTCATTCTTTACGATTGGGGGCCAATCAGGCAGATACTCCAATGTATACCCAATAAGAGGAACAGGGACACCAGAGGGTGTTGTTTCGGCCCCAGTTGGTAGTCAATTTATGGACTTAGCAGGGTCTGCTGGTAATGTTAGATTTCTAAAAGAATCAGGAACAGGAAATACAGGGTGGGTGTCGGCATGA

Genome Context

Tertiary structure

CAM0096759.1
ESMFold structure
Source ESMFold
pLDDT 83.1
Oligomeric state monomer