Genbank accession
CAM0034971.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,90
Seq2Symm
C1 confidence 0,772
C1 0,772
C2 0,609
C3 0,004
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAGKTPIYEPLSAGDEDNWDMPVVNDKQMLGGVKVFNNNKDRDAWAKAFPSRLADTVALVGNGENGYPSWYKWETTWHFAGYFGGMVLADVDGALTRVDSTAVLGPDFKLQAAGDQGNGVLIMLSDKAKADIASKGSDGLITIGTYQSPQTFSKGNTLELEWPLKAWPDADKEKTFRVSMDHSAFEPLHKPGFLAYLSHGVELVGKHQNAGKGHHDGAIWFDEIIVPTNAYIGSDMSSKSYTIEEADNLDPNVSGGTDYLIAFRVGLKGNAPDDGFVRIYIYDKSINPFMENGYMEDVNGQPMIIERHYKQGDKLGFLDIIGVVNAKGQQGFSCHVVDNFVSDTLNLTDPYYGETALMIQTLASDSRTGMARLQYQQDTQQRILEGSRYMGKHLFSVDYYARLDLPMTTASGGNGQTQIDGVHFYNLTYATIGVVDDHIVIKDDGTHICDFSFGNIFDAETTSMLKGRDVTLNIELTNKNGAFRAYLVSWTGEADKYTPEIFTSRDDGSPTWQKDWDEVGNSFIPEDAVHDDTAHSLTFSVPSDAKNFAIIIAPGTAEQPLEVKIKSFNVDVTEPFTAYSVRASEMLGELRGVWNPENFLFTQGVQGYASLRYTINKAWTTMPVGIPNKAQNQDITLDPSKNKIGGSAARGGEGVIKFNKEGLIDESSYVDFLAWNEQGTDNDLTVRVVMLNPDTGKFDPDNKDLYIAEGGITVPANSKGSKHLFHIPEKQVEQGEEWGIFAKSSKDDGAFLECVSDKNPLIQVQIKLKKLDTVSYTLSDEGDGKNSAAVKYDP
Physico‐chemical
properties
protein length:794 AA
molecular weight: 87406,45720 Da
isoelectric point:4,75966
aromaticity:0,10202
hydropathy:-0,41083

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAM0034971.1
1 794 aa
Domain Start End Length (AA) Confidence
N-terminal 1 235 235 0,7001
Central domain 236 470 236 0,5800
C-terminal 471 794 323 0,2733
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Vibrio phage D83 [NCBI] · taxon 3105327
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAM0034971.1 [NCBI]
Genbank nucleotide accession
OZ196244.1 [NCBI]
CDS location
range 47019 -> 49403
strand +
CDS
ATGGCAGGAAAAACACCGATATACGAACCACTTTCAGCTGGTGACGAAGACAATTGGGATATGCCAGTTGTTAATGATAAGCAGATGCTTGGCGGCGTTAAGGTATTTAATAACAACAAAGACCGAGACGCATGGGCGAAGGCCTTCCCTAGTCGACTTGCTGATACTGTAGCCCTAGTTGGTAACGGTGAAAATGGTTATCCGTCTTGGTATAAGTGGGAAACTACGTGGCATTTTGCTGGCTACTTTGGCGGCATGGTGCTCGCTGACGTTGACGGAGCACTAACAAGAGTCGATAGCACTGCGGTGCTTGGTCCAGACTTTAAACTGCAAGCAGCTGGCGACCAGGGCAATGGCGTTCTTATAATGCTAAGCGATAAGGCCAAAGCTGACATAGCAAGTAAGGGCAGTGATGGTCTAATCACTATTGGAACATATCAATCACCTCAAACATTTTCTAAGGGAAATACGCTTGAGCTTGAATGGCCGCTTAAAGCATGGCCTGACGCAGATAAAGAAAAAACCTTTCGCGTATCTATGGATCATTCAGCGTTTGAGCCACTTCACAAACCGGGCTTCCTTGCTTACCTAAGTCATGGGGTTGAGCTTGTTGGGAAGCATCAAAACGCAGGGAAAGGCCATCACGATGGCGCGATCTGGTTTGATGAAATTATAGTTCCTACTAATGCCTATATTGGTTCTGATATGTCGTCCAAATCTTACACGATTGAAGAGGCCGACAACCTAGATCCTAACGTGTCTGGTGGTACGGATTACCTTATCGCATTTCGTGTAGGGCTGAAGGGTAATGCGCCTGATGATGGTTTTGTTCGTATTTACATTTACGACAAATCAATCAATCCATTCATGGAAAACGGTTACATGGAAGACGTTAACGGTCAGCCTATGATCATCGAACGTCATTATAAGCAAGGTGACAAGTTAGGATTCCTGGATATCATCGGCGTGGTTAACGCTAAAGGGCAGCAAGGTTTTAGTTGTCATGTTGTGGATAATTTTGTTAGCGACACGCTAAACCTAACCGATCCGTATTACGGCGAAACCGCATTAATGATTCAGACACTTGCTAGTGATAGTCGAACAGGAATGGCGCGCCTTCAGTACCAACAAGATACACAGCAGCGCATTCTTGAAGGCTCTCGATATATGGGGAAACATTTATTCTCTGTTGATTATTATGCAAGATTGGATCTTCCTATGACTACCGCCAGCGGTGGGAATGGACAAACACAAATAGACGGGGTTCACTTTTACAATCTTACTTATGCGACCATTGGAGTTGTTGACGATCATATCGTGATTAAAGATGACGGGACGCATATTTGTGATTTTAGTTTTGGCAACATATTCGACGCTGAAACAACATCAATGCTTAAGGGTAGAGATGTGACTTTAAATATAGAGTTGACGAATAAAAACGGAGCGTTTAGAGCTTACTTAGTTTCGTGGACTGGCGAAGCTGACAAGTACACGCCTGAAATATTCACATCAAGAGACGACGGTTCCCCAACTTGGCAAAAGGATTGGGATGAAGTTGGTAACTCTTTCATACCTGAAGATGCTGTGCACGATGATACGGCGCATTCTCTAACGTTCTCTGTGCCTTCTGACGCGAAAAACTTTGCCATTATTATTGCGCCTGGAACGGCAGAGCAACCGCTTGAAGTTAAAATTAAGAGTTTTAATGTCGACGTTACTGAGCCGTTTACCGCATATTCTGTTCGTGCCTCTGAAATGCTTGGAGAGCTTCGAGGTGTTTGGAATCCTGAAAACTTCCTGTTTACCCAGGGTGTGCAGGGTTATGCATCACTAAGATACACGATCAATAAAGCTTGGACGACAATGCCAGTAGGCATTCCAAACAAAGCACAAAACCAAGATATAACCTTGGACCCATCTAAAAATAAAATTGGTGGATCTGCAGCTAGGGGCGGTGAAGGTGTAATTAAATTCAACAAAGAGGGCTTAATAGATGAATCCTCATACGTTGACTTCTTAGCTTGGAATGAGCAAGGCACAGACAACGATCTAACCGTTCGCGTGGTTATGTTGAATCCAGACACCGGAAAGTTCGATCCAGATAATAAAGATCTTTATATAGCTGAAGGTGGCATTACTGTTCCTGCTAACTCTAAAGGCTCGAAACACTTATTTCACATACCTGAAAAGCAAGTTGAGCAGGGTGAAGAGTGGGGCATATTCGCCAAATCAAGCAAGGATGACGGCGCATTCCTTGAGTGTGTTAGCGATAAAAACCCGTTAATTCAGGTCCAAATCAAGCTTAAAAAGCTAGATACGGTTTCTTACACGCTATCAGATGAAGGTGACGGCAAGAACTCAGCAGCTGTTAAGTACGATCCTTAA

Genome Context

Tertiary structure

CAM0034971.1
ESMFold structure
Source ESMFold
pLDDT 45.2
Oligomeric state monomer