Genbank accession
CAL9994023.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect
Probability 0,86
TF
Evidence RBPdetect2
Probability 0,59
Seq2Symm
C3 confidence 0,999
C3 0,999
C1 0,053
C6 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAELRSSTSIGGNLVWHSGNLRFDTQGETIRYSGYKIYTEHDKPDPHTDLTTSVVKRSGDTMTGALRITNAGEQLDLTNTAFSSTDSWISMGNGKADTHYAWQIRYMGTGGGIGSNELRFGSTYGASPKYWQMDHSGNFNYFNGANTYTMLHTGNINNTLDGRYVNTAGDTMTGTLNVPTLHVTDGMIQVDHSGTSSDTLISMMGTMEDSSVMFINNGGGDNILSFTRAGSSDYVSAFYGTARATSDLIASRYVQGSRLYASVDRSSGYFFNDSSTRVSYKGGDFYIQSDVQNTYLYATNTYLGNTSGDNILVRGNKLSGDTWSFAGVTGNFLTTATSEFNGATEFDTSTGFRLKRNASSNTGDDVVNLVVDDGGLMVRVDNDNDSDSSKFNVQYKTGGAWVSTFYVDHNGVSYKGNAIFHAGDYSTLDNRYLNVTGDTMTGILTGTNIRAQNFQTRTGQRLIDTAADNILRIGNSTGAETHTRVHGSGSSAGRKLSVWHGGVDQWVFNDGYHPNADKWTTARTLTLAGDVSGSVSMDGTANVSLTATVADDSHNHTSLTSVSQIQFQLPGSSDGGFIEMKGGSNSGYMRFSTWDDNGTEYMEFGDYDTSATSSTFTRWLKLVRGSAEFAGTLSTTGNTTVGGDLTINGGDLTINSNNGGITYNDSSKYWLKTATNWGLYWNTSSNSFEYRGSGTARAAVDLDSGNITTNGEVQFAEAMVTKASVSYNSSTKSIDFKFV
Physico‐chemical
properties
protein length:739 AA
molecular weight: 79692,61190 Da
isoelectric point:5,08671
aromaticity:0,10690
hydropathy:-0,47537

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAL9994023.1
1 739 aa
Domain Start End Length (AA) Confidence
N-terminal 1 10 10 0,3621
Central domain 11 204 195 0,0827
C-terminal 205 739 534 0,9031
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Vibrio phage D479 [NCBI] · taxon 3105242
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAL9994023.1 [NCBI]
Genbank nucleotide accession
OZ195776.1 [NCBI]
CDS location
range 203787 -> 206006
strand -
CDS
ATGGCAGAGTTAAGATCGTCGACCTCAATCGGCGGAAACTTAGTATGGCATAGCGGAAATCTTCGTTTTGATACTCAAGGTGAGACGATTCGTTACTCCGGCTATAAAATTTACACAGAACACGATAAGCCAGACCCACACACGGATTTAACGACGTCGGTTGTTAAACGTTCCGGTGATACTATGACTGGTGCGCTACGCATTACAAACGCGGGCGAACAGCTGGATTTGACCAATACAGCATTCAGCAGCACTGATTCGTGGATTAGTATGGGTAATGGTAAAGCTGATACTCACTACGCGTGGCAAATTCGTTACATGGGCACTGGTGGTGGTATTGGTAGCAACGAACTCCGTTTTGGTAGTACATACGGAGCGAGTCCGAAATACTGGCAAATGGACCATAGCGGTAACTTTAATTACTTTAATGGTGCAAATACATACACGATGTTGCACACAGGCAATATCAACAATACATTGGATGGTCGTTACGTAAACACTGCTGGCGATACAATGACCGGTACGCTAAACGTACCAACGCTTCATGTCACTGATGGCATGATTCAAGTTGACCACTCAGGCACCTCAAGTGATACGCTAATCAGCATGATGGGTACGATGGAAGATTCGTCAGTCATGTTCATTAACAACGGTGGTGGTGATAACATCCTATCGTTTACACGAGCTGGAAGTAGCGACTACGTATCGGCGTTTTACGGCACAGCAAGAGCAACGTCTGATTTAATCGCGAGTCGATATGTCCAAGGTAGTCGTTTGTACGCATCTGTAGATCGTTCTTCTGGATACTTCTTCAACGACTCCAGTACTCGAGTTTCGTATAAGGGCGGTGACTTCTACATTCAATCAGACGTTCAGAACACGTATCTGTATGCAACCAACACGTATCTGGGCAACACGTCTGGCGACAACATCCTCGTTCGTGGCAATAAGCTATCTGGAGATACTTGGTCATTTGCAGGCGTGACTGGTAATTTCCTAACAACCGCAACGTCGGAGTTCAACGGTGCAACTGAGTTCGATACCAGTACCGGATTCCGTTTAAAACGTAATGCGTCATCAAACACTGGTGATGACGTTGTGAATTTGGTTGTGGATGACGGCGGACTGATGGTTCGAGTGGATAATGACAACGACTCCGACTCGTCCAAATTCAATGTTCAGTATAAAACTGGTGGTGCTTGGGTATCGACGTTTTACGTGGATCATAACGGCGTTAGTTACAAAGGAAATGCCATATTCCACGCTGGAGATTACTCAACGCTTGATAATCGTTACTTGAACGTTACTGGCGACACGATGACCGGCATACTAACTGGTACAAACATTCGAGCTCAGAACTTCCAGACACGCACTGGCCAGCGTCTGATTGACACTGCTGCTGATAATATTCTACGCATTGGTAATTCAACCGGCGCAGAAACGCACACTCGAGTACACGGATCTGGTTCATCTGCTGGTAGAAAGCTATCTGTGTGGCATGGTGGGGTGGATCAATGGGTATTCAACGATGGATATCATCCAAACGCTGACAAGTGGACTACCGCAAGAACACTGACGTTAGCTGGTGATGTGAGTGGCTCTGTTTCAATGGATGGTACGGCGAATGTTTCGTTGACTGCTACTGTTGCTGACGATTCGCATAATCACACGAGCTTGACCAGTGTGTCGCAAATCCAATTCCAATTACCTGGATCAAGCGATGGTGGATTCATCGAAATGAAGGGCGGTTCGAATTCTGGATACATGCGTTTCTCTACTTGGGACGATAACGGCACTGAGTACATGGAGTTTGGTGATTACGATACGAGCGCAACATCAAGCACGTTTACCCGTTGGTTGAAACTGGTCCGTGGTTCTGCTGAATTTGCTGGTACTTTATCAACGACCGGCAATACAACAGTTGGTGGCGATCTAACCATCAATGGTGGCGATCTAACCATCAATAGCAACAATGGTGGCATTACGTACAACGATTCGAGTAAGTATTGGCTAAAGACTGCTACAAACTGGGGATTGTATTGGAACACCTCGAGTAATTCATTCGAATATCGTGGATCTGGAACAGCAAGAGCAGCGGTTGATTTGGATAGTGGTAACATCACAACCAATGGTGAAGTGCAATTTGCAGAAGCTATGGTTACCAAAGCGTCCGTAAGTTACAACAGTTCTACTAAGTCAATTGACTTTAAATTTGTATAG

Genome Context

Tertiary structure

CAL9994023.1
ESMFold structure
Source ESMFold
pLDDT 56.0
Oligomeric state monomer