Genbank accession
WMM95392.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,86
TSP
Evidence RBPdetect2
Probability 0,66
Seq2Symm
C3 confidence 0,998
C3 0,998
C1 0,028
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSNARDKANIPVLNFQSKGIDDNATSTVLTITSGTDVQIGSTNSGVGGTIDLSIGNTSSSGGITLWSTTTSSHSIGFADGYTGTDRYRGYLEYTHSGDSMRFGTASSEKMRLNSTGLGIGTSSPLATLHVDTSNSAVAPNAEADDFFVEGNSHSGITIGSGSSHRSSIYFANSSDNDIARIVVSHAEGSMRFNNNASERMRITSGGNLIIGDTTEADARTGKLKVRNDVDYSSTEFEDDATILVQNETNNNSASIVFHSNNASGSSKRSAIIGGFIKDTDTAIGFYGAIENKTTSSNPDVIINSSGQVGIGTSSPSKPLEIVSSAQTTLLHLNSTAGTTSAITFENTGSNDSITIGAENDDLKLRTDDGVIKFFTNENSEKMRIDSSGNVGIGTTSPTPPTAYGGLHINSQYPVLKLSSTTSGTGVADGFTVRINSADDAQLWHYENKNMSFATNNAERMRITSDGRFGMNGRTNPQYTLEFGDSGTGNGWSINAENNVHKIRTRASAGDTQTHVQWENTNGIVGSVKTNGSATQYNTSSDYRLKENVSYDFDATTRLKQLKPARFNFIADDTDTLVDGFIAHEVSTIVPEAVSGAKDSMFAEVLYEEGDELPEGKNVGDVKTSAQIDPQGIDQSKLVPLLVKTIQELEARITTLEANNP
Physico‐chemical
properties
protein length:660 AA
molecular weight: 70091,45560 Da
isoelectric point:4,83486
aromaticity:0,06364
hydropathy:-0,46697

Domains

View on InterPro
WMM95392.1
1 660 aa
CHP 540–659 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WMM95392.1
1 660 aa
Domain Start End Length (AA) Confidence
N-terminal 1 10 10 0,0038
Central domain 11 209 200 0,0482
C-terminal 210 660 450 0,9482
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Pelagibacter phage HTVC134P [NCBI] · taxon 3072836

Coding sequence (CDS)

Genbank protein accession
WMM95392.1 [NCBI]
Genbank nucleotide accession
OR420744.1 [NCBI]
CDS location
range 35534 -> 37516
strand +
CDS
ATGAGTAACGCAAGAGATAAAGCTAACATACCAGTATTAAATTTTCAATCTAAAGGTATAGATGATAATGCTACAAGTACAGTATTAACAATTACAAGTGGTACAGATGTTCAAATCGGTTCAACTAATTCTGGTGTAGGTGGTACAATAGATTTATCTATAGGAAATACATCTTCATCTGGTGGTATAACTTTATGGTCTACTACAACTTCGTCTCACTCTATTGGATTTGCTGATGGATATACTGGAACAGATAGATACAGAGGTTATTTAGAATACACACATAGTGGCGATAGTATGCGATTTGGTACAGCAAGTTCAGAAAAAATGAGATTAAATTCTACTGGATTAGGTATTGGTACAAGTTCTCCATTAGCTACACTTCATGTTGATACTTCTAATAGTGCTGTAGCACCTAATGCCGAAGCAGATGATTTCTTTGTAGAAGGTAATAGTCACTCAGGAATAACCATTGGCTCTGGTTCAAGTCATCGTTCTAGCATTTATTTTGCAAACTCAAGTGATAATGATATTGCTAGAATTGTAGTTTCTCATGCTGAAGGTAGTATGAGATTTAATAATAATGCTTCAGAACGTATGCGTATCACATCAGGTGGTAATTTAATAATTGGAGATACTACAGAAGCAGATGCAAGAACAGGAAAATTAAAAGTACGAAATGATGTGGATTATTCCTCAACTGAATTTGAAGATGATGCAACAATTTTAGTTCAAAATGAAACAAACAACAATTCTGCATCTATAGTATTTCATTCTAATAATGCTTCTGGTAGTTCCAAACGTTCTGCAATTATTGGTGGATTTATAAAAGATACTGATACTGCTATTGGTTTTTATGGAGCTATTGAAAATAAAACAACATCTTCAAATCCAGATGTAATTATCAACAGTTCTGGTCAAGTTGGCATCGGAACGTCATCGCCATCGAAACCATTAGAAATTGTTAGTTCTGCACAAACAACTTTATTACATTTAAATTCTACAGCAGGAACAACTTCAGCTATAACTTTTGAAAACACAGGCTCTAACGACAGTATTACTATTGGTGCTGAAAATGATGATTTAAAATTAAGAACTGATGATGGTGTTATAAAATTCTTTACTAATGAAAATAGTGAGAAAATGCGTATAGACAGTTCTGGTAACGTAGGTATTGGTACAACTTCTCCAACACCACCAACTGCTTATGGTGGATTACATATTAACTCTCAATATCCAGTATTAAAATTAAGTTCAACCACTTCTGGTACTGGTGTTGCAGATGGTTTTACAGTTAGAATTAATAGTGCTGATGATGCACAGTTATGGCATTACGAAAATAAAAATATGTCATTTGCTACTAATAACGCAGAACGTATGCGTATTACTAGTGATGGAAGATTTGGAATGAATGGTAGAACAAATCCTCAATATACTTTAGAATTTGGAGATAGTGGTACTGGAAATGGGTGGTCTATAAATGCTGAAAATAATGTACACAAAATAAGAACAAGAGCATCAGCAGGGGACACTCAAACTCATGTTCAATGGGAAAATACTAATGGTATTGTTGGTTCAGTTAAAACAAATGGAAGTGCCACTCAATATAACACTTCTTCCGATTACAGATTAAAAGAAAATGTATCTTATGACTTTGATGCAACAACAAGATTAAAACAATTGAAACCTGCAAGATTTAATTTTATAGCAGATGATACAGATACTCTTGTTGATGGTTTTATAGCACATGAAGTATCTACTATAGTGCCTGAAGCTGTTAGTGGTGCAAAAGATAGTATGTTTGCTGAAGTTCTATATGAAGAAGGTGATGAATTACCTGAGGGTAAAAATGTTGGTGATGTCAAAACATCTGCACAAATAGACCCACAAGGTATCGACCAATCTAAATTAGTACCTTTACTGGTTAAAACAATTCAAGAATTAGAAGCTAGAATAACAACACTAGAAGCTAATAACCCATAA

Genome Context

Tertiary structure

WMM95392.1
ESMFold structure
Source ESMFold
pLDDT 69.0
Oligomeric state monomer