Genbank accession
WWD14705.1 [GenBank]
Protein name
straight fiber tail protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,89
TF
Evidence RBPdetect2
Probability 0,46
Seq2Symm
C1 confidence 0,922
C1 0,922
C3 0,626
C2 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MISNNAPAKMVLNSVVTGYTLAYIQHSIYSDYDVIGRSFWLKEGSNITRRDFTGVDTFSVTINNLKPTATYEVQGAFYDSIIDSELLNAQIGINLSDKQTFKMKSAPRITSARCESEPVDVGVGAPIVYLNTTGEADYCTIELKNNSNANNPWVKYYVGALMPTIMFGGVPVGSYKVRISGQVSLPDGVTIDSSGYYEYPTVFEVKYNFVSPTAPVNIVFKAARIADGKERYDLRVQWDWNRGTGANVREFVLSYIDSTEFAKTGWTKAQKINVGAAQSATIISFPWKVEHKFKVSSIAWGPNIQDTTDSTAQTFILNEDTPLDNNFVNETGIEVNYAYIKGKIKEGTTWKQTFLIDAATGAVNIGLLDAEGKAPISFDPIKKIVNVDGSVITKTINAANFVMTNLTGQDNPAIYTQGKTWGDAKSGIWMGMDNTNAKPKLDIGNATQYIRYDGDTLRISNKVVIGTPNGDVDLGTGMQGKQTVFVYKLASSLPAKPLEQDYPPPSWSKTPPNRTDMTQNIYVTTGTLDPVTNKLLVGTSWSDVVQWSGTEGTIGHDGQRGPGMYSLGISGLGGWNDSQANAFFQNNFGSPPVKYDVLTEFNSSAPQSAFTRQWNGSSWADPAMVLHGNMIVNGTVTASKIVANDAFLSQIGVNVIYDRNAALSNNPEASYRMKIDLATGYIHIR
Physico‐chemical
properties
protein length:685 AA
molecular weight: 74861,24940 Da
isoelectric point:5,61248
aromaticity:0,10365
hydropathy:-0,25971

Domains

View on InterPro
WWD14705.1
1 685 aa
STR 10–97 · STR 103–197 · STR 212–335 · STR 350–664 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WWD14705.1
1 685 aa
Domain Start End Length (AA) Confidence
N-terminal 1 410 410 0,8818
Central domain 411 651 242 0,1617
C-terminal 652 685 33 0,8852
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WWD14705.1 [NCBI]
Genbank nucleotide accession
OR896848 [NCBI]
CDS location
range 105818 -> 107875
strand +
CDS
ATGATTTCAAATAATGCACCAGCTAAAATGGTCCTAAATAGCGTCGTAACTGGATATACATTGGCGTATATCCAGCACTCTATCTACTCTGATTACGATGTTATAGGCAGATCTTTTTGGCTTAAAGAAGGTAGCAATATTACTCGTAGAGATTTTACTGGAGTTGATACCTTCTCTGTAACTATTAATAATCTAAAACCTACAGCAACGTATGAGGTTCAGGGTGCATTTTATGATTCTATAATAGACTCTGAACTACTTAATGCTCAGATAGGTATTAATCTGTCTGACAAACAAACTTTTAAAATGAAGTCAGCACCTAGAATCACGAGTGCTAGATGTGAATCAGAGCCGGTAGACGTAGGTGTTGGGGCACCAATAGTTTATCTAAATACTACGGGAGAAGCTGATTATTGTACTATAGAATTAAAAAATAATTCTAATGCTAATAATCCGTGGGTTAAATATTATGTTGGGGCATTAATGCCAACTATTATGTTTGGTGGTGTGCCAGTTGGGTCTTATAAGGTAAGAATTTCTGGACAAGTATCTCTACCAGATGGGGTAACTATTGATTCATCTGGCTACTATGAGTACCCTACTGTTTTTGAAGTTAAATATAACTTTGTATCACCTACAGCTCCAGTTAATATTGTATTTAAAGCTGCGCGTATAGCCGATGGTAAAGAACGCTATGATTTACGTGTACAATGGGATTGGAACAGGGGCACAGGTGCTAACGTTCGTGAATTCGTTCTATCCTATATAGATTCAACAGAATTTGCTAAAACTGGATGGACTAAGGCACAAAAAATCAACGTGGGGGCTGCTCAGTCGGCAACAATTATATCATTCCCCTGGAAGGTAGAACATAAATTTAAGGTTTCATCTATTGCTTGGGGACCAAATATACAGGATACTACTGATTCCACAGCACAGACATTTATACTAAATGAAGATACCCCACTTGATAATAATTTTGTTAACGAAACGGGTATAGAAGTTAACTATGCATACATTAAGGGTAAGATCAAAGAGGGCACAACCTGGAAACAAACCTTCCTAATAGATGCCGCCACTGGTGCTGTTAATATAGGTCTTCTAGACGCGGAAGGAAAAGCGCCAATATCTTTTGATCCTATTAAAAAGATTGTTAACGTTGATGGTAGTGTAATCACTAAAACTATTAATGCTGCTAACTTTGTCATGACTAACCTAACTGGTCAAGATAACCCGGCAATATATACACAAGGTAAAACTTGGGGAGATGCAAAGTCTGGTATTTGGATGGGTATGGATAATACCAATGCTAAACCTAAATTAGACATCGGTAACGCTACACAGTATATACGTTACGATGGCGATACATTGAGAATTTCTAATAAAGTTGTAATTGGTACACCAAATGGCGATGTAGATCTTGGTACAGGTATGCAAGGTAAACAAACAGTATTCGTTTATAAATTAGCATCCTCACTTCCTGCAAAACCACTAGAGCAAGATTATCCACCACCTAGTTGGTCGAAGACCCCACCTAACCGTACGGATATGACTCAAAATATCTATGTGACTACAGGTACACTTGATCCAGTAACTAATAAATTACTTGTAGGTACTAGCTGGTCAGATGTAGTTCAGTGGAGTGGTACTGAAGGTACAATTGGACACGATGGACAACGTGGTCCTGGGATGTACTCTTTAGGTATTTCTGGTCTTGGGGGTTGGAATGACAGCCAGGCTAATGCCTTCTTTCAGAATAATTTTGGTAGTCCTCCAGTTAAATATGACGTGTTGACTGAGTTTAATAGTAGTGCTCCACAATCTGCATTTACTCGTCAATGGAATGGCTCCAGTTGGGCTGACCCTGCGATGGTTTTACACGGCAATATGATAGTTAACGGTACGGTAACCGCTAGTAAGATTGTGGCGAATGATGCCTTCTTATCTCAGATAGGTGTTAACGTTATCTATGATAGAAATGCAGCGTTATCAAACAATCCGGAAGCCTCTTACAGAATGAAGATAGACCTAGCTACTGGGTATATCCATATAAGGTAA

Genome Context

Tertiary structure

WWD14705.1
ESMFold structure
Source ESMFold
pLDDT 77.9
Oligomeric state monomer