Genbank accession
WEM32681.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,86
TSP
Evidence RBPdetect2
Probability 0,53
Seq2Symm
C3 confidence 0,996 truncated
C3 0,996
C1 0,003
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MADIKVVRIESLPATTAVTEDDYLVVQQPDLTRRVKIGDVVHVDGTVSHVISFKEGGKLNGPMDFAYFEEEDLYLRWKGEFPHTVPALSSPYSDGGITDAAWMVYTDPSLREELESTIGASMIMTAEGQSVQDVMDVTVQTANDAKALAQRVDFGTVHTVGDVVHLVNFVGPAVIEEGRTTNYPSVAAGEKFLNGVVSRRDTTTVDGIFRGATSGAMYTIAVTNGVVTTKRIALRDEFKRLEANNPTRTVIRAGDDVNTAGYLQLDATGRWGMWNQQTASWQPLAIEQGGTGARDAAGARINLGAFYKQRAALEANFNINNLTGNQDGVYYQPMTANATEANGYPAGSGAGHLIVWQNNANGGTGCRQEYYPFSNVDVWYLRTYQANTNQWTAWQPMVRPRNDETFRSHIGLGSRNSPTFGHLYLSQSSADVKSASGIVNGDKYSADGVLEHGYRIYSEVRNDNKAWLTIHLHKGAKGSETHRYLGFREDGVLDCPKYMQVGDLTGQLTNWGLGEWIRSSGAERGFWGSKKAAKMVIWDGGMDESGNGTLEWGVYNNRKAKWEPLPQAAGGTGATTLADAQNLFKVPIAAGVKDFLTLPRTAGMEDGKYYPIIVRTDPYYAPATGTDITIVTRSSSGNDPMNCATLQCHYRTGGWTDRGGSFYGVVNFYQNEKAILGMVAPTRGKQEYVAFYVEARAFPVSIYASRNVVEVFTREQDYQVGSVTNNQDGVKFVSPLQSADLNLAILGDNNTNTRPIVDFKGTSGFYTGGGTQWHYIGTAERYAVMSKMNMPKVELWADGLDYLCYGSPRKALFSNAGFQCASDGTEDLTNGTFTSKCGNGAGLKGQAEFRSTPEAGQVIVRDVVGSAHRFYNFNKDGTFSAPGGFVCHTGADWNNQFGNNNPSKILAGNVNGPEGSMVVGGLSVAFSGNYAFQMAGRLDQLYTRSIEQGNHRAWNKVIQHRGQGLGTSDLNDYKADREGIYHQEANANATAERHYPPGQQMAGTLIVLRNSANEGTGCVQIYKMYLGGTWERYYNNTGSGMNWSPWKRTSFPESTTAPVMPDLWLPLTSNLKPVLGEGEMIFSRPSTATYFTKRGVMAVAQANQPRFERDGLLIEGQRTNLMLNSEDPSKWGASQQITVGSTVTNTNGTKGARFTVNTISGVETTALNLATVPATRGADVTGAEKFCTGSIIARGGKAHQRLRVRFDMYDGSTTVFQGDAYVNLSTLEVKTTGVAAGRIKVKAERWQTAGPAWIRVVATFEAVDSDMNIGCQFQIAPPDGSQHAVGDWVDVAIPQFELGSCESSFIPTGSSPVTRAADLCKFPMTDNLAPRPFTIAATVDANWRGWGKAPNAAPRVIDTEGHQSGAAFIMGFGSAANIAEDGYPYCDIGGSNRRVYEMAKTRKLKIGFRIKDDGKTCSFANGLVSTETQSSWEFLAGGALIRLGGQTATGERHLFGHIKDVRVWNSALTDTQLMMESVE
Physico‐chemical
properties
protein length:1479 AA
molecular weight: 160853,79910 Da
isoelectric point:6,14693
aromaticity:0,09804
hydropathy:-0,37329

Domains

View on InterPro
WEM32681.1
1 1479 aa
ATT 46–117 · STR 310–395 · STR 961–1048 · STR 1411–1473 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WEM32681.1
1 1479 aa
Domain Start End Length (AA) Confidence
N-terminal 1 575 575 0,4594
Central domain 576 774 200 0,2935
C-terminal 775 1479 704 0,8263
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WEM32681.1 [NCBI]
Genbank nucleotide accession
OQ420740.1 [NCBI]
CDS location
range 50232 -> 54671
strand +
CDS
ATGGCTGATATTAAAGTTGTCAGAATTGAATCTCTTCCTGCCACTACCGCAGTGACAGAGGATGATTACCTGGTTGTTCAACAACCAGACCTGACCCGTCGTGTGAAAATTGGCGATGTTGTCCATGTGGATGGGACTGTTTCTCATGTAATCTCCTTTAAGGAAGGTGGTAAGTTAAACGGCCCAATGGATTTTGCCTACTTCGAAGAGGAAGATCTATACCTGCGTTGGAAAGGCGAATTTCCACACACTGTTCCTGCACTGTCTTCACCATATTCTGATGGTGGGATTACCGATGCTGCATGGATGGTATATACAGACCCGTCCTTAAGGGAGGAGCTGGAGTCTACCATTGGTGCGTCTATGATTATGACAGCCGAAGGGCAGTCTGTCCAGGATGTAATGGATGTTACTGTTCAGACAGCCAACGATGCTAAAGCACTTGCACAGCGGGTAGATTTTGGTACAGTACATACTGTGGGCGATGTTGTTCACCTTGTCAACTTTGTTGGCCCTGCAGTTATTGAAGAGGGACGAACCACTAACTATCCTTCCGTAGCAGCTGGTGAAAAATTTCTGAATGGTGTGGTATCTCGTCGTGATACTACAACTGTTGATGGTATTTTCCGTGGCGCTACTTCCGGAGCCATGTATACCATTGCAGTAACAAACGGTGTGGTAACAACAAAAAGAATAGCCCTTCGTGATGAATTTAAACGCCTGGAGGCAAATAATCCAACAAGAACAGTTATCCGTGCTGGGGATGATGTAAACACAGCAGGGTACTTGCAGCTTGATGCAACAGGCCGTTGGGGTATGTGGAACCAACAGACAGCTTCGTGGCAACCTCTTGCTATAGAGCAGGGCGGCACAGGAGCTAGAGATGCCGCAGGTGCACGCATTAACCTAGGTGCTTTCTATAAGCAACGTGCAGCCCTTGAGGCAAATTTCAATATCAATAACCTGACTGGTAATCAGGATGGTGTATACTACCAGCCTATGACTGCTAATGCAACTGAGGCAAATGGTTACCCTGCGGGTTCTGGTGCGGGTCACCTAATTGTTTGGCAGAACAATGCTAACGGCGGCACAGGCTGTCGTCAGGAATACTACCCATTCTCTAACGTAGATGTTTGGTATTTGAGAACCTATCAGGCCAACACAAACCAGTGGACTGCATGGCAGCCGATGGTCAGACCTCGTAACGATGAGACCTTTAGATCGCACATCGGTCTTGGGTCTAGGAATTCTCCTACCTTCGGGCACCTTTACTTATCTCAAAGTTCTGCTGATGTCAAGTCGGCATCTGGCATTGTTAACGGGGACAAGTACAGTGCTGACGGTGTCCTTGAGCATGGGTATAGGATCTATTCCGAGGTAAGAAACGACAATAAGGCGTGGTTAACAATCCACCTGCACAAAGGTGCAAAAGGATCTGAAACTCATAGATATTTAGGTTTCCGCGAAGACGGCGTATTAGACTGCCCTAAATACATGCAGGTTGGGGATCTTACTGGTCAGCTGACAAACTGGGGACTCGGAGAATGGATCCGTAGTTCAGGAGCAGAAAGAGGGTTCTGGGGATCCAAGAAAGCCGCCAAGATGGTCATCTGGGATGGCGGGATGGATGAATCCGGTAATGGTACTCTAGAATGGGGTGTTTATAACAACCGGAAGGCCAAGTGGGAACCTTTACCTCAAGCCGCAGGTGGTACTGGGGCTACAACTCTAGCAGATGCTCAGAATCTGTTCAAAGTTCCTATAGCAGCAGGTGTAAAAGACTTCTTAACACTGCCAAGAACCGCAGGAATGGAAGATGGGAAATACTACCCGATCATCGTCAGAACAGATCCGTACTATGCTCCAGCAACTGGCACTGATATTACCATAGTTACCAGATCGTCATCTGGAAATGACCCTATGAACTGTGCTACCTTACAGTGTCACTATAGAACTGGAGGATGGACAGACAGAGGAGGCTCTTTCTACGGGGTAGTAAATTTCTACCAGAATGAAAAAGCAATTCTTGGGATGGTTGCTCCAACAAGGGGTAAACAAGAGTATGTTGCTTTCTATGTGGAGGCTCGTGCTTTCCCTGTCAGCATATACGCAAGTAGAAATGTTGTCGAAGTGTTTACCAGAGAGCAAGATTATCAGGTCGGCTCTGTAACAAACAATCAGGACGGTGTTAAGTTCGTTTCACCTCTCCAGTCGGCAGACTTGAATCTTGCTATTCTTGGAGATAACAATACAAACACCAGACCTATTGTTGACTTCAAAGGCACCTCTGGGTTCTACACTGGCGGCGGCACACAGTGGCACTATATAGGCACTGCTGAGCGCTATGCAGTGATGAGCAAAATGAACATGCCAAAAGTCGAGCTATGGGCAGACGGTCTTGACTATTTGTGCTACGGCAGTCCTAGAAAGGCGTTATTCTCTAATGCAGGATTCCAGTGTGCATCAGACGGGACAGAAGACCTGACTAACGGTACGTTTACCTCTAAATGCGGTAATGGTGCTGGCCTCAAAGGACAGGCAGAGTTCAGATCTACTCCAGAAGCTGGTCAAGTTATTGTTCGTGATGTTGTAGGTTCTGCTCACAGATTCTACAATTTCAACAAAGATGGTACTTTCTCAGCACCGGGTGGTTTTGTATGTCATACTGGTGCAGATTGGAACAATCAGTTCGGGAATAATAATCCGTCCAAAATACTGGCTGGCAATGTCAACGGACCTGAAGGTTCAATGGTTGTTGGCGGGTTGTCTGTGGCATTTTCTGGAAACTATGCTTTCCAGATGGCAGGCCGTTTAGATCAGCTGTACACCCGTTCCATAGAGCAGGGTAACCACAGAGCGTGGAACAAAGTTATTCAGCACCGTGGTCAAGGGTTGGGTACTAGTGACCTTAACGATTACAAAGCGGATCGCGAAGGTATTTACCATCAAGAGGCAAATGCCAACGCCACAGCGGAAAGACACTATCCACCAGGGCAGCAGATGGCTGGTACGCTGATCGTGCTTAGAAACTCTGCCAACGAGGGTACTGGGTGTGTCCAGATATATAAAATGTATCTTGGTGGGACGTGGGAAAGGTATTATAATAACACTGGCAGTGGGATGAACTGGAGCCCTTGGAAGAGAACTAGCTTCCCAGAAAGTACAACTGCCCCAGTTATGCCAGATCTGTGGCTACCTTTAACCTCTAACCTGAAACCTGTGTTAGGTGAGGGGGAGATGATCTTCTCCAGACCTTCTACCGCAACCTATTTCACTAAGCGTGGTGTTATGGCTGTTGCACAAGCAAACCAACCACGTTTCGAAAGAGATGGGCTGCTTATTGAAGGGCAAAGGACAAACCTAATGCTTAATAGTGAGGACCCAAGTAAGTGGGGGGCAAGTCAACAGATCACTGTTGGTAGCACTGTAACAAACACTAATGGAACAAAAGGTGCAAGATTTACAGTAAACACCATATCCGGTGTAGAAACAACAGCGTTAAACCTAGCTACGGTTCCAGCCACCAGGGGTGCCGATGTAACAGGTGCTGAGAAATTCTGTACTGGGTCTATTATTGCAAGGGGCGGTAAAGCTCACCAAAGACTGCGTGTAAGATTCGACATGTACGACGGGTCCACCACAGTATTTCAAGGTGATGCTTATGTCAACCTGTCAACACTTGAAGTTAAAACAACAGGTGTCGCAGCTGGGAGAATTAAAGTAAAAGCTGAGAGATGGCAAACAGCCGGACCTGCTTGGATAAGAGTTGTTGCTACGTTTGAGGCAGTGGACTCTGACATGAATATTGGGTGCCAGTTCCAGATTGCCCCACCGGATGGTTCTCAACATGCCGTAGGGGATTGGGTTGACGTCGCAATACCTCAGTTTGAGTTAGGATCTTGTGAGTCCTCGTTTATCCCTACAGGGTCTTCACCAGTGACTAGGGCAGCAGACCTTTGTAAATTCCCAATGACTGATAATTTAGCACCTAGACCGTTCACCATCGCCGCTACGGTGGATGCCAACTGGAGAGGTTGGGGAAAAGCTCCTAACGCAGCTCCTAGAGTTATTGATACAGAGGGCCACCAATCAGGTGCTGCATTTATCATGGGATTTGGCTCTGCAGCAAATATTGCAGAAGATGGTTATCCATATTGTGATATTGGCGGTTCAAACAGACGTGTCTATGAGATGGCTAAAACACGTAAATTGAAAATTGGGTTCAGGATAAAAGATGACGGTAAAACCTGCTCTTTTGCTAACGGATTGGTGAGTACGGAAACGCAATCTTCTTGGGAATTCCTGGCAGGAGGCGCTCTCATCCGTCTCGGAGGTCAAACGGCGACAGGTGAAAGACATTTGTTTGGTCATATTAAAGATGTAAGAGTTTGGAACTCTGCATTGACCGACACCCAGCTTATGATGGAGAGTGTTGAATAA

Genome Context

Tertiary structure

WEM32681.1
ESMFold structure
Source ESMFold
pLDDT 59.7
Oligomeric state monomer