Genbank accession
WQZ19206.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,98
Seq2Symm
C3 confidence 1,000
C3 1,000
C1 0,004
D3 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MGYFQMTRNVEELFGGVVTAPHQIPFTYKSSVGGETFISLPFYPVTGVVTINGGMQVPLDNFEIDGNTLNLGRALSKDDVVYCLFDKILSPEDTSKGIRIYKFQAVGGETEFTPDFTSYGVQSLYIGGEYKTPDIEYSYNSTTGKVSLQTALTAGVWVVAEMSVKQPNISPAFDRSIQEIARSANVKDSEVIVSTDTISLLDDKKVVYDSAAQVIYGLPTIPDGSVISSVSDGKLTYNPGDVQVDLLPLPDSAQAVKLFYLQPSGAENIKVSSGDTVQDILNNINKHRVVSSISELLNISPTETSVVFVASFHPSTNYGGGFFRWDPSGNKATHNGGTIIDPDKTFPTWDSAGKTSWFTASGTGTGVWRRQDVMGHYRAEDFGALPWNVGDAHDSTKEFQQVANVAYRGGCWRWTGRHRITSYIDIPNKQTFGSYAQMTSVYSELFQPSNFQGVHVISDPSLARSVQNAVFFDAATGEAFRCGEGASPTDFLVYGRGFTTTGMDLATSLPSAASYCDTQAFRHGKAINVRNVTVALMKYALDSNPWDASKGDYYSTTDHMTILYCYCISRVPTGQDITFNTKHINMRAYVNQIGDYGLAVRNVVFIGGSIEGYNTSTFLRSSTQLSFKGTYFETGDTSFNGTVFSLVGWCTLNFEECLVYLNNTTNFVSSGGSGQSAGVLGLTIKSQGNVWRKTDAGTTTVFAVDPVTNKQALVGSEILNAASGATIAYWAGAVPPGTYTAPISVAF
Physico‐chemical
properties
protein length:747 AA
molecular weight: 80944,40910 Da
isoelectric point:5,14929
aromaticity:0,11513
hydropathy:-0,13507

Domains

View on InterPro
WQZ19206.1
1 747 aa
ATT 161–249 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WQZ19206.1
1 747 aa
Domain Start End Length (AA) Confidence
N-terminal 1 392 392 0,9923
Central domain 393 721 330 0,9847
C-terminal 722 747 25 0,4351
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WQZ19206.1 [NCBI]
Genbank nucleotide accession
OR924452.1 [NCBI]
CDS location
range 91433 -> 93676
strand +
CDS
ATGGGGTATTTTCAAATGACCAGAAATGTAGAAGAATTATTCGGCGGCGTAGTCACAGCTCCCCACCAGATTCCTTTCACTTATAAATCAAGTGTCGGTGGAGAAACTTTCATTTCTCTACCTTTCTATCCTGTCACTGGTGTTGTCACAATTAACGGCGGCATGCAAGTTCCGTTAGACAACTTCGAGATAGACGGGAATACGTTAAACCTCGGGCGCGCATTGTCTAAAGATGACGTGGTTTATTGCCTGTTCGACAAAATCCTTTCACCAGAAGATACTTCTAAAGGCATTCGAATATACAAATTTCAAGCCGTGGGTGGGGAAACTGAATTCACGCCTGACTTTACTTCTTATGGTGTACAGTCTCTTTATATCGGTGGCGAGTACAAAACCCCAGATATAGAATATTCATACAACAGTACGACTGGGAAAGTTTCCCTACAAACTGCTCTGACTGCAGGGGTGTGGGTTGTTGCGGAGATGTCTGTTAAACAACCGAATATCAGTCCGGCGTTCGATCGCAGTATCCAAGAAATTGCCCGTTCGGCTAACGTAAAAGACTCTGAAGTCATTGTCAGCACTGATACCATATCTTTACTCGACGACAAGAAAGTTGTTTATGATTCAGCAGCGCAGGTTATTTATGGTTTACCAACTATTCCTGATGGTTCAGTGATTTCTTCTGTATCTGATGGAAAATTGACTTATAATCCAGGTGATGTGCAGGTTGATCTGTTACCATTACCAGATTCTGCCCAGGCAGTTAAATTATTCTATTTGCAACCAAGTGGCGCAGAAAATATTAAAGTTTCCAGTGGCGACACAGTACAAGATATTCTGAATAATATCAATAAACACCGTGTTGTAAGCAGCATTTCAGAACTTTTGAATATATCTCCAACAGAAACGTCAGTTGTATTCGTGGCATCTTTCCATCCATCAACCAATTACGGGGGTGGATTCTTCCGTTGGGATCCGTCTGGAAACAAGGCAACCCACAATGGTGGTACGATTATTGATCCTGATAAAACGTTTCCGACTTGGGACAGCGCAGGTAAAACTTCTTGGTTTACCGCAAGCGGGACGGGTACTGGTGTTTGGCGTCGGCAAGACGTGATGGGTCATTACCGTGCTGAAGATTTCGGTGCACTCCCTTGGAACGTCGGGGACGCGCATGACAGTACCAAAGAATTCCAACAAGTGGCTAATGTGGCTTATCGGGGCGGTTGCTGGAGATGGACAGGTCGCCATCGCATTACGAGTTATATCGATATCCCCAATAAACAGACTTTTGGTTCATACGCCCAAATGACTTCTGTTTATTCTGAATTATTCCAGCCTAGCAATTTCCAGGGGGTGCACGTTATTTCTGATCCTTCTTTAGCGCGTTCTGTGCAAAATGCAGTCTTCTTTGATGCTGCGACCGGAGAAGCATTCCGTTGTGGGGAAGGTGCATCCCCGACCGATTTTTTGGTGTACGGAAGAGGGTTTACAACTACTGGGATGGATTTGGCAACATCATTACCTTCGGCGGCGTCGTATTGTGACACCCAAGCATTCCGTCATGGGAAGGCTATTAACGTGCGAAATGTTACTGTTGCGCTTATGAAGTACGCATTGGATTCTAATCCATGGGATGCCAGCAAAGGTGATTATTATTCCACAACGGATCATATGACGATTTTGTATTGTTATTGCATTAGTCGTGTACCAACTGGCCAGGATATAACATTTAACACCAAGCATATCAATATGCGTGCATATGTAAACCAGATTGGCGATTATGGATTGGCAGTCCGAAATGTGGTGTTTATCGGTGGATCCATAGAAGGATATAACACTTCAACATTCTTACGATCCAGTACTCAACTTTCTTTCAAAGGCACATATTTTGAAACGGGTGACACGTCATTCAATGGTACAGTATTCAGCCTTGTTGGTTGGTGTACTCTTAACTTTGAAGAATGTCTTGTTTATTTGAACAACACCACAAACTTCGTGTCTTCTGGTGGTTCTGGGCAATCTGCTGGCGTCTTGGGTCTAACGATTAAATCTCAAGGTAACGTGTGGCGTAAAACTGACGCGGGGACAACCACAGTGTTTGCAGTTGACCCAGTCACTAATAAACAAGCCTTAGTTGGATCCGAAATATTGAATGCTGCGAGTGGGGCAACTATCGCATATTGGGCTGGTGCCGTCCCACCTGGCACATACACGGCTCCAATCAGTGTTGCATTTTAA

Genome Context

Tertiary structure

WQZ19206.1
ESMFold structure
Source ESMFold
pLDDT 72.4
Oligomeric state monomer