Genbank accession
QRE00331.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,86
TF
Evidence RBPdetect2
Probability 0,59
Seq2Symm
C1 confidence 0,459
C1 0,459
C2 0,004
C3 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAKTPQLLVTDKGLAAASDATPYGPFVRVTQFRIGDAYGYAPQRTDEDINGHLLFSDKPTTYNYVGDNTINIILRIPPDAGPFAFGEVGIYIDDPNDPNYNWTADPLNPNEEPPNIAKILFAKAVFDEPQQKYSSLGTNVGSSYTFNCLLKLEQSVAIFQISDATYYPAILDVACWSDVIPPNQQANPEVKSLRVAEWNGSGDVSFLNAVDQPDAAQFWAVNSTSYYRYRSVKGDRTASHGEFPVANASQSWIDIDASRLHVNDITQANRQFLIRTSEGHFRSVQSVVQMGNNYRFNLNVTNDGRYQNRLLPSIPPIGSLVTVWRDDQAGGTVFYDNIVDPPPPPPLANWDVPGLATVGSGGLTLEAPGRLATHGLLHDVPNSGRGFANGEDISQLFPTGIYMINGNQPGVPVGQVAAHLLHIWYGGGVTQVFYPLDRPDIPTYWRWWANNRWGPWRYYWTDANNNLPPMPPVIMTGVNIDQLGQNWSDPGQAVGIGQRCMWVLNLNDGGGGGDCIVRCDFTRTSPPGRQIVGRASRYGGAGYGRWATVTGMANAGDTLYFQMKDWNTRTLYRYYF
Physico‐chemical
properties
protein length:576 AA
molecular weight: 63696,30910 Da
isoelectric point:5,14935
aromaticity:0,11979
hydropathy:-0,36944

Domains

View on InterPro
QRE00331.1
1 576 aa
STR 399–460 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QRE00331.1
1 576 aa
Domain Start End Length (AA) Confidence
N-terminal 1 220 220 0,9663
Central domain 221 419 200 0,1761
C-terminal 420 576 156 0,9440
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QRE00331.1 [NCBI]
Genbank nucleotide accession
MW460245.1 [NCBI]
CDS location
range 199661 -> 201391
strand -
CDS
ATGGCAAAAACACCTCAATTACTTGTGACCGATAAGGGACTGGCAGCGGCGTCAGACGCCACCCCTTACGGTCCTTTCGTCCGTGTCACGCAGTTCCGAATCGGTGACGCCTATGGCTACGCGCCGCAGCGTACCGATGAGGACATCAACGGCCACCTGCTGTTCTCGGACAAGCCGACCACGTATAACTACGTGGGCGACAACACGATCAACATCATCCTACGGATCCCGCCTGACGCTGGTCCGTTCGCCTTCGGCGAAGTTGGTATATACATAGACGATCCGAACGATCCGAATTACAACTGGACGGCTGACCCTCTGAATCCAAATGAGGAGCCGCCGAACATCGCCAAGATTCTGTTCGCGAAGGCAGTGTTCGATGAACCCCAGCAGAAGTATAGCTCGCTCGGCACGAACGTCGGTTCGTCTTACACGTTCAACTGTCTGCTCAAGCTGGAACAGTCGGTCGCGATCTTCCAAATCTCAGACGCTACGTATTATCCGGCTATCCTGGATGTCGCATGCTGGTCGGATGTGATTCCGCCTAACCAACAAGCCAACCCTGAGGTAAAGTCTCTGCGTGTCGCAGAATGGAACGGCTCTGGTGACGTCAGTTTCCTGAATGCAGTGGACCAGCCAGATGCAGCTCAATTCTGGGCAGTCAACAGTACCTCATACTACCGGTATCGCTCTGTGAAGGGTGACCGCACTGCATCTCACGGAGAGTTCCCTGTCGCGAACGCGAGCCAAAGCTGGATCGATATAGATGCATCACGCCTTCATGTCAACGATATCACGCAGGCGAATCGTCAGTTTCTGATTCGCACCAGTGAAGGTCATTTCCGCAGCGTGCAGAGTGTTGTCCAAATGGGCAACAACTACCGCTTTAACCTGAACGTGACCAACGATGGTCGCTATCAAAACCGTTTGTTGCCGTCTATTCCGCCGATCGGCTCTCTCGTTACGGTATGGCGTGACGACCAGGCAGGTGGTACAGTCTTCTACGACAACATCGTAGACCCGCCGCCGCCGCCACCTTTGGCGAACTGGGATGTACCTGGCCTTGCGACAGTCGGCAGCGGTGGTCTCACGCTTGAGGCACCTGGTCGCCTTGCAACGCACGGTCTCTTGCATGATGTACCGAATTCTGGTCGCGGCTTCGCTAACGGTGAGGACATAAGCCAGCTATTCCCGACAGGCATCTACATGATTAACGGGAACCAACCTGGAGTCCCTGTTGGTCAAGTGGCAGCTCATCTTTTGCACATCTGGTACGGCGGGGGTGTTACTCAGGTCTTCTATCCTCTGGATCGTCCAGACATTCCGACCTACTGGCGCTGGTGGGCGAACAACCGTTGGGGGCCGTGGCGCTACTATTGGACGGATGCGAACAACAATCTGCCGCCGATGCCTCCTGTCATCATGACAGGTGTGAACATCGACCAACTGGGCCAGAACTGGTCTGATCCTGGTCAGGCCGTCGGTATCGGCCAACGGTGTATGTGGGTTCTGAACCTTAACGACGGCGGTGGCGGTGGCGATTGTATCGTGCGGTGTGATTTCACCCGAACTAGCCCTCCAGGTCGGCAGATAGTAGGACGTGCGAGTCGTTATGGCGGCGCAGGCTACGGTCGATGGGCTACGGTCACTGGTATGGCTAACGCAGGTGACACGCTGTACTTCCAGATGAAGGACTGGAACACCCGTACTCTGTATCGCTATTATTTCTAA

Genome Context

Tertiary structure

QRE00331.1
ESMFold structure
Source ESMFold
pLDDT 62.2
Oligomeric state monomer