Genbank accession
YP_009783898.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,90
TF
Evidence RBPdetect2
Probability 0,56
Seq2Symm
C3 confidence 0,892
C3 0,892
C1 0,009
I 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAYSNLSFVRHVGDGVKTLFPLTVAGENMGYFRVEDIHTYVDDKEVPNVIQSQSPHIVSITPAPPAGSDVLIRREMPIEKPYADFSRGNNFGHRQVNNSFLQQLYLTQELIDGFTPKGFYMKQNVDYGGHVPKNLGDAVDPDDAVKKSVTDSLDNRLSNVEASTNVSSVNFLVPFTRTAAGGEVLINTGYSFNYCELSINGVEQIPSKSFNYMNGILYFAEPLEEGDEVFAKLGSLEKFAIGSSFSDYRHTAVGGEYSFPAPEHDFTALFINGVYQAPSYSYVIVGNNVHLAESLEEGDVVDLWYAEKPNT
Physico‐chemical
properties
protein length:311 AA
molecular weight: 34387,82680 Da
isoelectric point:4,68384
aromaticity:0,11897
hydropathy:-0,26302

Domains

View on InterPro
YP_009783898.1
1 311 aa
ATT 1–113 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_009783898.1
1 311 aa
Domain Start End Length (AA) Confidence
N-terminal 1 306 306 0,9941
Central domain 307 306 1 0,4436
C-terminal 307 311 4 0,7868
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009783898.1 [NCBI]
Genbank nucleotide accession
NC_047737.1 [NCBI]
CDS location
range 34757 -> 35692
strand +
CDS
ATGGCGTACAGTAACCTCTCGTTCGTTCGCCACGTAGGGGATGGGGTTAAGACTCTGTTCCCTTTAACAGTGGCTGGCGAGAATATGGGGTACTTTCGTGTAGAAGATATTCATACTTATGTAGATGATAAGGAAGTACCCAATGTAATACAATCACAATCACCTCACATCGTTAGCATTACACCAGCACCTCCTGCTGGCTCTGATGTGCTAATTCGTCGTGAGATGCCTATAGAAAAGCCATATGCAGATTTCTCTCGTGGTAACAACTTTGGGCACAGGCAGGTTAACAATTCATTCCTACAGCAGCTCTATCTGACACAAGAGCTTATTGACGGGTTTACACCTAAAGGATTCTACATGAAACAGAATGTAGATTATGGTGGTCATGTACCAAAAAACTTGGGAGATGCAGTTGACCCTGATGACGCAGTTAAGAAGTCTGTTACAGACTCACTTGATAATCGTTTATCTAATGTCGAAGCATCAACTAATGTGTCTTCAGTAAATTTCCTAGTGCCATTCACGAGAACAGCAGCAGGTGGTGAGGTTTTAATCAATACTGGTTATAGCTTCAACTACTGTGAGCTTTCTATTAATGGCGTTGAGCAGATACCTTCAAAGTCTTTCAATTATATGAACGGTATTCTTTACTTTGCAGAGCCTCTTGAAGAAGGTGATGAAGTATTTGCTAAATTAGGCTCACTTGAGAAGTTTGCTATAGGTTCTTCTTTCAGTGATTATAGGCATACTGCTGTAGGGGGGGAGTATTCTTTCCCCGCACCAGAACACGACTTTACGGCTTTATTCATAAACGGAGTATATCAAGCTCCTTCATATAGCTATGTTATCGTAGGTAATAACGTGCATCTAGCTGAATCACTTGAAGAGGGTGATGTTGTAGACCTATGGTATGCCGAGAAACCTAATACCTAG

Genome Context

Tertiary structure

YP_009783898.1
ESMFold structure
Source ESMFold
pLDDT 83.7
Oligomeric state monomer