Genbank accession
YP_010765521.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect
Probability 0,90
TF
Evidence RBPdetect2
Probability 0,92
Seq2Symm
C3 confidence 0,983
C3 0,983
C1 0,085
C6 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MADYSQLPIENIWSTGGDMVAPTPAQQQGGWGIQSVPRQWWNWKWNLHDTNLAYLLQKGIPEWTSTQEYIANKSFCTRGGFVYKAVRTHTGSDPATANPNWARAFADFTTSSSALGSLTPRDGGIPFFISATGASVFDSTAYGRGMLNVANAAAARNYISAQESSVVLSNLSTVTRAANTVPYFNTDTSMATFNITAFGRGLVNAANAENARGFLGLANSAIITADPANRAHTLVYRDAAGNFNAGVITATLSGNATTANKLRTPVTINGVAFDGSQNIVLPGLDTSYAGTVARLHINGANLSSADKTTQLALRNKSDNDWISLAVVDDNILQFVFRSATNPVVQIGNEVILHTGNQFSLGPTLTDARSRLGLDRLTQGSSDTQVFPSTLNNGPYLTVQPTAIGGFNGSTNGWLFRFDANGNMTHGTVPAARITGLSNSAQIPATTTAQANSLVQRDADGGFSAIAINAYGTIVGYGSNIFSRASGTGNAHIGFQRANGTELGLIWGAQSNNSMNFRVAGGSTAVSITGLDMTVTGRVNATTLNASGNVNATGNVNAGSATLNTAGNITGAAYGAYGSLTNWVDSVYAKKGEIPNDIARAGAAWDAVGQYILAGDQSGGSGGPGTTRAGSQLKPYSTISYTAGALPAAGTYRCMGAFAGGGNQITLWQRIS
Physico‐chemical
properties
protein length:671 AA
molecular weight: 69811,42400 Da
isoelectric point:8,89627
aromaticity:0,08644
hydropathy:-0,12221

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_010765521.1
1 671 aa
Domain Start End Length (AA) Confidence
N-terminal 1 310 310 0,6145
Central domain 311 509 200 0,2513
C-terminal 510 671 161 0,8656
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_010765521.1 [NCBI]
Genbank nucleotide accession
NC_073623.1 [NCBI]
CDS location
range 19095 -> 21110
strand +
CDS
ATGGCTGATTACAGTCAACTACCTATTGAAAATATTTGGTCCACAGGCGGGGATATGGTAGCCCCGACCCCTGCGCAGCAGCAAGGCGGATGGGGTATTCAGTCGGTTCCTCGCCAATGGTGGAACTGGAAATGGAACCTTCACGATACCAACCTAGCGTATCTGCTACAGAAGGGCATTCCAGAGTGGACCAGCACTCAAGAGTATATTGCAAACAAATCGTTCTGCACAAGAGGCGGGTTCGTCTATAAGGCTGTTCGTACCCATACAGGTAGCGACCCGGCCACCGCTAACCCCAACTGGGCCCGAGCTTTCGCAGACTTTACCACATCTAGCTCTGCACTTGGAAGCCTGACACCAAGAGACGGTGGAATCCCGTTCTTCATTAGTGCCACAGGAGCTAGCGTGTTTGACTCTACGGCTTATGGTCGTGGAATGTTGAATGTAGCTAACGCCGCAGCAGCCAGAAACTATATTTCGGCTCAAGAAAGTTCTGTTGTACTGTCTAACCTGTCCACTGTGACTAGGGCTGCCAACACAGTTCCGTACTTCAATACGGATACCTCCATGGCTACCTTCAACATCACAGCGTTCGGAAGAGGACTTGTCAACGCGGCTAATGCTGAAAACGCAAGAGGTTTCCTAGGCCTAGCTAACTCTGCTATCATCACAGCCGATCCAGCTAACAGAGCCCACACTCTGGTCTATAGAGATGCTGCTGGCAACTTCAACGCTGGCGTAATCACTGCTACCCTGTCTGGAAACGCAACTACAGCTAACAAGCTTAGAACCCCAGTTACAATCAACGGTGTGGCGTTTGACGGAAGCCAAAACATTGTTCTTCCGGGCCTAGATACAAGTTATGCGGGAACGGTTGCACGTCTTCACATCAACGGAGCGAACCTTTCGAGTGCAGATAAGACTACTCAGCTAGCACTGAGGAACAAATCTGACAACGACTGGATTAGCCTTGCTGTAGTGGATGACAACATTCTCCAGTTTGTATTCAGAAGCGCTACAAACCCAGTTGTCCAGATTGGCAACGAAGTTATCCTTCACACAGGAAACCAGTTCTCTCTGGGCCCGACTCTTACAGACGCTAGGTCTCGTCTGGGTCTCGACAGACTCACTCAAGGTAGCTCTGATACTCAAGTCTTCCCCAGCACCTTGAACAATGGCCCCTACTTGACCGTACAACCTACGGCTATCGGAGGATTCAACGGTAGCACTAACGGATGGCTGTTCCGATTCGACGCTAATGGTAACATGACTCATGGTACAGTTCCTGCCGCTAGAATCACTGGTCTGTCCAACTCGGCTCAGATTCCAGCCACAACTACGGCGCAGGCTAACTCTCTTGTTCAGAGAGACGCAGACGGAGGATTCAGCGCTATTGCGATTAATGCGTATGGCACTATCGTCGGGTACGGCTCTAACATCTTCAGTAGAGCATCGGGCACTGGCAACGCCCACATCGGGTTCCAGAGAGCGAACGGAACAGAACTCGGTCTTATCTGGGGGGCCCAGTCTAACAACTCGATGAACTTCCGGGTAGCTGGTGGCTCCACCGCAGTGTCGATTACCGGTCTGGACATGACTGTTACTGGAAGAGTCAATGCTACCACACTAAACGCCTCTGGAAACGTGAATGCGACAGGTAACGTCAACGCCGGGAGTGCTACACTCAATACAGCAGGGAACATCACAGGGGCCGCCTACGGAGCGTATGGTTCTCTTACCAACTGGGTAGATTCTGTATATGCGAAGAAGGGAGAGATTCCTAACGATATCGCTAGAGCAGGCGCAGCTTGGGACGCAGTTGGACAGTACATCCTAGCTGGCGATCAATCTGGAGGGTCTGGTGGACCGGGGACAACTAGAGCTGGAAGCCAGTTGAAGCCTTATTCGACTATTAGCTACACAGCAGGGGCACTACCAGCAGCAGGCACTTACAGATGTATGGGAGCGTTTGCAGGTGGTGGTAACCAGATTACCCTGTGGCAGAGAATTTCTTAA

Genome Context

Tertiary structure

YP_010765521.1
ESMFold structure
Source ESMFold
pLDDT 64.4
Oligomeric state monomer