Genbank accession
YP_004421602.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,74
TSP
Evidence RBPdetect2
Probability 0,52
Seq2Symm
C3 confidence 0,996 truncated
C3 0,996
C1 0,713
D3 0,006
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MIEPKREPTQDFFVCLLKEPRWISTDDLYPILLIPGVNYPAEIAMMHPDFFGGDDIVFKPEPPIDPDGPDLSNYYTKPETNSLLDKKADKIHTHVVADITDLNLDKFATKEETYTKQEIDDKIDEIVPPEINLTDYAKKDAVNIFTKANTFTEAPSVEVDATLDNHVIRKKQFDNNIKEVKDLLSNVFSYKGSKPTYTEIEAIVNKKIGDVWYAEDTGYMYIWNGKTWYDLGKSFDASKFVDITSDQVAINGIKKFTGKLKALTPVDSDDVAILSWTTKQINDKVESVIGDLNSLNNEVSKDNLVNAINSVDDKFKTTAKTNKSNTFTGDQTYVDHILLESVPSERNHAVNLGYILDNPGGIKLPDHTALTQNSVTEITFGYANPVVYSAQQLKNVFLKDIVGNEYKAIMADKTSFTENPSKEMVVILSRTDYTKNIDVKFDITKTVDELKQYELKEGEVRVILSYDTISVYSSGYGYGAMFARNANKKDGDLIYDYYSGSQNDITNNRKVSIKIDKLGINTPDIVSISMTTNGSEKLTVKTDTLDPVENTYESADMTYIHTPVSKIAGDILYSNISQAIKSIHVLENNICSLKPADMELQLVRLKEFKQTINNMLQSMFDESPVTLKNGDYIDVSFSGSASYGTGYCGYVNIKDTIRNITYKAYKVSSNAFDTTSGTKVIAVLTSDNSKTNVTYSDSVSTLESYEVAENEILLEISFSAAKQYSAKYGYGAMLEYWGSVSDLCYDYYMGSNLDMDCPFKITLLKIGSSVKADTIQIGAPTFAGSLVMHLRKNTNDVINFLVSTGMNVTGRDGTESGSVYNLVEKSLKPLKVLTSEAHQSINGITTFNNKVYMNINNEKITDSKQLIHKEYLDKNIADNVAYNISNTPLVPYNDVSSLNTKNICVKISATTDSSNYSSGDTVVVSNFKIKLKGDDEYLKPYGVEVIDRENNKIGLNLIGDDTVYNDNDALLSTRPSDFNSSSVDLSSGSNALVTVKTNGAYDYSGVYDIPNPFREYNKKYSLFLSNDGLKNPYYQVDINSSKQVDNISFQLFGTSATNPFLYSKDCKIELFIENTIVKTFNIKGSSGNNSPVNINIDYKDGMFLISVLDSINYINNRINKNAELLTGSGKPNFSLNPNKVGSLYSDTTNKAVYMCIDNTSGANKWVNIVTGDEIKPNLRKIEITCNVRLRSGQYGGCMSGVKIGFDNGYASTKQIVKGLNSGQILLSLDGLGNLSGYSEVSSLTPSSQDIKVDVDTTGIYNDPSYHCVTNIFKQYLGNADQCSLWSDASVKQLKITLLSKKIPNKILYVGDGYYGQTSVSDVKAIWYYVNDNGDKIEGSIDNDLEISNNDSETNDSSYIYAFNIN
Physico‐chemical
properties
protein length:1365 AA
molecular weight: 151637,13860 Da
isoelectric point:4,90182
aromaticity:0,09524
hydropathy:-0,38110

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_004421602.1
1 1365 aa
Domain Start End Length (AA) Confidence
N-terminal 1 376 376 0,9696
Central domain 377 601 226 0,6260
C-terminal 602 1365 763 0,1201
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_004421602.1 [NCBI]
Genbank nucleotide accession
NC_015464.1 [NCBI]
CDS location
range 36870 -> 40967
strand -
CDS
ATGATAGAACCAAAAAGAGAACCTACACAAGATTTTTTTGTATGTTTATTAAAAGAACCTAGATGGATTAGTACTGATGACTTATATCCTATTTTATTAATACCAGGAGTCAATTATCCTGCTGAAATAGCTATGATGCATCCTGATTTTTTTGGTGGGGATGATATTGTATTTAAGCCTGAACCCCCAATTGATCCAGATGGTCCTGATTTATCTAACTATTATACAAAACCAGAAACAAATAGTTTATTAGATAAGAAAGCAGATAAAATTCATACACATGTTGTAGCTGATATAACAGATTTAAATTTGGATAAATTTGCTACAAAAGAAGAAACATATACTAAACAAGAGATAGATGATAAAATAGACGAAATAGTACCACCTGAAATTAATTTAACTGATTATGCAAAGAAAGATGCAGTTAATATTTTTACAAAAGCTAATACTTTTACAGAAGCACCTTCAGTAGAAGTAGATGCAACACTAGATAATCATGTTATTAGAAAGAAACAGTTTGACAATAACATAAAAGAAGTTAAAGATCTACTATCTAATGTATTTTCATATAAAGGATCAAAACCTACATATACAGAAATAGAAGCCATTGTTAATAAAAAGATAGGTGATGTATGGTATGCTGAAGATACTGGATATATGTATATATGGAATGGTAAAACTTGGTATGATTTAGGTAAATCTTTTGATGCTAGTAAATTTGTTGATATAACTTCAGACCAAGTAGCAATAAATGGTATTAAAAAATTCACAGGAAAATTAAAAGCATTAACACCTGTTGATTCTGATGATGTGGCTATTTTGAGCTGGACAACAAAACAAATAAATGACAAAGTTGAATCTGTTATTGGTGATTTAAATTCACTAAATAATGAAGTTTCTAAAGATAATTTAGTTAATGCTATAAATAGTGTAGATGATAAGTTTAAAACAACAGCTAAAACCAATAAATCAAATACATTTACAGGTGATCAAACTTATGTAGATCATATTTTACTAGAATCTGTTCCTTCTGAAAGAAATCATGCAGTTAATTTGGGATACATTTTAGATAATCCTGGAGGTATAAAGCTTCCTGATCATACAGCACTTACACAAAATTCTGTTACAGAAATAACTTTTGGATATGCAAATCCAGTAGTGTACTCTGCACAACAATTAAAAAATGTATTCCTAAAAGATATAGTAGGCAATGAATATAAAGCTATAATGGCAGATAAAACATCATTTACAGAAAATCCTTCAAAGGAAATGGTTGTTATACTTTCTAGAACTGATTATACAAAAAATATAGATGTTAAGTTTGATATAACTAAAACAGTTGATGAGCTTAAACAATATGAGCTTAAAGAAGGAGAAGTTAGAGTTATACTATCTTATGATACTATATCTGTTTATTCTAGTGGATATGGTTATGGAGCCATGTTTGCTAGAAACGCTAATAAAAAAGACGGAGATTTAATATATGATTATTATTCTGGAAGTCAAAATGATATAACAAATAATAGAAAAGTATCTATAAAAATAGATAAACTTGGTATTAATACTCCAGATATTGTAAGTATATCTATGACTACAAATGGTTCTGAAAAATTAACAGTAAAAACAGATACACTAGATCCTGTAGAAAATACATACGAATCTGCGGATATGACTTATATTCATACTCCTGTCAGCAAAATTGCAGGAGATATTCTGTATAGTAATATATCTCAAGCAATTAAATCAATACATGTGTTAGAAAATAATATATGCTCTTTAAAGCCTGCAGATATGGAATTACAACTTGTAAGACTTAAAGAATTTAAACAAACAATAAATAATATGTTGCAATCTATGTTTGATGAGAGCCCTGTAACTCTAAAAAATGGAGATTACATAGATGTTTCATTTAGTGGTAGTGCAAGCTATGGAACAGGATATTGTGGGTATGTTAATATAAAAGATACTATAAGAAATATTACATATAAAGCTTATAAAGTATCTTCAAATGCTTTTGATACAACTAGTGGAACTAAAGTTATTGCAGTTCTAACTTCTGATAACAGTAAAACAAATGTAACTTATTCTGATAGTGTATCAACATTAGAATCTTATGAAGTAGCAGAAAATGAGATATTATTAGAAATATCATTTTCTGCTGCTAAGCAATATTCTGCTAAATACGGGTATGGAGCTATGTTAGAATATTGGGGTTCTGTATCTGATTTATGTTATGATTATTATATGGGTTCAAACCTAGATATGGATTGTCCATTTAAAATAACATTACTCAAAATAGGAAGTTCTGTTAAAGCTGATACTATACAAATAGGTGCTCCTACTTTTGCAGGATCATTAGTTATGCACCTAAGAAAAAATACAAACGATGTTATTAATTTCCTTGTATCTACAGGTATGAATGTAACAGGAAGAGATGGGACTGAAAGTGGATCAGTATATAATTTAGTAGAAAAATCATTGAAACCATTAAAAGTTCTAACATCTGAAGCACATCAATCTATAAATGGGATAACTACTTTTAATAATAAAGTGTATATGAATATAAACAATGAAAAAATTACAGACAGCAAACAACTAATACATAAAGAATACCTAGATAAAAATATTGCAGACAATGTAGCATATAATATTAGTAATACTCCATTAGTACCTTACAATGATGTTAGTTCTTTAAATACAAAAAATATTTGTGTAAAAATATCTGCGACAACTGATAGCTCTAATTATTCATCTGGTGATACAGTAGTAGTTAGTAATTTCAAGATAAAACTTAAAGGAGATGATGAGTACCTTAAACCTTATGGGGTTGAAGTTATTGATAGAGAAAATAATAAAATAGGTTTAAATTTAATAGGAGATGATACAGTATATAATGATAATGATGCTTTATTATCTACAAGACCTTCTGATTTTAATTCATCTAGTGTAGATCTTTCTAGTGGAAGTAACGCCTTAGTAACTGTTAAAACTAATGGAGCTTATGATTATAGTGGAGTTTATGATATACCAAATCCTTTTAGAGAATATAATAAAAAATACTCTTTATTCTTAAGTAATGATGGGTTAAAAAATCCTTATTACCAAGTTGATATAAATAGCTCCAAACAAGTTGATAATATATCTTTTCAATTATTTGGAACTAGTGCTACAAATCCTTTTTTATATTCTAAAGACTGTAAAATTGAATTGTTTATAGAAAATACTATTGTAAAAACCTTCAATATTAAAGGCAGCTCTGGAAATAATAGTCCTGTGAATATTAATATAGATTATAAAGATGGTATGTTTTTAATATCTGTTCTTGATTCTATAAATTACATAAATAATAGAATTAATAAAAATGCAGAATTACTTACAGGGTCAGGCAAACCTAATTTTTCATTAAACCCTAATAAAGTAGGTTCTCTATACTCTGATACAACTAATAAAGCTGTATATATGTGTATAGACAATACTTCTGGTGCTAATAAATGGGTAAATATAGTAACAGGAGATGAAATTAAACCAAACCTTAGAAAAATAGAAATTACTTGTAATGTAAGATTAAGAAGTGGCCAATATGGTGGTTGTATGAGCGGTGTTAAAATAGGATTTGATAACGGATATGCTTCTACAAAACAAATAGTTAAAGGGTTAAATAGTGGTCAAATATTGCTATCTCTAGATGGGTTGGGTAACCTTTCTGGATATTCTGAAGTCAGTTCTTTAACTCCTAGCAGTCAAGATATAAAAGTTGATGTGGATACTACTGGTATATATAATGACCCTTCATATCATTGCGTTACTAATATATTCAAACAATATCTTGGAAATGCTGATCAATGTTCGCTATGGTCTGATGCTAGTGTTAAACAACTTAAAATAACTTTATTATCTAAAAAGATTCCTAATAAAATATTGTATGTAGGAGACGGATATTATGGTCAAACATCTGTTTCTGATGTAAAAGCTATATGGTATTATGTAAATGATAATGGAGACAAAATAGAAGGCAGTATAGATAATGATTTGGAAATAAGCAATAATGACTCTGAAACAAACGATAGTTCTTATATATATGCGTTCAATATAAATTAA

Genome Context

Tertiary structure

YP_004421602.1
ESMFold structure
Source ESMFold
pLDDT 45.6
Oligomeric state monomer