Genbank accession
YP_009011741.1 [GenBank]
Protein name
tail fiber protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,81
TSP
Evidence RBPdetect2
Probability 0,68
TF
Evidence UniProt/TrEMBL
Probability 1,00
Seq2Symm
C3 confidence 0,997 truncated
C3 0,997
C1 0,044
C6 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MADLKLGTQIGGNLVWHQGILELNPVDDKLFYRDQEIMTTRGYQTMLGSIKFGTPNDVYDIESMSDGPGNVKRYLRKMRSGASSTIWHETINDRFYAISTGVTDTAPQFTLYNGDSATFQYPVYTNSPQSTLANSLARKDYVDAIDAKNVDKSGDVMDGILNFSGNNVNGINFNAYINTGVFAGNGDGASIDKANMQIRSWQGIGFSPTVIGDENRLVKAGENSIWFNLRNGDMTTVGNMYVGKNQQVYSPINKPAPGDLNAYNKQEIDEKHWIRVRDERTGMTQPGDHVAGVMAAYFTNLSDVTNNWVSGFTVKGWSDTYATWSIFAGSQADNDTNRLWFKHGRSTWLPSSRIYHELDKPTNNELNLVSRAGDTMTGNLTMSVGTSVGSSPLNCLYFDSSDGAGMNNANLRIKSWFGVGFGPTVDTGAVKNGQNSIWFNVRTGDMTTVGNMFVGGGSHQVYSPINKPNHNDVGATQRKSGNSDISADIKYTKICAMQANIGANGNSGSFILTGGNSIGWNTVPIYNISMNTRGYSGTGPHTDGMIRITLLEGPPQATFYAVTNGSHVELWMERPTYSGQMSISVLNDYGLAISMEDGVMPAGDKTRIDVSKVYTSKEKPTNNDLNLVSRAGDTMSGALTIKNAAPQMIFHESETDKKYMFVSDGTEVRLNEDKTDGRLIWQYQPAFDSIRLYKPEVGDDGMGTKATSLATKQYVDQKVGTAVQSVTATGAVKSTGGINPVISLTNATNASDGAMSASDKAKLDGIPSAAVNKTGDGMTGNLTFTNNSELVWSRNTDWAKIGFKNDSDADTDSYMWFETGDNKNEYFKFRMHNTTGPKHEVLDIKLEGSTFAHDVILAAREVGANELTFTNDPVEYKGNTGIERIIGGVFSQWYDDNLVFGHIRSGGKPSAGFGVRLNDKYIMRVSPTGAVSADSFLITGAQSSDASASTRKDYVDTKVAKAGDTMTGTLAIRKDSASSLCLNLSNETDGWTWINFGASNASGAKSCHVAWNTTAYDGANANAFHIRPAGDTAMSFSTTTVRSHKLLSAANNFTVIQTAPYMELHKPGAIAFSWNISADNRLMLSQTNGSGVAHQDILGINANNNTISINANPWSKTSSRAYASVYAQNAPLTVDFGAGPGTSDYYPIIKGSQVVTNQGYTTAATFGILRSGANRWGDASITVGNGESATGPIQYYLFGSDGTTTLPGKVVMKDHLSIQGVSPTILFQDQDHLSAFCHINSNLFYILRSSGANGTGWDGGPNGIHPMSLNLADGDVQFSRNGSFNDVQIRSDIRLKSNLIDIKGALDKVCSLTGKTFDKFGCDKREAGIIAQDLQKVLPEAVGSFKNTAGEEYLTVSNSGVNALLVEAIKELRAELNELKSKLN
Physico‐chemical
properties
protein length:1384 AA
molecular weight: 149507,53820 Da
isoelectric point:5,79129
aromaticity:0,08887
hydropathy:-0,38447

Domains

View on InterPro
YP_009011741.1
1 1384 aa
STR 179–252 · CHP 1291–1383 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_009011741.1
1 1384 aa
Domain Start End Length (AA) Confidence
N-terminal 1 161 161 0,1148
Central domain 162 360 200 0,3816
C-terminal 361 1384 1023 0,7686
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009011741.1 [NCBI]
Genbank nucleotide accession
NC_023688.1 [NCBI]
CDS location
range 205148 -> 209302
strand +
CDS
ATGGCAGATTTAAAACTAGGTACGCAAATTGGCGGAAACTTAGTTTGGCATCAGGGGATTCTTGAACTGAATCCAGTTGATGATAAGCTATTTTATCGCGATCAAGAAATAATGACTACCAGAGGGTATCAGACTATGCTTGGTTCAATCAAGTTTGGTACTCCTAATGATGTCTATGACATCGAAAGCATGAGTGATGGTCCTGGTAACGTTAAGCGTTATTTGCGTAAAATGCGTTCCGGTGCATCATCTACAATTTGGCACGAAACTATCAATGATCGATTCTATGCAATCTCAACTGGTGTGACTGATACAGCACCACAATTTACATTGTATAATGGTGATAGTGCTACTTTTCAATATCCAGTTTACACAAATAGCCCACAATCTACATTAGCAAACAGTCTAGCTAGAAAGGATTACGTTGATGCGATAGACGCTAAAAATGTTGATAAATCCGGCGACGTTATGGATGGAATTTTAAACTTTTCTGGTAATAATGTTAATGGCATTAATTTCAATGCTTACATTAATACTGGTGTGTTTGCTGGTAATGGTGATGGCGCGTCTATTGACAAGGCAAACATGCAGATCAGATCGTGGCAAGGGATTGGATTTAGTCCTACTGTTATTGGTGATGAAAATAGACTGGTAAAGGCTGGAGAGAATAGTATTTGGTTTAACCTGCGCAATGGTGATATGACAACAGTTGGTAATATGTATGTTGGTAAAAATCAACAGGTATATAGTCCAATCAATAAACCAGCGCCTGGTGATTTGAATGCTTATAACAAGCAGGAAATTGATGAAAAGCATTGGATTAGAGTTAGAGATGAACGAACCGGAATGACTCAACCAGGTGATCATGTCGCTGGTGTAATGGCTGCTTATTTCACTAATCTTAGTGATGTCACTAATAACTGGGTTTCTGGATTTACGGTTAAAGGTTGGTCGGATACATACGCGACTTGGTCGATATTTGCTGGATCACAGGCAGACAATGACACAAATCGTTTGTGGTTTAAACATGGTAGATCTACATGGTTGCCGAGTTCGCGCATTTATCATGAACTAGATAAGCCAACAAATAACGAGTTGAACTTGGTATCAAGAGCTGGTGATACTATGACCGGTAATTTAACAATGTCAGTTGGGACTAGCGTTGGGTCATCGCCATTGAATTGTCTTTATTTTGATTCATCTGACGGTGCTGGGATGAACAACGCAAACTTACGAATCAAATCATGGTTTGGTGTTGGGTTTGGTCCGACAGTTGATACCGGCGCAGTAAAGAACGGTCAAAACAGTATTTGGTTTAACGTTCGTACTGGTGATATGACAACAGTTGGTAATATGTTTGTTGGTGGTGGCAGTCATCAAGTATATAGTCCAATTAATAAACCGAACCACAATGACGTCGGCGCGACACAACGCAAGAGTGGCAATAGTGATATTAGCGCAGATATAAAATACACAAAAATTTGTGCGATGCAAGCCAACATTGGCGCTAACGGTAATAGTGGTAGTTTCATTCTGACTGGTGGTAATAGTATCGGTTGGAACACTGTCCCAATATATAACATTTCGATGAATACTAGAGGGTATTCCGGTACTGGTCCTCATACGGATGGTATGATTCGTATTACTTTGTTGGAAGGGCCACCCCAAGCTACTTTCTACGCAGTCACGAATGGATCACACGTTGAGTTGTGGATGGAACGTCCGACATATAGCGGACAAATGTCTATCAGCGTTCTAAATGACTATGGTTTAGCGATAAGCATGGAAGATGGCGTTATGCCTGCTGGTGATAAAACTAGGATCGATGTATCCAAAGTTTATACCTCAAAAGAGAAACCAACCAATAATGATCTGAACTTGGTTTCAAGAGCAGGCGATACTATGTCTGGTGCATTGACTATTAAAAACGCCGCACCACAGATGATTTTTCATGAGAGTGAAACCGATAAGAAATATATGTTTGTTTCTGATGGTACAGAAGTCCGTCTAAATGAAGATAAAACTGATGGAAGACTTATTTGGCAATATCAACCGGCATTTGATTCAATTAGATTATACAAGCCAGAGGTTGGCGATGATGGCATGGGCACAAAAGCAACGTCGCTCGCAACCAAACAGTATGTGGATCAAAAAGTTGGTACTGCTGTTCAGTCTGTAACTGCTACTGGTGCAGTTAAGAGCACAGGTGGTATTAACCCAGTTATCAGTCTGACTAATGCTACCAATGCGAGCGATGGTGCTATGAGTGCATCTGATAAAGCTAAATTGGATGGCATCCCGAGTGCTGCTGTCAATAAGACTGGCGATGGTATGACTGGTAACTTGACATTCACTAATAATAGTGAATTGGTGTGGAGTCGAAATACAGACTGGGCAAAGATTGGATTCAAGAACGACTCGGACGCAGATACCGATAGCTATATGTGGTTTGAGACTGGTGATAATAAGAACGAGTATTTTAAGTTTAGGATGCACAACACAACTGGACCAAAACACGAAGTTCTGGATATCAAACTGGAAGGATCAACATTCGCACACGATGTTATTCTTGCTGCAAGAGAAGTTGGAGCAAACGAGCTTACATTTACCAATGATCCAGTTGAGTATAAAGGAAACACAGGAATAGAACGTATTATTGGTGGAGTATTCTCTCAGTGGTATGATGATAATCTTGTTTTCGGACACATTAGATCCGGTGGTAAACCTTCCGCGGGATTTGGAGTTAGACTGAATGACAAGTACATTATGCGAGTTTCTCCTACTGGAGCAGTTTCTGCCGATTCGTTCTTGATTACTGGTGCTCAATCCAGTGACGCAAGCGCAAGCACAAGAAAGGACTATGTTGATACCAAAGTAGCCAAAGCTGGAGATACAATGACAGGTACTCTCGCAATCAGAAAAGATAGTGCTAGTTCACTGTGTTTGAATCTATCAAATGAAACGGATGGATGGACTTGGATTAACTTTGGTGCTAGTAATGCGTCTGGCGCAAAATCCTGTCATGTTGCGTGGAATACAACTGCTTATGATGGAGCTAACGCAAATGCGTTTCACATTAGACCTGCCGGCGATACGGCGATGTCATTCAGCACAACTACAGTTAGATCGCATAAATTGCTATCCGCTGCAAATAACTTTACCGTTATTCAAACTGCACCATACATGGAACTTCATAAGCCCGGTGCAATTGCGTTTAGTTGGAACATTTCGGCCGATAATAGACTGATGTTGAGTCAAACAAACGGCAGCGGCGTTGCACATCAAGACATTCTTGGTATAAATGCCAACAATAATACAATTAGTATTAATGCAAACCCATGGTCAAAAACCAGTAGTCGTGCATATGCAAGTGTTTATGCACAGAATGCTCCATTAACAGTTGATTTTGGAGCTGGCCCAGGTACATCCGATTATTACCCAATAATCAAAGGATCACAAGTAGTAACGAACCAGGGATATACCACGGCAGCGACGTTTGGTATTCTTAGATCCGGAGCTAATAGATGGGGTGATGCATCAATCACAGTTGGCAACGGTGAGAGTGCGACTGGTCCAATACAATACTATTTGTTTGGTAGCGATGGGACAACGACACTTCCTGGTAAGGTTGTTATGAAAGATCATCTTTCTATTCAGGGAGTCAGTCCTACCATTTTGTTCCAAGATCAGGATCATCTTTCTGCTTTCTGTCACATAAACAGTAATTTGTTTTACATTTTGAGATCTTCGGGTGCCAACGGAACTGGTTGGGACGGCGGTCCAAATGGCATTCACCCAATGTCATTGAACTTGGCAGACGGTGATGTTCAATTTAGCCGAAACGGTAGCTTTAACGATGTTCAGATTCGTTCTGATATTAGATTGAAATCAAACTTAATCGATATCAAAGGCGCACTAGACAAAGTTTGTAGTCTAACTGGTAAAACATTTGATAAGTTTGGTTGTGATAAGCGTGAAGCTGGTATTATTGCGCAAGATCTACAGAAAGTATTACCAGAAGCTGTTGGTAGCTTTAAAAATACAGCCGGCGAAGAGTATCTAACTGTTTCTAACTCTGGCGTTAACGCGCTGTTGGTAGAAGCAATCAAAGAACTTAGAGCCGAGTTGAACGAACTTAAATCAAAACTTAACTAA

Genome Context

Tertiary structure

YP_009011741.1
ESMFold structure
Source ESMFold
pLDDT 51.2
Oligomeric state monomer