Genbank accession
YP_007001985.1 [GenBank]
Protein name
tail protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,76
Seq2Symm
C6 confidence 0,319
C6 0,319
C1 0,312
C3 0,023
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAISWIQPSFAGGEIGPSLYGRIDMAKYQVALRKCDNFIVRQYGGVENRPGTRFVGAAKYPNRKCRLIPFQFSTVQTYALEFGHQYMRVIKDGALVLNSSNVIYEIATPYTEADLFRIKFTQSADVLTLVHPAYPPKELRRYAHDNWQLVDVVTKNGPFEDINIDESVTVYASASTGTITLTANASIFGAEQVGKLFYLEQPAVDSVPVWETSKSTSIGDIRRADSNYYRAVTAGKTGTLRPSHTEGTSWDGWGGSGDDDTGIEWEYLHSGFGIARITAANGTTATAEVISYIPSQVVGEDNASYKWAKYAWNSVNGYPGTVVYYQQRLYFAASTAFPQTIWASRTGDYKDFGKSNPTQDDDRIIYTYAGRQVNEIRHLIDVGSLVALTSGGEYVITGDQNKVLTPSSFAFSSQGSNGSSNVPPIAVANIALFVQEKGSVVRDLAYSFDVDGYQGNDLTILANHLFQKHSIVDWCFSIVPYSSAFCIRDDGKLLVMTYLRDQQVFAWAPQSSTGKYESTCSISEGNEDAVYFVVNRTVNGQTVRYIERLSSRLFTSDEDAFFVDSGLSYDGRNTSDRTMTITGGSGEWDYRAEYTISVSGGAYFTSSDVGAQLQFPYTGTDPDTGDEVSKELRCDIISVTSNTAVVVRANRNVPSSLRNVATTNWQMARRTFGGLSHLEGQTVNILSDANVEPQKVVSGGTVTLESPGAVVHIGLPITAEFETLDINISGQETLLDKKQVIPSVTLVVNASRGIWATTPGGKWYEYPQREFEFYDDPVDDATGKVEVKLDSNWGKNGRVKIRQLDPLPLSVLAVIPRLTVGGF
Physico‐chemical
properties
protein length:823 AA
molecular weight: 90482,74780 Da
isoelectric point:5,10553
aromaticity:0,11057
hydropathy:-0,25371

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_007001985.1
1 823 aa
Domain Start End Length (AA) Confidence
N-terminal 1 160 160 0,9911
Central domain 161 366 207 0,2865
C-terminal 367 823 456 0,0945
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Escherichia phage TL-2011b [NCBI] · taxon 1124654

Coding sequence (CDS)

Genbank protein accession
YP_007001985.1 [NCBI]
Genbank nucleotide accession
NC_019445 [NCBI]
CDS location
range 20630 -> 23101
strand +
CDS
ATGGCTATCAGTTGGATCCAGCCCAGCTTTGCCGGTGGTGAGATTGGACCGTCGTTGTACGGTCGTATCGACATGGCGAAGTACCAGGTGGCATTGCGCAAGTGCGATAACTTTATCGTGCGGCAGTATGGCGGCGTTGAGAATCGACCTGGTACGCGTTTTGTCGGTGCCGCCAAATACCCAAATCGGAAATGCCGCCTGATCCCGTTCCAGTTCTCGACGGTTCAGACTTATGCTCTGGAGTTCGGACACCAGTACATGCGCGTTATCAAAGATGGTGCGTTGGTGCTGAACAGCAGCAATGTTATTTATGAAATTGCCACGCCATATACTGAAGCCGATCTGTTCCGAATTAAATTCACGCAAAGCGCTGACGTGCTTACGCTGGTTCACCCGGCATACCCGCCGAAAGAGTTGCGGCGCTATGCGCATGACAACTGGCAACTTGTTGATGTGGTAACGAAGAACGGGCCATTTGAAGATATCAATATTGACGAGTCAGTGACGGTTTATGCCAGCGCCAGCACCGGGACAATTACGTTAACGGCAAACGCCTCTATTTTTGGCGCGGAACAGGTAGGCAAATTGTTCTATCTGGAACAGCCAGCAGTGGATTCAGTACCGGTATGGGAAACCAGTAAGAGTACGTCGATTGGCGATATTCGCCGTGCAGACAGTAACTACTATCGCGCTGTTACGGCAGGTAAAACAGGCACTTTGCGCCCTTCGCATACAGAAGGCACATCATGGGATGGCTGGGGCGGATCCGGAGATGATGATACTGGCATTGAGTGGGAATATCTGCACAGTGGTTTTGGCATTGCCCGTATCACTGCTGCAAATGGAACTACTGCAACTGCCGAGGTGATTTCCTATATCCCTTCTCAGGTAGTTGGCGAGGATAATGCTAGCTATAAATGGGCTAAATATGCCTGGAACAGTGTTAATGGTTATCCTGGCACTGTTGTTTATTATCAACAACGTCTTTACTTCGCCGCATCTACTGCGTTCCCTCAGACTATCTGGGCCAGCCGTACTGGGGATTATAAGGATTTTGGCAAAAGCAATCCTACGCAGGATGACGACAGAATTATCTACACCTATGCCGGGCGTCAGGTTAATGAGATCCGCCACCTGATTGATGTCGGTTCGCTGGTGGCACTGACTTCCGGAGGTGAGTACGTCATCACCGGCGACCAGAACAAAGTGTTAACCCCATCATCATTTGCATTCAGCTCTCAAGGATCAAATGGCTCGAGCAATGTCCCACCAATTGCCGTGGCGAATATTGCTCTGTTCGTCCAGGAGAAAGGCAGTGTTGTCCGTGATCTGGCCTACTCATTCGATGTTGACGGCTATCAGGGGAACGACCTGACCATCCTTGCCAATCATCTTTTTCAGAAGCACAGCATTGTTGACTGGTGCTTCTCTATTGTCCCTTACTCCAGCGCCTTCTGCATTCGTGATGACGGTAAATTACTGGTGATGACCTATTTGCGTGATCAGCAGGTTTTTGCATGGGCACCACAATCCAGTACCGGAAAATATGAAAGCACATGCAGTATCAGCGAAGGCAATGAAGATGCGGTGTATTTCGTCGTTAACCGAACCGTTAACGGGCAAACAGTGAGATACATCGAGCGACTGTCCAGCCGTTTATTTACCAGCGATGAAGATGCTTTCTTTGTTGATTCTGGCCTTAGTTATGATGGAAGAAATACGTCTGACAGAACGATGACCATCACTGGTGGTTCTGGTGAATGGGATTACCGTGCGGAATATACAATCAGTGTTTCTGGTGGTGCGTACTTCACCAGTAGTGATGTCGGCGCGCAACTACAGTTCCCTTATACCGGAACTGATCCTGATACTGGCGATGAAGTGTCAAAAGAATTACGTTGCGACATTATTTCTGTAACCAGCAATACCGCAGTAGTGGTTCGTGCTAACAGGAACGTCCCGTCATCCCTCAGGAATGTGGCCACCACGAACTGGCAGATGGCGCGCCGGACATTTGGAGGCCTGTCTCATCTTGAAGGCCAGACCGTAAACATTCTCTCTGATGCGAACGTGGAACCACAGAAAGTAGTTTCCGGAGGTACCGTCACGCTGGAATCTCCGGGGGCTGTAGTGCACATCGGCCTGCCAATAACTGCTGAATTCGAAACACTGGATATCAACATTAGCGGACAGGAAACGCTGCTGGACAAAAAACAGGTGATCCCGTCAGTTACTCTGGTTGTGAATGCCAGTCGCGGCATCTGGGCGACTACGCCCGGCGGTAAATGGTACGAATATCCACAGCGAGAATTCGAGTTCTACGATGATCCTGTTGATGATGCTACCGGAAAAGTAGAAGTGAAACTGGACAGTAACTGGGGCAAAAACGGACGTGTAAAAATCCGTCAGCTTGACCCGTTGCCGCTGTCTGTTCTTGCCGTTATTCCTCGCCTTACTGTTGGGGGATTCTGA

Genome Context

Tertiary structure

YP_007001985.1
ESMFold structure
Source ESMFold
pLDDT 91.0
Oligomeric state monomer