Genbank accession
YP_009805449.1 [GenBank]
Protein name
straight fibre tail protein
RBP type
TSP
Evidence RBPdetect
Probability 0,87
TF
Evidence RBPdetect2
Probability 0,45
Seq2Symm
C3 confidence 0,848
C3 0,848
C1 0,729
C7-C9 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MISNNAPAKMVLNSIMTGYTMAYVQHSIYTDYDVIGRSFWLKMGESIDRRDYTGIDTFFVMINNLTPSTSYEIQGAFYDSIIDSELLEAKIGINLSNETNFKTKEKPIITAARSESEPVDVGVGAPIVVVETAGEASYCTIELKSTASEDSEWVKYYIGALGPTIKFGGVPVGDYKIRISGQVTMPDGVTVDSSGYYEYPSIFTVAYNFVPPTAPTNIAFKAARIADGKERYDVRIEWDWERGAGANVREFLVTYINSEEYAKTGWAKAQKINVGAARAATIISFPWKVEHTFKVSSIAWGPNKQDITESAPVTFILNEDTPLDNSFVNETGIDVNYAFIKGSMKDGEIWRQTFLIDAATGAINIGLLDEEGKAPISFDPINRVVNVDGKVITRDINAANFIMTNLSGKDNPAIYTQGKSWGDNNSGIWMGMDNTSAKAKLDIGNATQWIRYDGDVLRISSGVVIGTPKGDVDLGTGMQGKQTVFVYKLATSLPAKPLEQDYPPPGWSKTPPNRTDMTQNIYATTGTLDPVTNKLLEGTSWSDVVQWSGTEGTIGHDGQRGPGMYSLGIPGLGGWDDGQANAFFQNNFGSPPVRYDVLTEFNSNAPQSAFTRQWNGSGWVNPAMVLHGNMIVNGTVTADKIVAGNAFLSQIGVNIIYDRNAALSGNPEAYYKMKIDLNSGYIHIR
Physico‐chemical
properties
protein length:685 AA
molecular weight: 74873,21220 Da
isoelectric point:4,88022
aromaticity:0,10511
hydropathy:-0,24642

Domains

View on InterPro
YP_009805449.1
1 685 aa
STR 10–97 · STR 103–197 · STR 211–335 · STR 350–664 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_009805449.1
1 685 aa
Domain Start End Length (AA) Confidence
N-terminal 1 407 407 0,8369
Central domain 408 639 233 0,2688
C-terminal 640 685 45 0,7391
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009805449.1 [NCBI]
Genbank nucleotide accession
NC_048009 [NCBI]
CDS location
range 18415 -> 20472
strand +
CDS
ATGATTTCGAATAATGCACCAGCCAAAATGGTCTTAAATAGTATAATGACTGGATATACAATGGCGTATGTCCAGCACTCTATATATACTGACTATGACGTTATTGGTAGATCTTTTTGGTTAAAGATGGGAGAAAGTATAGATAGACGTGATTATACCGGTATAGATACTTTCTTCGTAATGATTAATAACCTGACCCCTTCAACCTCTTACGAGATTCAAGGGGCTTTTTATGATTCTATTATAGATTCTGAATTACTAGAGGCTAAAATTGGTATCAATCTATCTAATGAAACCAACTTTAAGACAAAAGAGAAGCCAATAATTACTGCAGCAAGATCTGAATCAGAACCCGTTGATGTTGGTGTTGGTGCTCCAATAGTTGTTGTAGAGACTGCTGGTGAAGCTAGTTACTGTACTATTGAATTAAAAAGTACTGCATCAGAAGATAGTGAATGGGTTAAATATTATATAGGCGCACTGGGACCTACTATCAAATTTGGTGGTGTTCCTGTTGGCGACTATAAGATCAGAATATCTGGTCAAGTTACGATGCCAGATGGTGTTACAGTTGACTCATCTGGTTATTATGAATATCCTAGCATTTTCACTGTAGCTTATAATTTTGTACCACCTACTGCACCTACTAACATTGCCTTTAAAGCTGCACGAATTGCAGATGGTAAGGAACGATATGATGTCAGAATAGAGTGGGACTGGGAACGTGGTGCTGGTGCTAATGTCCGTGAATTTCTAGTCACTTATATAAACTCTGAGGAATACGCTAAGACTGGCTGGGCTAAAGCTCAAAAGATAAACGTTGGGGCTGCCAGAGCTGCAACGATTATATCATTCCCATGGAAAGTTGAGCATACTTTTAAGGTATCATCAATTGCCTGGGGACCAAATAAGCAAGATATAACAGAATCAGCTCCTGTAACATTTATATTGAATGAAGATACTCCTCTAGACAACAGCTTTGTCAATGAGACGGGTATTGATGTTAATTATGCCTTTATTAAGGGTAGCATGAAAGATGGAGAAATCTGGAGACAGACATTCTTAATCGACGCAGCTACTGGTGCTATTAACATTGGTCTACTAGATGAAGAAGGAAAAGCACCTATTTCTTTTGACCCTATAAACCGTGTTGTTAACGTTGATGGTAAAGTAATTACTAGAGATATTAATGCTGCGAACTTTATCATGACTAACTTATCTGGTAAGGATAATCCAGCAATTTACACTCAAGGTAAATCTTGGGGGGATAATAACTCTGGTATTTGGATGGGTATGGATAATACCTCTGCCAAAGCTAAATTAGACATTGGTAATGCCACACAGTGGATTCGTTATGATGGTGATGTGCTACGTATTTCTAGTGGAGTAGTTATTGGAACTCCTAAGGGCGATGTAGATCTTGGTACTGGTATGCAAGGTAAGCAAACAGTATTTGTTTATAAGTTAGCAACATCTCTACCTGCTAAACCACTAGAACAAGATTATCCGCCTCCTGGTTGGTCAAAAACTCCACCTAACCGTACAGATATGACACAAAATATCTATGCCACTACAGGTACGCTTGATCCCGTTACTAACAAACTTCTTGAAGGTACTAGCTGGTCTGATGTAGTTCAGTGGAGCGGTACTGAAGGTACTATAGGACATGACGGACAACGTGGTCCTGGGATGTACTCCTTAGGTATTCCTGGTCTTGGAGGCTGGGATGATGGACAAGCTAATGCCTTCTTCCAGAATAACTTTGGTAGTCCTCCTGTTAGATATGATGTATTAACCGAATTTAATAGTAATGCTCCACAATCAGCATTTACCAGACAATGGAATGGATCTGGGTGGGTTAACCCTGCAATGGTTCTTCACGGGAACATGATTGTTAATGGAACAGTGACGGCAGATAAAATTGTAGCAGGAAATGCTTTCTTGTCTCAAATTGGTGTTAATATCATTTATGATAGAAATGCTGCGTTATCCGGGAATCCTGAGGCATACTACAAGATGAAGATAGACCTAAATAGTGGGTATATCCATATAAGGTAA

Genome Context

Tertiary structure

YP_009805449.1
ESMFold structure
Source ESMFold
pLDDT 79.4
Oligomeric state monomer