Genbank accession
XPO97406.1 [GenBank]
Protein name
tail spike protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C3 confidence 1,000
C3 1,000
C1 0,030
D3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSSGCGDVLSLADLQTAKKHQIFEAEVITGKSGGVAGGADIDYATNAVTGQTQKTMPAILRDIGFEPASFDFTTGGTLSTADRNKAVLWPMADGGDGDWYYWEGALPKVIPAASTPSSTGGIADGAWRPVGDIELRSQISDPDGAEKYPELQIARWRDEGDARGWGIAPGNPDNSSLINGAISELSSRGGGELLFRVPGVLLIKGPIVPRRGVICKASPGTVTIKLADNSNTGMVESYKFDTLRANSAHSIADDPDFTQDYGFDGFIFDGNGANQSKATLNYGVKMYGLRLTLKRCIIYNFAGIGLLTSHAGAGSGAYTIDKASIPACIDELEIINSFDENWIYEGPSDTPIGSVVTNENGDKNNPGTTPQTSRHFPGEPVHSVVVAANKAMQADYLNLNSPRFGKCFVAKDNTRLTIDTLITAGGWGNVEFGVNCNGVVKNNFSQANKINWGGVTKPFVLNYSNKLVITDTIIRRASGQDVGADGVFDTGGANWGTVANLQAATQGGHLFVADAVSIMIGQLKSVGIGGLGSDGLVSAALVTTENCDQLNCTMTFSNVSLAWRNKKNGLIGNFIATGDVGTGNNFAEGLTGTPALNKSSLMTMQAVFKDGTGTVKTNNFIGYGNIDLTSTGGKTVTIPHTLWRAPSVEEIQATLRHSSFTAPGTFSPVYISSFNATQVVLRVDVTTAATGTPVSQVVCRIN
Physico‐chemical
properties
protein length:702 AA
molecular weight: 73864,88740 Da
isoelectric point:5,27622
aromaticity:0,07835
hydropathy:-0,12536

Domains

View on InterPro
XPO97406.1
1 702 aa
ATT 66–141 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

XPO97406.1
1 702 aa
Domain Start End Length (AA) Confidence
N-terminal 1 174 174 0,9913
Central domain 175 596 423 0,9921
C-terminal 597 702 105 0,9729
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Shigella phage phiSD1 [NCBI] · taxon 3385254

Coding sequence (CDS)

Genbank protein accession
XPO97406.1 [NCBI]
Genbank nucleotide accession
PQ571306 [NCBI]
CDS location
range 7272 -> 9380
strand +
CDS
ATGTCAAGCGGATGCGGTGACGTTTTAAGCCTGGCGGATTTACAAACCGCCAAGAAACACCAGATTTTCGAAGCCGAGGTCATCACCGGTAAATCCGGTGGTGTCGCTGGTGGTGCTGATATTGATTACGCGACCAACGCTGTTACAGGCCAAACACAAAAGACGATGCCCGCGATTCTTCGAGATATTGGCTTCGAACCCGCATCTTTTGATTTTACTACAGGCGGGACCTTGTCTACGGCGGACAGAAACAAAGCCGTCCTGTGGCCTATGGCCGATGGTGGGGATGGCGATTGGTATTACTGGGAAGGTGCGCTGCCGAAGGTAATCCCTGCAGCTTCAACTCCTTCTTCAACTGGCGGTATTGCGGATGGGGCCTGGAGGCCAGTGGGTGATATTGAATTGCGCAGCCAAATATCAGACCCGGATGGCGCAGAAAAATACCCAGAACTGCAAATTGCACGTTGGCGGGATGAAGGAGATGCTCGTGGTTGGGGTATTGCACCGGGCAATCCGGATAACTCATCTTTGATTAATGGCGCAATTTCGGAGTTATCATCGCGCGGTGGTGGCGAGTTATTGTTCCGTGTTCCCGGTGTGCTCCTGATCAAAGGGCCAATAGTTCCTCGTCGCGGAGTTATCTGCAAAGCCTCACCCGGAACTGTGACCATTAAACTGGCGGATAACTCAAATACAGGCATGGTGGAGAGTTATAAGTTTGACACGTTGCGAGCAAACAGCGCGCATTCTATCGCCGACGATCCTGATTTCACACAGGATTACGGATTTGATGGTTTTATCTTTGACGGTAACGGAGCAAATCAGAGCAAAGCTACGTTGAATTATGGCGTTAAAATGTATGGTCTCCGCTTAACGCTCAAACGTTGCATTATTTATAACTTCGCTGGAATTGGTTTGTTGACATCTCACGCTGGTGCGGGCAGCGGTGCATATACGATTGATAAAGCGTCCATTCCTGCCTGTATTGATGAACTGGAGATCATAAATAGCTTTGATGAGAACTGGATTTACGAAGGGCCATCAGACACACCAATTGGCTCCGTCGTCACTAACGAGAATGGCGATAAAAACAACCCTGGCACCACACCACAAACATCACGGCATTTCCCGGGGGAGCCAGTTCACAGTGTGGTTGTTGCAGCAAACAAAGCCATGCAGGCTGATTACCTGAATTTAAACTCCCCCCGTTTTGGTAAGTGTTTTGTGGCGAAGGACAATACACGTCTGACCATTGATACACTAATCACCGCCGGTGGCTGGGGAAATGTGGAATTTGGTGTGAACTGTAACGGAGTGGTAAAAAATAACTTCAGCCAGGCCAACAAAATTAACTGGGGAGGTGTTACTAAGCCGTTTGTACTTAATTATTCTAACAAACTGGTAATCACCGACACCATTATTCGCCGGGCATCTGGACAGGATGTTGGAGCAGATGGCGTATTTGATACTGGCGGGGCAAACTGGGGGACGGTTGCAAACCTGCAAGCAGCAACTCAGGGCGGGCATTTGTTTGTCGCTGACGCCGTGAGCATCATGATTGGTCAATTAAAATCGGTCGGTATTGGTGGGTTAGGTAGTGATGGTTTGGTATCGGCAGCACTGGTGACGACAGAAAACTGCGATCAGCTTAACTGTACGATGACCTTTTCGAACGTTTCACTTGCGTGGCGAAACAAGAAGAATGGACTGATTGGCAATTTCATTGCCACTGGGGACGTTGGCACCGGCAACAATTTTGCAGAGGGATTAACCGGCACTCCAGCCCTGAACAAGTCATCATTGATGACGATGCAGGCGGTATTCAAGGATGGAACCGGCACAGTTAAAACAAATAACTTTATCGGCTATGGCAATATCGATCTGACTTCAACAGGCGGTAAAACCGTAACAATCCCTCACACGTTATGGCGAGCGCCCTCTGTCGAAGAGATTCAGGCGACACTCCGGCATAGTTCATTTACGGCGCCAGGTACATTTTCACCGGTTTACATCAGCTCATTTAACGCCACACAGGTGGTACTGAGAGTTGACGTAACTACTGCGGCTACCGGCACGCCTGTCTCACAGGTTGTATGCCGTATTAATTGA

Genome Context

Tertiary structure

XPO97406.1
ESMFold structure
Source ESMFold
pLDDT 73.0
Oligomeric state monomer