Protein

View in Explore

Genbank accession

XSG66671.1 [GenBank]

Protein name

tail protein

RBP type

TSP

Evidence RBPdetect

Probability 0,90

Evidence RBPdetect2

Probability 0,88

Protein sequence

MNFVVNNVPDGVPIRIFIDEICEDNDVTEDFDALKEDAIFYIVESAGGGVVKGVMKIFSVILKPLAKLLSPSAKGLSSNFANSQADSPNNSLTDRNNKPRPYERSYDICGTVQTVPNNLMTTYKIFNDTGRIIEYGYYDAGRGHLDIKAEDVTEGDTRVQDIDGSSVAIYAPYTSPNNTSTPQLQIGEVIDQQLYTTIESNEIDGITLRAPNDLGVTFSGETAVVTLSGTTGRITETAGGVDFTEDFSVGDIANLNAWTTNTVNIGDHYTVTSVSETVIELDVSSRLLSWSSASGNPIRGSDGENSIRPTDTLDKTLTDWVSINRSTVERIVVNIAAPNGMYKDNGSKLTMSATAEVQYQALDESGAPFGPIYTATGTITGRSSDYNGVTIYGYLPTASRVRVRARRTSDTDRGFNGTVSDEIVYANLYGQSVDTTPHYGNRTTVHSARKQTPRATEVRQPQLRMIATEMVFKYLGGGVFDTVMTPNRQAVQSLIRLARDPVVGGLDLSVANMDALLETQEEVESYFGSSDAGEFCYTFDDYKTTMQEIVTIIAEAIFCTPYRKGADILLDFERPRLGPEMVFTHRSKVKTSEKWSRTFNDPQVFDSLKFSYIDPVTNVKGTISIPETGGLKTETYDSKGVRNKKQAYWLAHRRHQKNILRKVNVSFTATEEGIFARPNRPISVVKGSRMATYDGYITSVDGLTVHLSSPVQFTAGEPHSLVLKTRDGGAQSIPVIEGPDNRSVIMLSVPQEAIYTGNSALKTEFSFGSDSRHAAQMIMVSTVEPSDDRTVRITGFNYDADYYKYDGVSPFGRAFSDGFSNGFS

Physico‐chemical properties

protein length:	824 AA
molecular weight:	90389,59230 Da
isoelectric point:	4,98691
aromaticity:	0,08859
hydropathy:	-0,34976

Domains

Domains [InterPro]

DC_0118
STR
1–657

DC_0118 DC_0808

NF040662
Unmapped
326–804

NF040662

XSG66671.1

1 824

Architecture

STR

RBD

STR 1-657 | RBD 675-818 |

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_0118	STR	DC_0118	1	657	Novel HMM	DC_0118	Central	Low	Positional only	383 proteins / 383 hits
NF040662	Unmapped	-	326	804	NCBIfam	host specificity factor TipJ family phage tail protein	-	-	-	-
DC_0808	RBD	DC_0808	675	818	Novel HMM	DC_0808	C-terminal	Low	Positional only	361 proteins / 361 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

XSG66671.1

1 824

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	201	201	0,9741
Central domain	202	400	200	0,5278
C-terminal	401	824	423	0,1865

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-201

Central
202-400

C-terminal
401-824

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Salmonella phage SaI_NFG_5579 [NCBI]	3420192	Viruses >
Host	Salmonella enterica subsp. enterica serovar Infantis [NCBI]	595	Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Salmonella > Salmonella enterica

Coding sequence (CDS)

Genbank protein accession

XSG66671.1 [NCBI]

Genbank nucleotide accession

PV593526 [NCBI]

CDS location

range 15708 -> 18182
strand -

CDS

ATGAATTTTGTAGTAAATAATGTGCCTGATGGGGTTCCTATTCGCATATTTATTGATGAAATATGTGAAGATAACGACGTAACAGAAGATTTTGATGCGTTAAAAGAAGATGCAATATTTTATATTGTTGAGTCTGCGGGGGGTGGCGTTGTAAAAGGGGTAATGAAAATATTCAGCGTCATCCTTAAACCACTTGCAAAGCTTTTAAGCCCATCGGCAAAAGGCTTATCTTCTAATTTTGCAAACTCGCAGGCGGACTCGCCAAACAATAGCCTTACAGACCGCAACAATAAGCCACGACCATATGAGCGCAGTTATGACATATGTGGCACGGTACAAACCGTACCGAACAATCTTATGACAACGTACAAAATATTCAATGATACGGGCCGCATCATTGAATATGGGTATTATGACGCCGGGAGAGGTCATCTCGATATAAAAGCTGAAGATGTTACTGAAGGGGACACGCGGGTGCAGGATATTGACGGGTCGTCCGTCGCGATATACGCCCCGTACACATCACCTAATAACACATCAACACCACAGTTACAGATAGGAGAGGTTATAGACCAGCAGTTGTACACCACTATAGAGTCCAACGAGATAGACGGCATAACGCTTAGGGCCCCAAATGATTTAGGCGTAACATTCAGTGGAGAGACGGCAGTAGTTACGTTGTCAGGAACAACAGGAAGAATAACAGAAACTGCCGGTGGTGTTGACTTCACAGAAGATTTTTCTGTAGGCGATATCGCTAACTTAAATGCCTGGACAACTAACACCGTTAATATAGGAGACCATTACACTGTAACATCGGTGTCAGAAACAGTTATTGAACTGGACGTATCATCGAGGCTACTGTCTTGGTCAAGCGCAAGCGGCAACCCTATCAGGGGGAGCGACGGTGAAAATAGTATCAGACCAACGGACACGCTAGATAAAACATTAACGGACTGGGTGTCTATAAATAGGAGTACCGTAGAGCGCATAGTGGTTAATATCGCCGCGCCAAATGGTATGTATAAAGACAATGGCAGCAAATTAACGATGTCTGCGACCGCCGAGGTGCAATATCAGGCCCTGGATGAGAGTGGAGCGCCGTTCGGGCCCATATACACCGCCACAGGAACAATAACAGGTCGTAGCTCAGATTATAATGGAGTTACGATATATGGCTATCTACCGACCGCGTCCCGTGTTCGGGTTAGAGCGCGGCGCACATCAGACACCGATAGAGGTTTTAATGGCACCGTTTCGGACGAAATTGTATACGCTAACCTGTACGGTCAGTCTGTGGACACAACCCCACACTATGGTAATAGAACAACAGTACATTCGGCGCGAAAACAAACCCCCAGGGCGACGGAAGTTAGGCAACCACAGCTACGTATGATTGCCACCGAAATGGTATTCAAATACTTGGGTGGTGGAGTTTTTGATACGGTAATGACACCAAATAGACAAGCTGTTCAGTCTCTTATTCGGCTAGCGAGGGACCCGGTAGTTGGTGGTCTTGATTTATCTGTAGCTAATATGGACGCGCTTTTAGAGACTCAAGAAGAAGTCGAGTCGTATTTCGGTTCTTCTGATGCTGGCGAGTTTTGCTACACGTTCGATGATTATAAGACCACAATGCAGGAAATAGTTACCATTATTGCCGAGGCTATATTTTGCACTCCGTATCGAAAAGGTGCGGATATACTTTTAGATTTTGAACGTCCGCGATTAGGGCCGGAGATGGTGTTTACTCACCGCAGTAAAGTAAAAACGTCTGAGAAATGGTCACGAACATTCAATGACCCCCAGGTTTTTGACAGCCTTAAATTCTCGTACATAGACCCTGTAACAAACGTTAAGGGGACAATATCTATCCCTGAAACAGGAGGTTTAAAGACCGAGACGTACGACTCTAAAGGGGTTCGCAATAAAAAACAAGCATACTGGCTGGCGCACAGACGGCATCAAAAAAATATCTTACGCAAAGTTAACGTATCATTCACCGCAACCGAAGAAGGTATTTTTGCACGACCAAACCGCCCGATATCTGTGGTTAAAGGCTCGCGCATGGCTACTTATGATGGCTATATAACTTCAGTAGACGGTTTAACGGTTCACTTGTCGTCGCCAGTACAGTTTACCGCAGGGGAACCACATTCGCTGGTACTGAAAACTCGCGATGGTGGCGCGCAAAGCATTCCGGTAATAGAAGGGCCTGACAATCGTTCTGTAATAATGCTTTCAGTACCGCAAGAAGCCATCTATACTGGTAACAGCGCGCTGAAGACAGAATTTTCCTTCGGCAGCGATAGCCGCCATGCGGCGCAAATGATTATGGTCAGCACCGTAGAACCGAGCGACGATAGAACCGTGCGCATCACTGGGTTCAATTACGATGCCGATTACTACAAATACGATGGCGTTTCGCCATTTGGCCGCGCATTTAGCGACGGATTCAGCAACGGTTTTAGTTAA

Genome Context

Tertiary structure

PDB ID

707afdd8de6f86de38937b6880b42486bb667f4778280c31aa76e62c55a1a839

ColabFold

Source ColabFold

Method ColabFold

Resolution 0,3116

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence