Protein

View in Explore

Genbank accession

YP_009850624.1 [GenBank]

Protein name

virion structural protein

RBP type

TSP

Evidence DepoScope

Probability 1,00

TSP

Evidence RBPdetect

Probability 0,91

TSP

Evidence RBPdetect2

Probability 0,94

Protein sequence

MSNPFNADQSGKIAYQAPNGTYDMVIGTAEGTTSRIALQFFDYQSVVDAQNQTSANLAAQQALLTQTQDIINGAGDQSTLVRLNQPDGLNLIGAAPEGYGNPPTTPSHLNDVIKRVTPFQFGAKGDGVTDDSDAIQAAHDWCMQQSSRDAADPTRRIGGYVLDLNGPKYWLIKKPLKLNFGSINIEFGKSTLDCRQFPVGADENNHTVVISATYAGAYQQTRAWWSDLNMLGPGQESFCTAVRCNMTSAVPGGYERLCNVLYGGGIEQFGRGLSVGSNCYFLTCYNLSFGHCNEAYYFEPGGKNYGEQITFYSCVFNAGNYQVTTYGGMSNFYGCSFDYCYHQQMKLLGGMVNCVNCWWEGYGPVDYIINIPESTTSVRLNIIGGLFSFKAGATGAESRATSNPFYFGTRASVKFENVQFQKLGNAYYGDSTTAWIDGASQGVSFSGCYFPNSANSFTTVIMNSDPSVINNQFATESYTLGIGAENWLGDTWILPNSDNGLVRKNRWGYGLSNGGTTFSFTRTSNGFVNLDVTQPANSGTFEAVIGTIPVKSTGQVVHYVSGNLYLGTGDGSVNIKTYWVKLIVKGTPDNPDEPRILQMVKATDVNYPIGGTSGQLHSFRWPPSMPTGTQSPASTTVAPDWATHCIMTLDISKIKRNMGGIRINEVFMRQI

Physico‐chemical properties

protein length:	671 AA
molecular weight:	72993,64630 Da
isoelectric point:	5,46515
aromaticity:	0,11773
hydropathy:	-0,26751

Domains

Domains [InterPro]

DC_1436
ATT
1–157

DC_1436

IPR012334
STR
75–561

IPR012334

IPR011050
STR
114–498

IPR011050

DC_0715
STR
115–562

DC_0715

YP_009850624.1

1 671

Architecture

ATT

STR

ATT 1-157 | STR 158-562 |

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_1436	ATT	DC_1436	1	157	Novel HMM	DC_1436	N-terminal	Low	Positional only	26 proteins / 26 hits
IPR012334	STR	IPR012334	75	561	Merged direct domain	Pectin lyase fold	Central	Low	Positional only	867 proteins / 867 hits
IPR011050	STR	IPR011050	114	498	Merged direct domain	Pectin lyase fold/virulence factor	Central	Low	Positional only	572 proteins / 572 hits
DC_0715	STR	DC_0715	115	562	Novel HMM	DC_0715	Central	Low	Positional only	37 proteins / 37 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

YP_009850624.1

1 671

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	131	131	0,9926
Central domain	132	483	353	0,9941
C-terminal	484	671	187	0,9561

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-131

Central
132-483

C-terminal
484-671

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Serratia phage MyoSmar [NCBI]	2596673	Uroviricota > Caudoviricetes > Lindbergviridae > Myosmarvirus myosmar >
Host	Serratia marcescens [NCBI]	615	cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Genbank protein accession

YP_009850624.1 [NCBI]

Genbank nucleotide accession

NC_048800 [NCBI]

CDS location

range 47320 -> 49335
strand -

CDS

TTGTCAAACCCGTTTAACGCAGATCAGAGCGGTAAAATCGCATATCAGGCTCCAAACGGAACATATGACATGGTCATTGGTACTGCAGAGGGCACGACTAGTCGAATTGCCCTTCAATTCTTCGATTACCAAAGTGTAGTGGATGCGCAGAACCAAACTAGTGCCAACTTGGCGGCGCAACAAGCCCTGCTTACTCAGACCCAGGACATCATCAACGGAGCCGGTGACCAATCGACTCTGGTCAGACTCAACCAGCCGGATGGCCTAAACCTTATCGGCGCGGCACCAGAGGGGTATGGCAATCCGCCGACTACCCCATCGCACCTGAATGACGTCATAAAGCGAGTGACGCCATTCCAATTTGGCGCAAAGGGCGACGGTGTTACTGACGATTCCGATGCGATACAAGCAGCGCATGATTGGTGCATGCAACAATCTTCAAGGGACGCGGCGGATCCCACTCGAAGGATTGGCGGATATGTACTTGATTTGAATGGGCCAAAATACTGGCTGATCAAGAAGCCGCTGAAATTAAACTTCGGCAGTATCAACATCGAGTTTGGCAAGTCAACCCTTGATTGCCGCCAGTTCCCTGTCGGAGCCGACGAAAACAATCACACGGTCGTAATCAGCGCAACATACGCTGGCGCGTATCAGCAAACACGTGCGTGGTGGAGCGACCTGAACATGTTGGGGCCAGGTCAGGAATCGTTCTGCACGGCGGTTCGTTGTAACATGACTTCAGCAGTTCCTGGTGGATACGAGCGCCTTTGCAACGTCCTGTACGGCGGCGGAATCGAACAATTCGGGCGTGGCCTCTCTGTTGGCTCCAACTGCTATTTCTTGACTTGTTACAACCTTTCGTTTGGGCATTGTAATGAGGCTTATTACTTCGAGCCTGGTGGCAAGAACTATGGCGAACAAATCACATTCTATTCTTGTGTATTCAACGCCGGAAACTACCAGGTCACAACGTATGGTGGCATGAGCAACTTCTATGGATGCTCATTCGACTATTGCTATCACCAGCAAATGAAGTTGTTGGGCGGCATGGTGAACTGCGTTAATTGTTGGTGGGAGGGTTATGGCCCAGTTGATTATATCATCAACATCCCAGAGTCAACGACGTCAGTGCGATTGAACATCATCGGCGGATTGTTCTCATTCAAAGCTGGCGCGACTGGCGCTGAGTCAAGGGCGACGAGCAACCCATTCTATTTCGGAACCAGGGCGTCAGTTAAATTTGAGAATGTGCAGTTCCAGAAGTTGGGTAATGCGTATTATGGTGACAGCACCACCGCATGGATTGACGGAGCGTCGCAGGGCGTTTCATTTAGTGGATGTTATTTCCCGAACAGCGCAAACTCTTTCACGACCGTGATTATGAACTCAGACCCATCGGTGATCAACAACCAATTTGCAACCGAAAGCTACACGCTTGGTATTGGGGCTGAAAACTGGCTGGGTGATACGTGGATACTTCCGAATTCCGACAACGGATTGGTTAGAAAGAATCGCTGGGGATATGGGCTGTCAAATGGCGGCACCACATTTTCCTTCACAAGAACATCAAACGGATTCGTGAACCTTGATGTCACCCAGCCAGCCAACTCAGGCACCTTTGAAGCGGTCATAGGCACCATTCCTGTAAAAAGTACAGGCCAGGTTGTTCACTATGTATCCGGCAATTTGTATCTTGGCACAGGCGACGGATCAGTGAACATCAAGACTTACTGGGTTAAATTAATCGTCAAGGGAACGCCAGACAATCCTGATGAACCTAGAATCCTTCAGATGGTTAAGGCCACTGACGTGAACTATCCAATCGGAGGAACTTCAGGGCAGCTTCACTCATTCAGGTGGCCGCCATCAATGCCGACCGGCACCCAATCGCCTGCATCAACTACAGTTGCGCCTGATTGGGCAACCCATTGCATTATGACTTTGGATATTTCAAAGATCAAACGTAATATGGGCGGCATCCGAATCAATGAAGTGTTCATGCGCCAAATCTAA

Genome Context

Tertiary structure

PDB ID

88578e2c281e76b6a90f162989d54a2e052fe45269af14072eb159a961f53a1d

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,6953

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence