Protein

View in Explore

Genbank accession

QEG13812.1 [GenBank]

Protein name

hypothetical protein

RBP type

TSP

Evidence DepoScope

Probability 1,00

TSP

Evidence RBPdetect

Probability 0,91

TSP

Evidence RBPdetect2

Probability 0,94

Protein sequence

MMELKTFFAQDKFGNLVPGATVTVYNAGTTNLATGLKDQSGAALSNPFNADQSGKIAYQAPNGTYDMVIGTAEGTTSRIALQFFDYQSVVDAQNQTSANLAAQQALLTQTQDIINGAGDQSTLVRLNQPDGLNLIGAAPEGYGNPPTTPSHLNDVIKRVTPFQFGAKGDGVTDDSDAIQAAHDWCMQQSSRDAADPTRRIGGYVLDLNGPKYWLIKKPLKLNFGSINIEFGKSTLDCRQFPVGADANNHTVVISATYAGAYQQTRAWWSDLNMLGPGQESFCTAVRCNMTSAVPGGYERLCNVLYGGGIEQFGRGLSVGSNCYFLTCYNLSFGHCNEAYYFEPGGKNYGEQITFYSCVFNAGNYQVTTYGGMSNFYGCSFDYCYHQQMKLLGGMVNCVNCWWEGYGPVDYIINIPESTTSVRLNIIGGLFSFKAGATGAESRATSNPFYFGTRASVKFENVQFQKLGNAYYGDSTTAWIDGASQGVSFSGCYFPNSANSFTTVIMNSDPSVINNQFATESYTLGIGAENWLGDTWILPNSDNGLVRKNRWGYGLSNGGTTFSFTRTSNGFVNLDVTQPANSGTFEAVIGTIPVKSTGQVVHYVSGNLYLGTGDGSVNIKTYWVKLIVKGTPDNPDEPRILQMVKATDVNYPIGGTSGQLHSFRWPPSMPTGTQSPASTTVAPDWATHCIMTLDISKIKRNMGGIRINEVFMRQI

Physico‐chemical properties

protein length:	714 AA
molecular weight:	77379,59350 Da
isoelectric point:	5,58013
aromaticity:	0,11625
hydropathy:	-0,23964

Domains

Domains [InterPro]

DC_1436
ATT
2–200

DC_1436

IPR012334
STR
119–605

IPR012334

DC_0715
STR
155–608

DC_0715

IPR011050
STR
157–540

IPR011050

QEG13812.1

1 714

Architecture

ATT

STR

ATT 2-200 | STR 201-608 |

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_1436	ATT	DC_1436	2	200	Novel HMM	DC_1436	N-terminal	Low	Positional only	26 proteins / 26 hits
IPR012334	STR	IPR012334	119	605	Merged direct domain	Pectin lyase fold	Central	Low	Positional only	867 proteins / 867 hits
DC_0715	STR	DC_0715	155	608	Novel HMM	DC_0715	Central	Low	Positional only	37 proteins / 37 hits
IPR011050	STR	IPR011050	157	540	Merged direct domain	Pectin lyase fold/virulence factor	Central	Low	Positional only	572 proteins / 572 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

QEG13812.1

1 714

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	175	175	0,9937
Central domain	176	524	350	0,9949
C-terminal	525	714	189	0,9778

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-175

Central
176-524

C-terminal
525-714

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Erwinia phage vB_EamM_TropicalSun [NCBI]	2591372	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	No host information

Coding sequence (CDS)

Genbank protein accession

QEG13812.1 [NCBI]

Genbank nucleotide accession

MN013090 [NCBI]

CDS location

range 14463 -> 16607
strand +

CDS

ATGATGGAATTAAAAACCTTCTTTGCGCAAGATAAGTTCGGCAACCTTGTGCCTGGCGCAACAGTAACAGTCTACAACGCCGGCACAACCAACCTCGCAACTGGCCTGAAAGATCAGAGTGGCGCGGCATTGTCAAACCCGTTTAACGCAGATCAGAGCGGTAAAATCGCATATCAGGCTCCAAACGGAACATATGACATGGTCATTGGTACTGCAGAGGGCACGACTAGTCGAATTGCCCTTCAATTCTTCGATTACCAAAGTGTAGTGGATGCGCAGAACCAAACTAGTGCCAACTTGGCGGCGCAACAAGCCCTGCTTACTCAGACCCAGGACATCATCAACGGAGCCGGTGACCAATCGACTCTGGTCAGACTCAACCAGCCGGATGGCCTAAACCTTATCGGCGCGGCACCAGAGGGGTATGGCAATCCGCCGACTACCCCATCGCACCTGAATGACGTCATAAAGCGAGTGACGCCATTCCAATTTGGCGCAAAGGGCGACGGTGTTACTGACGATTCCGATGCGATACAAGCAGCGCATGATTGGTGCATGCAACAATCTTCAAGGGACGCGGCGGATCCCACTCGAAGGATTGGCGGATATGTACTTGATTTGAATGGGCCAAAATACTGGCTGATCAAGAAGCCGCTGAAATTAAACTTCGGCAGTATCAACATCGAGTTTGGCAAGTCAACCCTTGATTGCCGCCAGTTCCCTGTCGGAGCCGACGCAAACAATCACACGGTCGTAATCAGCGCAACATACGCTGGCGCGTATCAGCAAACACGTGCGTGGTGGAGCGACCTGAACATGTTGGGGCCAGGTCAGGAATCGTTCTGCACGGCAGTTCGTTGTAACATGACTTCAGCCGTTCCTGGTGGATACGAGCGCCTTTGCAACGTCCTGTACGGCGGCGGAATCGAACAATTCGGGCGTGGCCTCTCTGTTGGCTCCAACTGCTATTTCTTGACTTGTTACAACCTTTCGTTTGGGCATTGTAATGAGGCTTATTACTTCGAGCCTGGTGGCAAGAACTATGGCGAACAAATCACATTCTATTCTTGTGTATTCAACGCCGGAAACTACCAGGTCACAACGTATGGTGGCATGAGCAACTTCTATGGATGCTCATTCGACTATTGCTATCACCAGCAAATGAAGTTGTTGGGCGGCATGGTGAACTGCGTTAATTGTTGGTGGGAGGGTTATGGCCCAGTTGATTATATCATCAACATCCCAGAGTCAACGACGTCAGTGCGATTGAACATCATCGGCGGATTGTTCTCATTCAAAGCTGGCGCGACTGGCGCTGAGTCAAGGGCGACGAGCAACCCATTCTATTTCGGAACCAGGGCGTCAGTTAAATTTGAGAATGTGCAGTTCCAGAAGTTGGGCAATGCGTATTATGGTGACAGCACCACCGCATGGATTGACGGAGCGTCGCAGGGCGTTTCATTTAGTGGATGTTATTTCCCGAACAGCGCAAACTCTTTCACGACCGTGATTATGAACTCAGACCCATCGGTGATCAACAACCAATTTGCAACCGAAAGCTACACGCTTGGTATTGGGGCTGAAAACTGGCTGGGTGATACGTGGATACTTCCGAATTCCGACAACGGATTGGTTAGAAAGAATCGCTGGGGATATGGGCTGTCAAATGGCGGCACCACATTTTCCTTCACAAGAACATCAAACGGATTCGTGAACCTTGATGTCACCCAGCCAGCCAACTCAGGCACCTTTGAAGCGGTCATAGGCACCATTCCTGTAAAAAGTACAGGCCAGGTTGTTCACTATGTATCCGGCAATTTGTATCTTGGCACAGGCGACGGATCAGTGAACATCAAGACTTACTGGGTTAAATTAATCGTCAAGGGAACGCCAGACAATCCTGATGAACCTAGAATCCTTCAGATGGTTAAGGCCACTGACGTGAACTATCCAATCGGAGGAACTTCAGGGCAGCTTCACTCATTCAGGTGGCCGCCATCAATGCCGACCGGCACCCAATCGCCTGCATCAACTACAGTTGCGCCTGATTGGGCAACCCATTGCATTATGACTTTGGATATTTCAAAGATCAAACGTAATATGGGCGGCATCCGAATCAATGAAGTGTTCATGCGCCAAATCTAA

Genome Context

Tertiary structure

PDB ID

84f84200b64fc4d5a4e5a25c820053b393dadd1f84555c8b00210d19d3c0e272

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,7094

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence