Protein

View in Explore

Genbank accession

XPO96674.1 [GenBank]

Protein name

tail protein

RBP type

Evidence Phold

Probability 1,00

TSP

Evidence RBPdetect

Probability 0,88

Evidence RBPdetect2

Probability 0,80

Protein sequence

MALILHYTRNEDGTFGRKRSNVPPMEYVVANIPDGVPVRIYRGEIGEDTEVTEDFEALKEDDVFHIIEGAGGGGGFLGKLLDPLGVLKFVTKLISPSQKTPKTSLANQQAESPNNSLTDRNNKPRPYERSYDICGRVQTIPNDLMTTYKVFNTAGRVIEYGYYDAGRGYLDIKAEDITDGDTKVQEITGTSVAVYAPFTSPNNTNAPQLLVGDPINQGLFITIASNEVDGAVLKAPNDLANNVGSSARARLVGTTGTITDPTGDSAFNTYIAPGDQATFTWIRPEGHGNLDGVYTVLSVDEFQITVDASPKLSEWQTLPDRGGGVREGYVTQDKAATIGPTDTYDASLTDWVSLNRIKVGRVVANFAAANGMYKDDGNKQGTSVTVEVQYQLIGDDGAPYGPVYNKRGTISGRTSDYTGVTVFADLPTESRVRVRCRRVSNFDFDFGGTVVDEVSYINLYGQVRDTTPHYGNRTTVHSARKQTPRAAEIKQPQLRMVATEMVYKYLGNGVFDTVMTPNTQAVQSLIRLARDPVVGNLNLTTSNMDKLLATQTEIENYFGNAEAGQFCYTFDEYKMTMQDIISTIADAIFCTPYRKGQDILLDFERPRMGPEMVFTHRSKTTASEKWTRTFNDAQVYDSLKFSYIDPDTNVKETISIPAEGGVNTETYDSKGIRNYRQAYWAAYRRYQKNLLKKVTVSFTATEEGVFVLPGRAISVVKGSRVAPQDGYIVAVNGLALTLSQPVTFTPGDDHSLILKKRDGGVQSVAVVPGSHDREVIMLSAPQEAIYTGNSALKTEFSFGNEARHNAQMILVSTVDPGDDRTVKITGINYEADFYKYDGVAPFGRGFSDGFSNGFS

Physico‐chemical properties

protein length:	855 AA
molecular weight:	93849,70880 Da
isoelectric point:	5,20335
aromaticity:	0,09474
hydropathy:	-0,39123

Domains

Domains [InterPro]

DC_0118
STR
1–688

DC_0118 DC_0808

NF040662
Unmapped
361–835

NF040662

XPO96674.1

1 855

Architecture

STR

RBD

STR 1-688 | RBD 707-848 |

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_0118	STR	DC_0118	1	688	Novel HMM	DC_0118	Central	Low	Positional only	383 proteins / 383 hits
NF040662	Unmapped	-	361	835	NCBIfam	host specificity factor TipJ family phage tail protein	-	-	-	-
DC_0808	RBD	DC_0808	707	848	Novel HMM	DC_0808	C-terminal	Low	Positional only	361 proteins / 361 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

XPO96674.1

1 855

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	232	232	0,9930
Central domain	233	431	200	0,3608
C-terminal	432	855	423	0,1400

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-232

Central
233-431

C-terminal
432-855

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Escherichia phage EM1 [NCBI]	3385242	Viruses >
Host	Escherichia marmotae [NCBI]	1499973	cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Genbank protein accession

XPO96674.1 [NCBI]

Genbank nucleotide accession

PQ571293.1 [NCBI]

CDS location

range 26450 -> 29017
strand +

CDS

TTGGCGCTGATATTACATTACACCCGTAACGAAGATGGTACTTTCGGCCGCAAACGGAGCAACGTACCGCCGATGGAATACGTCGTCGCTAACATCCCCGACGGCGTACCAGTGCGCATTTACCGCGGCGAAATAGGCGAAGATACAGAAGTCACCGAAGACTTCGAAGCGCTGAAAGAAGATGACGTTTTCCATATTATCGAAGGTGCGGGCGGTGGTGGCGGTTTTCTGGGTAAACTCCTGGACCCATTGGGCGTGCTTAAGTTTGTCACTAAGCTGATTTCACCGTCGCAGAAAACGCCTAAAACTAGTTTAGCCAACCAACAGGCTGAGTCGCCAAACAACAGCCTGACGGACCGAAACAATAAACCACGCCCATATGAACGGTCGTATGACATTTGCGGCAGGGTCCAGACTATCCCTAATGACCTCATGACCACGTATAAGGTATTTAATACCGCCGGTCGCGTTATTGAGTACGGGTACTATGATGCGGGTCGCGGTTACCTTGATATCAAAGCAGAAGATATTACCGACGGGGACACTAAAGTACAGGAGATTACCGGGACCTCCGTTGCCGTGTACGCGCCCTTCACTTCGCCCAACAACACGAATGCTCCGCAGTTGTTGGTTGGTGACCCCATAAACCAGGGGTTATTCATAACTATAGCATCCAATGAAGTAGACGGCGCCGTTTTAAAAGCACCAAACGACCTCGCTAACAACGTGGGCAGCTCGGCCCGCGCCCGTCTTGTCGGCACCACGGGGACAATAACCGACCCAACGGGGGATTCGGCATTCAATACCTACATTGCCCCGGGAGACCAGGCCACTTTTACGTGGATACGCCCAGAAGGACATGGCAATCTTGATGGCGTCTACACGGTATTAAGTGTGGACGAGTTCCAGATAACGGTTGACGCCTCCCCAAAACTATCTGAGTGGCAGACTCTGCCAGACCGGGGCGGCGGAGTGCGTGAAGGCTACGTAACGCAGGATAAAGCCGCAACCATCGGGCCTACGGATACATATGACGCTAGCCTAACAGATTGGGTCTCTCTTAACCGAATTAAGGTTGGGCGCGTCGTGGCAAACTTCGCCGCGGCAAATGGTATGTATAAAGACGACGGCAATAAACAGGGGACCTCTGTAACCGTTGAGGTTCAGTACCAATTAATCGGAGATGACGGTGCTCCTTACGGCCCTGTATACAATAAACGGGGTACTATTTCAGGCCGTACTAGCGATTACACAGGGGTCACTGTGTTCGCGGACCTTCCAACTGAATCCAGGGTTAGGGTGCGCTGCCGTAGGGTTAGTAACTTTGATTTTGACTTTGGCGGTACAGTGGTAGACGAGGTTTCGTACATTAACCTTTATGGGCAGGTACGTGATACTACGCCGCATTACGGCAATCGTACTACCGTACACTCAGCACGTAAGCAGACGCCGCGCGCGGCAGAGATTAAGCAACCACAGTTACGTATGGTCGCCACAGAGATGGTGTACAAATACCTCGGCAACGGCGTATTCGACACGGTTATGACGCCGAATACTCAGGCCGTTCAATCATTAATCCGTCTTGCCCGCGACCCGGTAGTAGGTAATCTCAACCTAACAACATCCAATATGGACAAGTTGTTAGCGACCCAGACCGAGATAGAAAACTATTTCGGTAACGCGGAGGCAGGCCAATTCTGCTACACTTTTGACGAATATAAAATGACCATGCAGGATATCATCAGCACAATAGCTGATGCTATTTTCTGCACTCCATATCGTAAAGGGCAGGACATATTACTGGATTTCGAGCGCCCTCGTATGGGGCCGGAGATGGTATTCACCCACCGCAGCAAAACCACAGCTTCTGAAAAGTGGACGCGTACATTCAACGACGCACAGGTATACGATAGTCTTAAGTTCTCCTACATCGACCCTGATACTAACGTTAAAGAGACAATCAGCATACCAGCAGAAGGAGGAGTTAATACTGAAACGTATGACTCTAAAGGGATTCGAAATTATAGACAGGCGTACTGGGCCGCATACCGCCGCTACCAGAAAAACTTGTTGAAAAAAGTCACGGTGTCCTTCACGGCGACAGAAGAAGGCGTTTTTGTATTACCGGGTCGCGCTATAAGCGTGGTTAAAGGCTCTCGCGTAGCCCCGCAAGATGGGTATATTGTTGCCGTTAATGGGCTTGCCCTAACACTATCGCAACCGGTTACATTTACCCCCGGTGACGACCACTCTTTAATCCTTAAGAAGCGCGACGGCGGTGTTCAGAGCGTTGCAGTGGTTCCGGGAAGCCACGACCGTGAAGTGATTATGCTATCCGCGCCTCAAGAAGCGATTTACACGGGGAATAGCGCACTAAAAACTGAGTTTTCATTCGGCAACGAAGCAAGGCATAATGCTCAGATGATTCTTGTTTCTACAGTCGACCCTGGAGACGACAGAACAGTTAAGATTACCGGGATTAACTACGAAGCAGATTTCTACAAATACGACGGCGTCGCACCTTTTGGTCGCGGTTTCTCCGACGGATTTAGCAACGGTTTTAGTTAA

Genome Context

Tertiary structure

PDB ID

8a4acd62b085e39c2123971571e9027cbef0f8fe99ef402227ed618312863e08

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,8017

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence