Protein

View in Explore

Genbank accession

QEG06821.1 [GenBank]

Protein name

tip attachment protein J

RBP type

TSP

Evidence RBPdetect

Probability 0,87

Evidence RBPdetect2

Probability 0,84

Protein sequence

MALTLHYTRNEAGTFDRERHNVPPMEYVVANIPDGVPVRIYRGEIGEDTEVTEDFEALKEDDVFHIIEGAGDGGGFLGKLLDPLGVLKFVTKLISPSQKTPKTSLANQQAESPNNSLTDRNNKPRPYERSYDICGRVQTIPNDLMTTYKIFDESGRIIEYGYYDAGRGYLDIKAEDITDGDTKVQEITGTSVAVYAPFTSPNNTNTPQLLVGEPINQNLYITIASNEVDGAVLKAQNDIRVNPSDTGRVRYDSATKIGYLYDDTGDSGFAEILSVGDTASFNNFDVPDVTNTNGNFRVLYVDNFELRVDTGGASNWAALGSTTYSLSRRSDTWVGPVDTYERTLTDWTTLNRLEVERVVANIAAANGMYKDNGSKLRTSVTIELQYQLLDETGAPYGSIYSKQAVISGRSADYTGVTIYADLPMRSKVRVRARRVTNLDLDFEGTVVDEVSYINLYGQVRDTTPHYGNRTTVHSARKQTPRAAEIKQPQLRMVATEMVYKYLGNGVFDTVMTPNTQAIQSLIRLARDPVVGNLNLTTSNMDKLLATQTEIENYFGNVEAGQFCYTFDDYKMTMQDIISTIADAIFCTPYRKGQDILLDFERPRMGPEMVFTHRSKTTASEKWTRTFNDAQVYDSLKFSYIDPDTNVKETISIPAEGGVNTETYDSKGIRNYRQAYWAAYRRYQKNLLKKVTVSFTATEEGVFVLPGRAISVVKGSRVAPQDGYVVAVNGLTLTLSQPVTFTPGDDHSLILKKRDGGVQSVAVVPGSHDREVVMLSAPQEAIYTGNSALKTEFSFGNEARHNAQMILVSTVDPGDDRTVKITGINYEADFYKYDGVAPYGSGFSDGFSDGFN

Physico‐chemical properties

protein length:	851 AA
molecular weight:	94412,13880 Da
isoelectric point:	4,99174
aromaticity:	0,09636
hydropathy:	-0,42550

Domains

Domains [InterPro]

DC_0118
STR
1–684

DC_0118 DC_0808

NF040662
Unmapped
354–831

NF040662

QEG06821.1

1 851

Architecture

STR

RBD

STR 1-684 | RBD 704-845 |

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_0118	STR	DC_0118	1	684	Novel HMM	DC_0118	Central	Low	Positional only	383 proteins / 383 hits
NF040662	Unmapped	-	354	831	NCBIfam	host specificity factor TipJ family phage tail protein	-	-	-	-
DC_0808	RBD	DC_0808	704	845	Novel HMM	DC_0808	C-terminal	Low	Positional only	361 proteins / 361 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

QEG06821.1

1 851

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	234	234	0,9870
Central domain	235	433	200	0,6678
C-terminal	434	851	417	0,1253

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-234

Central
235-433

C-terminal
434-851

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Escherichia phage Schulenburg [NCBI]	2580401	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	Escherichia coli [NCBI]	562	cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Genbank protein accession

QEG06821.1 [NCBI]

Genbank nucleotide accession

MK931438 [NCBI]

CDS location

range 20813 -> 23368
strand +

CDS

TTGGCGCTGACATTACATTACACCCGTAACGAAGCCGGTACTTTCGACCGCGAACGGCACAACGTACCGCCGATGGAATACGTCGTCGCTAACATCCCCGACGGGGTGCCTGTACGTATTTACCGTGGCGAGATCGGCGAGGACACGGAAGTAACTGAAGATTTCGAAGCGCTGAAAGAAGACGATGTTTTCCATATTATCGAAGGCGCTGGTGACGGTGGCGGTTTTCTGGGTAAACTCCTGGACCCTTTGGGTGTGCTTAAATTTGTTACCAAGTTGATTTCTCCGTCGCAGAAAACGCCTAAAACGAGTTTAGCGAACCAGCAGGCTGAGTCCCCCAACAACAGCCTGACGGACCGAAACAATAAACCCCGTCCATATGAACGGTCGTATGATATTTGCGGCAGAGTCCAGACTATCCCTAATGACCTCATGACTACCTATAAAATATTCGATGAATCTGGTCGCATTATTGAATACGGATACTACGATGCCGGTCGTGGGTATCTGGACATCAAGGCCGAAGATATTACCGACGGCGATACTAAGGTACAGGAGATTACGGGGACCTCTGTCGCGGTGTACGCGCCGTTTACATCCCCCAACAATACAAATACCCCGCAGCTTCTGGTGGGGGAACCTATCAATCAGAATCTTTATATAACTATCGCGTCTAATGAAGTAGATGGAGCCGTTCTTAAAGCCCAGAACGATATTCGGGTCAACCCAAGCGACACGGGCCGCGTGAGATATGACTCTGCTACAAAAATTGGATACCTGTATGACGACACGGGGGATTCTGGCTTCGCGGAAATATTATCTGTTGGTGACACCGCGTCGTTCAATAACTTTGACGTTCCGGACGTAACAAATACCAACGGCAACTTTCGTGTTCTTTATGTCGATAACTTCGAGCTGCGGGTCGACACCGGCGGCGCGTCTAATTGGGCTGCTTTAGGCTCAACCACCTATTCACTTTCCCGGAGAAGTGACACGTGGGTAGGCCCCGTGGATACGTATGAAAGAACATTAACCGACTGGACCACCTTAAACCGCCTGGAAGTTGAACGCGTAGTAGCCAACATCGCTGCCGCTAACGGTATGTATAAAGACAACGGCAGTAAATTGCGTACGTCGGTAACTATTGAACTCCAATACCAACTACTCGATGAAACCGGTGCCCCATACGGGAGTATCTATTCAAAACAGGCCGTTATATCTGGTCGGTCCGCCGACTACACCGGAGTTACTATTTACGCCGACTTGCCCATGAGGTCGAAAGTTAGGGTACGTGCCCGTCGTGTTACCAACCTGGACCTTGATTTCGAGGGCACCGTGGTAGACGAGGTTTCCTATATCAACCTTTACGGTCAGGTCCGTGACACTACGCCACATTACGGCAATCGTACTACCGTACACTCGGCACGTAAGCAGACGCCGCGGGCCGCAGAGATTAAGCAACCACAGTTACGTATGGTCGCCACAGAGATGGTGTACAAATACCTCGGTAATGGTGTATTCGACACCGTAATGACACCGAATACTCAGGCCATTCAATCATTAATACGTCTCGCCCGTGACCCAGTAGTAGGTAATCTCAACCTAACAACATCCAATATGGACAAGTTGTTAGCGACTCAGACCGAGATTGAGAATTATTTCGGTAACGTGGAGGCGGGTCAATTCTGCTACACTTTTGACGACTATAAAATGACCATGCAGGATATCATCAGCACAATAGCCGATGCTATTTTCTGCACTCCATATCGTAAAGGGCAAGACATATTACTGGATTTCGAGCGCCCGCGTATGGGGCCGGAAATGGTATTCACACATCGAAGTAAGACAACAGCTTCGGAAAAGTGGACGCGCACATTCAACGACGCTCAGGTATACGATAGTCTTAAGTTCTCCTACATCGACCCAGATACTAACGTAAAAGAGACCATCAGCATTCCCGCCGAGGGCGGTGTTAACACAGAAACGTATGACTCTAAAGGTATACGTAATTATCGTCAGGCGTACTGGGCGGCGTACCGTCGGTACCAGAAGAACCTGTTGAAGAAGGTGACGGTATCATTCACGGCGACAGAAGAAGGGGTTTTTGTGCTTCCAGGACGGGCAATAAGCGTAGTTAAAGGCTCGCGAGTAGCACCTCAAGATGGTTATGTCGTTGCCGTTAATGGGCTTACCCTTACTCTTTCTCAGCCGGTTACGTTTACTCCGGGTGATGACCACTCACTGATTCTTAAGAAGAGAGACGGCGGAGTTCAAAGTGTTGCTGTTGTGCCTGGAAGCCACGACCGTGAAGTGGTTATGCTCTCTGCGCCTCAAGAGGCGATATACACAGGGAATAGCGCACTAAAAACTGAGTTTTCATTCGGTAACGAAGCAAGGCATAATGCTCAGATGATTCTTGTTTCTACAGTTGACCCCGGAGACGACAGAACGGTTAAGATTACCGGGATTAACTATGAAGCAGATTTCTATAAATACGACGGCGTCGCGCCATACGGCAGCGGTTTCTCCGACGGATTCAGCGATGGTTTTAATTAA

Genome Context

Tertiary structure

PDB ID

37af5a23679775da80d1c4867effcd3296716b832d7de254ef83cef56af46ffc

ColabFold

Source ColabFold

Method ColabFold

Resolution 0,2911

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence