UniProt accession
A0A4Y5NUA6 [UniProt]
Protein name
Tail fiber protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,88
TF
Evidence RBPdetect2
Probability 0,95
Seq2Symm
C3 confidence 0,302 truncated
C3 0,302
C1 0,033
C10-C17 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAKNVISGSKGGSSKPYVPKEMEDNLISINKIKILLAVSDGECDETFSLRDLYLDDVPVMNDDGTYNYSGVSAEFRPGTQDQDYIQGFTDTSSEITVSRNLETDTPYVIAVTNKNLSAIRIKILMPTGIKQEDNGDLVGVSVTYAVDMAVDGGSYNEILSDTISGKTRSGYDRSRRIDLPAFNEQVLFRVRRVTPDSTSSKVTDLIKLQSYAEVVDAKFRYPLTGLVYVEFDSELFPNQIPRIAVKKKWKIINVPSNYDPVLREYHGAWDGTWKKAWSNNPAYILYDLITNQRYGLDQRELGIPLDKWSIYEAGQYCDQMVPDGKGGTEPRYLCDVVIQSQIEAYQLVRDICSIFRGMSFWNGESLSIVVDRPREPSYIFTNDNVVNGDFSYTFASEKSMYTQCNVTFDDEQNMYQQDVEGVFETEAALRFGYNPTSITAIGCTRRSEANRRGRWVLKTNLRSTTVNFATGLEGMIPSIGDVVAIADNFWSSALTLNLSGRVMEVSGLQVFLPFKVDARPGDFIMVNKPDGKPVKRTIANVSADGKTIELNIGFGFDVQPDTVFAIDRTDIALQQYVVTTITKGDNEDEFTYSITAVEYDPNKYDEIDYGVNIDDRPTSIVQPDVMQPPENVAVSSYSRIVQGVSVETMVVSWDKVPYASLYEVQWRKDNSNWLNVPQTANKEIEVEGIYAGVYYVRVRSVSASGSTSPWSGIVTASLTGKVGEPGKPINLTASTNEVFGIRVKWGMPEGTGDTAYIELHQSPDGTAENSSLLTLVPYPQFEYWHSTLPAGKVVWYRVRSVDRIGNVSGWSDFVRGMASDDVSDIIGDILDDIWNTEGGKEIKENAIDSANKIKDQAQSIIQNALANDTDVRIMRKENGKRKAEFRQSIQLIADETEARVTAMTQLKAEFDEEITSEVTRLDQAIATESETRATAIEELKSQIGDDIQGQLTRVEEAIANETEARVSADTALTAKFGDVESALTEKLDSWAGVGGVGAQYAMKLGLTYNGQKYSAGMVMQLSNSPQGLISQILFDAGRFAIMTSSTGGTYTLPFVVENNQVFINSLLVKDGSITNAMIGNFIQSNNYVWNQSGWRLDKNGTFENYGSTPGDGSMKMTNETISVRDANGVLRVQIGRLTGYW
Physico‐chemical
properties
protein length:1141 AA
molecular weight: 126616,20970 Da
isoelectric point:4,67463
aromaticity:0,09290
hydropathy:-0,34023

Domains

View on InterPro
A0A4Y5NUA6
1 1141 aa
ATT 92–217 · ATT 341–491 · STR 626–722 · STR 724–823 · RBD 983–1111 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

A0A4Y5NUA6
1 1141 aa
Domain Start End Length (AA) Confidence
N-terminal 1 506 506 0,9081
Central domain 507 1081 576 0,0462
C-terminal 1082 1141 59 0,8545
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Escherichia phage vB_EcoS_W011D [NCBI] · taxon 2575323
Host No host information

Coding sequence (CDS)

Genbank protein accession
QCW18517.1 [NCBI]
Genbank nucleotide accession
MK778457 [NCBI]
CDS location
range 38274 -> 41699
strand -
CDS
ATGGCTAAAAATGTGATAAGCGGCAGTAAAGGCGGTTCATCAAAACCGTATGTGCCAAAGGAAATGGAAGATAACCTGATTTCGATAAACAAAATCAAGATCTTACTTGCTGTTTCCGATGGTGAGTGCGACGAAACGTTTTCATTGCGTGACCTGTATCTTGATGATGTTCCGGTTATGAATGACGATGGCACTTATAACTATAGCGGCGTTTCGGCTGAGTTCAGGCCAGGCACTCAAGATCAAGATTACATCCAGGGATTTACTGACACCTCAAGCGAAATAACAGTATCGCGAAATCTTGAAACAGACACTCCATATGTGATTGCAGTAACCAACAAAAACCTATCTGCGATCAGAATAAAAATCCTTATGCCTACTGGTATAAAGCAAGAGGACAACGGCGATCTCGTTGGTGTAAGCGTAACATATGCCGTTGATATGGCTGTTGATGGCGGCTCATACAATGAGATTTTGAGCGACACGATAAGCGGTAAAACTCGCAGCGGTTACGACAGAAGCCGCAGAATTGATTTGCCAGCTTTTAACGAGCAAGTATTGTTTCGCGTTCGCCGTGTTACTCCTGATAGCACATCGTCAAAGGTTACAGATCTGATTAAGTTGCAGAGCTACGCGGAAGTTGTAGACGCTAAATTTCGTTATCCGCTGACAGGTCTTGTTTATGTGGAATTTGATTCCGAGCTATTCCCGAACCAGATCCCACGGATAGCGGTAAAAAAGAAATGGAAGATCATAAACGTTCCGAGCAATTACGATCCTGTTTTGCGTGAATACCACGGCGCGTGGGATGGAACCTGGAAAAAAGCATGGTCTAACAATCCGGCTTACATCCTATATGACTTGATAACCAATCAGCGTTACGGACTCGATCAACGTGAGTTGGGAATTCCACTTGATAAGTGGAGCATTTACGAGGCGGGGCAATATTGCGATCAGATGGTTCCAGATGGAAAGGGCGGAACAGAGCCGCGTTACCTTTGCGACGTTGTGATCCAAAGCCAGATTGAAGCGTATCAGCTTGTAAGGGATATTTGTTCAATCTTCCGTGGAATGAGTTTCTGGAACGGTGAGAGCCTTTCAATTGTCGTTGATAGACCGCGAGAGCCGTCTTACATCTTCACAAATGATAACGTTGTTAATGGAGATTTTAGCTACACATTCGCCAGCGAAAAGAGCATGTACACACAGTGCAATGTGACTTTCGACGACGAGCAAAACATGTATCAACAGGACGTTGAGGGGGTTTTTGAAACGGAGGCGGCGTTACGGTTTGGCTACAATCCAACGAGCATTACAGCGATTGGATGCACACGACGCAGCGAAGCAAACCGCCGTGGGCGATGGGTTCTGAAAACCAACTTGCGCAGCACAACGGTAAACTTTGCAACAGGTCTTGAGGGCATGATCCCGTCAATAGGTGATGTGGTGGCGATTGCGGATAACTTCTGGAGCAGCGCATTAACGCTCAACCTTTCGGGGCGAGTTATGGAGGTATCCGGTCTGCAAGTTTTCCTACCGTTTAAAGTAGATGCGCGGCCAGGCGATTTCATCATGGTAAATAAGCCAGATGGGAAGCCAGTAAAACGCACCATTGCCAACGTGAGCGCAGACGGAAAAACCATTGAGCTAAACATAGGTTTTGGCTTTGACGTTCAGCCAGATACGGTGTTTGCGATTGACCGCACAGACATTGCATTGCAGCAATACGTTGTGACGACAATCACCAAGGGAGACAACGAGGACGAGTTTACTTACTCAATCACAGCCGTTGAATACGATCCGAACAAATACGACGAGATTGATTATGGCGTTAACATCGACGACAGGCCAACAAGCATTGTGCAACCTGACGTAATGCAGCCGCCAGAGAATGTTGCCGTTTCCTCTTACTCTCGCATTGTTCAGGGTGTTAGCGTTGAAACGATGGTTGTTAGCTGGGACAAAGTGCCTTACGCGAGCTTATACGAGGTTCAATGGAGGAAAGACAACAGCAACTGGTTAAACGTCCCACAGACGGCAAACAAAGAGATTGAGGTGGAGGGGATTTACGCTGGAGTTTATTACGTTCGCGTGCGATCCGTTTCCGCTTCCGGCTCTACGTCGCCCTGGTCTGGAATAGTTACCGCATCGCTGACTGGTAAAGTTGGTGAGCCTGGGAAGCCTATAAACCTTACTGCATCAACAAATGAGGTTTTCGGTATTCGCGTAAAATGGGGTATGCCAGAGGGAACCGGAGACACGGCCTATATTGAGTTGCATCAATCACCAGATGGAACGGCGGAAAACTCAAGCCTTTTAACGCTTGTCCCATATCCGCAGTTTGAATACTGGCACAGCACGCTACCAGCGGGGAAAGTTGTGTGGTATCGCGTGCGCAGTGTTGACAGGATCGGAAACGTTTCCGGCTGGTCTGATTTTGTGCGCGGCATGGCTTCCGATGATGTATCAGATATTATTGGAGACATTTTAGACGATATCTGGAATACTGAGGGCGGAAAGGAAATCAAGGAAAACGCCATTGACAGCGCAAACAAGATTAAAGATCAGGCGCAAAGCATCATTCAAAACGCATTGGCGAATGATACGGACGTTAGAATAATGAGGAAGGAAAACGGCAAGCGCAAAGCAGAGTTTAGGCAATCAATCCAATTGATCGCAGATGAAACGGAGGCGCGCGTTACCGCAATGACGCAACTCAAGGCTGAATTTGACGAGGAGATAACTAGCGAAGTAACGAGACTTGATCAGGCAATTGCAACAGAATCAGAAACGCGAGCAACAGCCATTGAGGAATTGAAATCACAGATTGGTGATGATATCCAGGGGCAGTTAACGCGAGTTGAGGAAGCTATTGCAAACGAAACAGAGGCGCGTGTTTCGGCTGATACAGCGTTAACGGCGAAGTTTGGCGATGTTGAATCCGCACTGACTGAAAAACTTGATTCATGGGCTGGCGTTGGCGGCGTTGGCGCTCAATACGCAATGAAATTGGGCTTGACATACAACGGGCAGAAGTACAGCGCAGGAATGGTCATGCAGTTATCAAACAGCCCGCAAGGGTTGATTTCACAAATCCTGTTTGATGCCGGAAGATTTGCGATCATGACAAGTTCGACAGGCGGGACGTATACGTTGCCTTTTGTGGTAGAGAATAACCAGGTTTTCATTAACAGCCTGTTAGTGAAAGACGGTTCAATCACAAACGCCATGATCGGTAACTTCATCCAATCAAACAACTATGTTTGGAACCAATCAGGATGGAGGCTGGATAAAAACGGCACGTTTGAAAACTATGGCTCCACTCCTGGCGATGGTTCCATGAAAATGACAAACGAAACGATCAGTGTTAGGGATGCAAACGGCGTTTTACGTGTTCAGATTGGACGTTTAACCGGATACTGGTAA

Genome Context

Tertiary structure

A0A4Y5NUA6
ESMFold structure
Source ESMFold
pLDDT 78.9
Oligomeric state monomer