Genbank accession
AUZ95510.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,60
TF
Evidence RBPdetect2
Probability 0,93
Seq2Symm
C3 confidence 0,968 truncated
C3 0,968
C6 0,010
C1 0,004
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MPPAIIAAVIAVGASVAGTIGVISLTTAVVIGALATVAGSLLTKTSLPSLGNYTSQQERKQVLRSAAGSCTYIYGRVMTSGLLAFAEEQPGEQKTDDHEWVHLVIVLAAHAIDGVEEVYLGEDRIEVYGQNATWSLHSDPQTAPAFLLANCPQWKSDMIGKGLSYIRVSLKFDQELFPSGIPNVKALVRGKRVYDPRDGQTKWTDNAALVIRDFYAGDMLGVEDEDLDDAMFIEAANICDQSVLNADSSISRRYTINGQFDASEAISSILDDMHEACAGEPTYMAGRHGLLVGAYYGPATMVLDESMIVSDVEIVPETAYNQKVNVITGTFVDKGQDYTEADFPSIRIQEWIDEDGNEFVMDKKYRFVVDEWHAQRLGQIVLNRSRLGRTLKLTANYMAYAMRPGYYVKLTIEPLGIINQEFRITSWELSGTEGVVLSLRQETVSVWDDAIGKPLVRPDITVFPPRQVTPPWNLQYQVMEIGEVVQGTLTWNNTSDIAYNNVIVRKDGNIVYTVQVPGTLCRLNGLKRGEYTVAVVAVNMRGQRSAEATIDIVIRAPAKPTGCEIEQGYFAVTLKPRSADLSNVAVTYDFWTSYEQRLPNADTATVEAGANHEGQGTIWTKNHLLNGHTYWWYVRAVNAFGASDFLEVEALCFTDIGELLPMIDAEFQTTDAYKNLMKPIEMNYLAILEAARSVGANVDHQWANYGEVRADVITIKTTIANDKIAMAELENVVVAHGQYINELTGKSEDLSAAVSQKMTSIVTSEGTAKAAYTLNLGINRGGKYYSSGMAMSIEPDGSGSYKSTTLFKADRFGIYSANTPGNYKLVFAVVNGQTFIDDAMIRNASIDTAKIKVASITSALIAQQIQSDNWNGSNVGWMINKNGNANFSNVTVRGSIFANYGDLNNVIIRENCTILGTLSAANIRGNLSDLKVVQLIGSGVESQSNEGHWDTYATLLPDPDIERTLLVQIPMLAHGFYNVGNNHDTSGSASIWMRLYVNGTRVRTLDIDSGSSTVSSMLTYSMNVPRNTQVQLRFEFYRWMYGGSGAWARVEPVTLLSTARVNTKWQ
Physico‐chemical
properties
protein length:1066 AA
molecular weight: 117163,97820 Da
isoelectric point:5,00754
aromaticity:0,08912
hydropathy:-0,11914

Domains

View on InterPro
AUZ95510.1
1 1066 aa
STR 473–557 · ATT 559–663 · RBD 753–900 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

AUZ95510.1
1 1066 aa
Domain Start End Length (AA) Confidence
N-terminal 1 192 192 0,6879
Central domain 193 399 208 0,1133
C-terminal 400 1066 666 0,2352
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Salmonella phage PMBT28 [NCBI] · taxon 2081904
Host
Salmonella enterica subsp. enterica serovar Senftenberg [NCBI] · taxon 28150

Coding sequence (CDS)

Genbank protein accession
AUZ95510.1 [NCBI]
Genbank nucleotide accession
MG641885.1 [NCBI]
CDS location
range 13681 -> 16881
strand +
CDS
ATGCCACCAGCGATAATCGCGGCAGTCATTGCAGTGGGGGCGAGCGTCGCCGGGACCATCGGCGTTATCTCCCTAACCACTGCTGTCGTCATCGGGGCCCTTGCTACGGTGGCGGGGAGCCTCCTCACAAAGACATCCCTACCCAGCCTCGGCAACTACACCAGCCAACAGGAGCGTAAGCAGGTCCTCCGCTCCGCTGCTGGCTCATGCACCTATATCTACGGGCGCGTAATGACCTCCGGGCTGCTGGCATTCGCCGAAGAGCAGCCGGGCGAGCAGAAGACCGACGACCACGAGTGGGTCCATTTAGTCATCGTGCTGGCGGCGCATGCCATCGATGGGGTGGAGGAGGTGTACCTCGGCGAGGACCGAATCGAGGTATACGGCCAGAACGCCACATGGTCCCTGCACTCGGACCCGCAGACCGCCCCGGCGTTCCTGTTGGCTAACTGCCCACAGTGGAAGTCCGACATGATAGGCAAGGGCCTGTCGTATATCCGGGTGTCGCTCAAGTTCGACCAAGAGCTATTCCCATCGGGCATCCCCAACGTCAAGGCTCTGGTCCGTGGCAAACGCGTGTACGACCCACGTGACGGTCAGACCAAATGGACCGACAACGCCGCTCTGGTGATTCGTGACTTCTATGCGGGTGACATGCTCGGGGTGGAAGATGAAGACCTAGACGATGCCATGTTCATCGAGGCGGCCAACATCTGTGACCAGTCGGTGCTGAACGCGGATAGCTCCATCTCCCGCCGCTATACCATCAACGGCCAGTTCGATGCCAGCGAGGCCATATCCTCCATCCTCGACGACATGCACGAGGCGTGTGCTGGTGAACCGACCTACATGGCGGGGCGTCACGGTCTGCTAGTGGGTGCCTACTACGGCCCTGCTACTATGGTGCTAGATGAGTCCATGATTGTGTCGGACGTCGAGATAGTACCCGAGACCGCGTACAACCAGAAGGTGAACGTCATCACTGGGACCTTTGTGGATAAAGGTCAGGACTACACCGAAGCCGACTTCCCATCTATCCGCATACAGGAGTGGATAGACGAAGACGGCAACGAGTTCGTGATGGACAAGAAGTATCGCTTTGTCGTGGATGAATGGCACGCCCAGCGCCTCGGACAAATCGTGCTGAACCGCTCCCGCCTCGGTCGTACGCTCAAGTTGACGGCGAACTACATGGCCTATGCCATGCGCCCCGGCTATTACGTCAAGCTGACCATCGAGCCACTAGGTATCATCAATCAGGAGTTCCGCATCACATCGTGGGAGCTGTCCGGCACGGAGGGTGTGGTGCTGTCCCTGCGTCAAGAGACCGTGTCCGTGTGGGATGACGCCATCGGCAAGCCGCTGGTGCGCCCAGATATCACGGTATTCCCACCACGTCAGGTCACACCGCCGTGGAACCTGCAGTATCAGGTGATGGAAATCGGCGAGGTGGTACAGGGTACGCTGACGTGGAACAACACCTCCGACATCGCGTACAACAACGTCATCGTACGTAAAGATGGCAACATCGTGTACACCGTGCAGGTGCCCGGTACTCTGTGCCGTCTGAATGGGCTCAAACGTGGCGAATACACCGTGGCCGTGGTAGCCGTCAACATGCGCGGCCAACGGTCAGCCGAGGCCACCATCGACATCGTCATCCGCGCCCCGGCCAAGCCAACCGGGTGTGAGATTGAGCAGGGCTATTTCGCCGTCACGCTCAAGCCACGCTCCGCTGACCTGTCTAACGTGGCCGTGACCTACGATTTCTGGACCTCATACGAGCAACGCCTACCGAATGCTGATACCGCCACTGTGGAGGCTGGGGCGAACCACGAGGGTCAGGGCACTATCTGGACCAAGAACCACTTGCTGAACGGCCACACCTACTGGTGGTATGTCCGGGCGGTGAACGCGTTCGGGGCGTCCGACTTCCTCGAAGTAGAGGCCCTGTGTTTCACGGATATCGGCGAGCTGCTCCCGATGATAGATGCCGAATTCCAGACGACCGACGCATATAAGAACCTCATGAAGCCGATAGAGATGAACTATCTGGCCATCCTAGAGGCTGCCCGTTCTGTTGGTGCCAACGTTGACCACCAGTGGGCCAACTACGGCGAGGTCCGTGCGGATGTCATCACCATCAAGACCACCATAGCAAACGACAAGATTGCCATGGCCGAGCTTGAGAATGTGGTGGTCGCCCACGGTCAGTACATCAACGAACTGACCGGGAAGTCCGAAGACCTGAGCGCGGCGGTGTCGCAGAAGATGACCTCCATCGTGACCAGCGAGGGCACGGCTAAAGCTGCGTACACCCTGAACCTCGGGATTAACCGTGGCGGCAAATACTACTCGTCCGGTATGGCCATGTCTATCGAACCGGACGGCTCGGGCTCGTACAAGTCAACCACGCTCTTTAAGGCTGACCGCTTCGGCATCTATAGCGCCAACACGCCGGGCAACTATAAGCTGGTCTTCGCCGTGGTCAACGGGCAGACGTTTATCGACGACGCCATGATTCGCAACGCGTCTATCGATACGGCCAAAATCAAAGTGGCCTCCATCACCTCGGCCCTCATCGCCCAGCAAATCCAGTCAGACAACTGGAACGGGTCCAACGTAGGCTGGATGATTAACAAGAACGGGAACGCCAACTTCTCCAACGTGACGGTGCGTGGGTCCATCTTCGCCAACTACGGCGACCTCAACAACGTCATCATTCGTGAGAACTGCACCATCCTCGGGACCCTGTCAGCGGCCAACATCCGTGGCAACCTGTCGGACCTCAAGGTCGTACAGTTAATTGGCTCGGGTGTGGAAAGCCAGAGCAACGAGGGCCACTGGGACACCTATGCGACCCTGCTCCCGGACCCGGACATCGAGCGTACGCTCCTTGTCCAGATTCCGATGCTGGCGCATGGCTTCTATAACGTAGGTAACAACCACGACACCAGCGGCAGCGCTTCTATCTGGATGCGCCTCTACGTGAACGGCACGCGGGTCCGCACACTGGACATTGACTCGGGGAGCAGCACAGTGTCGTCCATGCTGACCTACTCTATGAACGTGCCGCGCAACACACAGGTGCAGCTACGCTTCGAGTTCTATCGTTGGATGTATGGGGGTAGCGGTGCATGGGCTCGTGTGGAGCCAGTCACCCTACTGAGTACGGCTCGCGTCAACACTAAATGGCAATGA

Genome Context

Tertiary structure

AUZ95510.1
ESMFold structure
Source ESMFold
pLDDT 74.0
Oligomeric state monomer