Genbank accession
WWD14453.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,89
TSP
Evidence RBPdetect2
Probability 0,93
Seq2Symm
C3 confidence 0,996 truncated
C3 0,996
D3 0,001
C4 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MLLSALLNQPKRIKNMALYREGKAAMTADGTVTGTSTKWQSSLSLIRPGATIMFLSSPIQMAVVNKVVSDTEIKAITTNGAVVASTDYAILLSDSLTVDGLAQDVAETLRYYQSQETVIADAVEFFKNFDFESLQNLANQIKADSEAAESSAAEAEASKDAAKISETNSKASEVAAATARDQVQQIINDAGEQSTLVVIDKNMGQWLPSAVSIFNETTDYQSFRVRGFYAANDGGSGVWVKTGAVNPSLSGTHIITQAKIYNANGVEYQLKVNVGSDVDARSNGAVCVTGSDNSSLISDVSAESTVCLGQAVNGILYTISPTDSYSLTNDDMLAPVVAQQIYIKITGGSYRISKIGGKVRGFAQYDCAGSRLYVYAANEYKRSVTNKWLNAFEHSYEDIDEVYAAIGQKEFWGAVSVGHTKISNAQILGDHRVSRRESECSAGAAFFLINPEYVTLENIHARGFQLPLVARPANSGVINSGLITTDLPTSSSAGVNFGNFYGLYCKNVFLDWGREGLAHVMCDWCTWEGGSLCDGAAWIEGPDAKRPDYFLVVTGAGFKMSGVNLTVSHTQISNETKRPGKGVVYTNCRAHTFTNNYMEHTPNLFVISKQMADPSYSKALGLIIDGIAHQYKPISSWTYITFEEGCFGHYDDSGNWIYPDLYTENQYAYNGINFTRIGSPVHDVGAFLHGGYNFKYGTYGLYAGSAGSVDFDHLRDYKETKEFISPYGLQVNSGKLYVPMHSPAYRSNICIWYKDLTGTFDPVNFVAWQSIADLETPSVDGNLVMSRGEGCIDFGNGYKMAILSNNKWNANDGVGTYTPQQNLVITVPSGKPIVLKAIQAFTGGVPVFPTGLDYNPESGMGGVFGNYTNGYIKSPGGGLFKPGDIVYPWISVDKHSNDYKYNAILGVAGNPIPQIVVGGMTLGSQYQQTFNVMINSVDATNGRTTITVPTESLPYIAMGIPAYVESGSSTSYSGSTRVYSRVMNSDGTASNQYILDAVVGAAGDTLVINQSKISGYVVKGDVAFNNVTVSTVTASGLIKAGRITVGENTVGSIVAVPASATSLGTPGQWAVDASYLYVCVASNTWRRVAVASW
Physico‐chemical
properties
protein length:1093 AA
molecular weight: 117611,38120 Da
isoelectric point:5,31532
aromaticity:0,10339
hydropathy:-0,10238

Domains

View on InterPro
WWD14453.1
1 1093 aa

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WWD14453.1
1 1093 aa
Domain Start End Length (AA) Confidence
N-terminal 1 325 325 0,9753
Central domain 326 849 525 0,9813
C-terminal 850 1093 243 0,4233
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Klebsiella phage HelplessSquare [NCBI] · taxon 3098256

Coding sequence (CDS)

Genbank protein accession
WWD14453.1 [NCBI]
Genbank nucleotide accession
OR896847.1 [NCBI]
CDS location
range 19781 -> 23062
strand -
CDS
ATGCTATTATCTGCGTTACTCAACCAACCAAAGAGGATTAAAAACATGGCACTATACAGAGAAGGCAAAGCGGCTATGACCGCAGACGGAACAGTTACCGGGACTAGCACAAAATGGCAATCATCGCTTTCGCTGATTCGCCCTGGTGCGACGATTATGTTTTTGTCGTCACCGATTCAAATGGCCGTCGTAAACAAGGTGGTCAGTGACACAGAAATTAAAGCAATTACCACAAACGGCGCTGTCGTAGCGTCTACTGACTACGCGATCCTGTTAAGCGACTCGCTGACCGTTGACGGACTGGCGCAAGATGTTGCTGAAACTCTGCGCTACTACCAGTCACAAGAAACTGTGATTGCGGATGCAGTCGAATTCTTTAAGAATTTTGATTTCGAATCTCTGCAAAATCTTGCCAACCAAATTAAGGCAGACTCTGAAGCTGCGGAATCAAGCGCTGCGGAGGCAGAGGCATCTAAAGATGCGGCGAAAATTTCAGAGACAAATTCTAAGGCTTCAGAGGTTGCCGCGGCGACTGCAAGAGACCAAGTGCAGCAGATCATCAACGACGCTGGCGAACAATCAACACTAGTGGTAATTGATAAAAATATGGGGCAGTGGTTGCCTTCAGCCGTTTCAATATTCAACGAAACTACAGATTATCAATCCTTCAGGGTTCGCGGGTTTTATGCCGCAAATGATGGTGGTAGTGGTGTTTGGGTAAAAACAGGGGCTGTGAATCCGTCACTATCTGGCACTCATATCATCACACAGGCGAAGATATACAACGCCAACGGCGTAGAATATCAGCTAAAAGTGAATGTCGGAAGTGACGTTGACGCCAGAAGTAATGGCGCGGTATGTGTCACCGGCAGTGATAACTCTAGCCTCATATCAGATGTGAGTGCGGAAAGTACCGTATGCCTTGGTCAGGCTGTTAACGGCATACTTTATACAATCAGCCCGACAGACTCCTACTCGCTGACTAATGATGACATGTTGGCTCCAGTAGTTGCACAGCAAATCTATATTAAAATAACTGGTGGTAGTTATCGCATTTCTAAGATTGGCGGTAAGGTACGAGGTTTTGCGCAATATGATTGTGCTGGTTCAAGGCTATACGTGTACGCAGCCAATGAATATAAGCGCTCAGTAACAAACAAGTGGTTAAATGCTTTTGAGCATTCGTATGAAGACATTGACGAAGTGTATGCGGCAATCGGTCAAAAAGAGTTTTGGGGCGCGGTATCAGTTGGGCATACAAAAATCTCCAACGCCCAAATACTTGGTGATCACAGGGTTTCTCGTCGAGAATCTGAATGCTCTGCTGGTGCTGCGTTCTTCCTGATTAACCCTGAATACGTTACCCTTGAGAACATCCATGCGCGAGGCTTCCAACTTCCATTAGTTGCACGCCCGGCAAATAGCGGAGTTATTAACTCTGGTCTGATTACAACCGACCTGCCAACATCCAGTAGTGCTGGGGTCAATTTTGGTAACTTTTATGGGTTGTATTGCAAAAACGTATTCCTTGATTGGGGTAGAGAAGGTCTTGCCCATGTAATGTGCGACTGGTGTACATGGGAGGGTGGTAGCCTGTGTGATGGTGCTGCCTGGATTGAGGGGCCAGATGCTAAGAGACCAGACTACTTCCTGGTAGTCACTGGCGCTGGTTTCAAAATGTCCGGGGTGAACTTGACAGTTAGCCACACTCAGATTTCCAATGAAACAAAGCGCCCTGGTAAGGGAGTTGTTTATACAAACTGCCGCGCTCACACGTTTACCAATAACTACATGGAACACACGCCTAATTTGTTCGTTATCAGTAAGCAGATGGCAGACCCAAGCTACTCTAAGGCACTTGGTCTGATTATTGATGGGATTGCTCACCAGTATAAGCCAATCTCTTCTTGGACATACATTACCTTTGAAGAGGGATGCTTCGGACACTATGACGATAGTGGGAACTGGATTTATCCAGATCTGTATACAGAAAACCAGTACGCATACAATGGTATTAACTTTACCCGTATTGGTTCACCTGTTCATGATGTAGGTGCATTCCTGCACGGTGGTTACAACTTTAAATATGGAACTTATGGCTTATATGCTGGTTCTGCTGGGAGTGTGGATTTTGACCACCTAAGGGATTACAAAGAGACAAAAGAGTTTATCAGTCCGTATGGGTTACAGGTAAACTCTGGAAAGTTGTATGTTCCAATGCACTCACCTGCTTACAGGTCTAATATCTGTATCTGGTACAAGGATTTAACTGGAACGTTTGACCCGGTAAACTTTGTCGCATGGCAGTCGATTGCTGACCTGGAAACGCCGTCAGTTGATGGGAACCTGGTGATGTCGCGCGGAGAAGGTTGTATTGACTTCGGTAACGGCTACAAGATGGCAATCCTGTCTAATAACAAATGGAATGCAAATGATGGTGTTGGTACATACACACCTCAGCAGAATCTTGTAATCACTGTTCCATCAGGAAAACCTATCGTACTGAAAGCAATTCAGGCGTTTACTGGCGGCGTACCTGTGTTCCCTACTGGCTTGGATTACAATCCTGAATCCGGTATGGGTGGCGTATTTGGAAACTATACCAATGGTTATATAAAATCCCCTGGTGGTGGATTATTTAAACCAGGTGATATTGTTTATCCGTGGATATCTGTCGATAAACATTCCAACGACTACAAGTACAATGCGATCCTTGGTGTAGCAGGAAACCCAATACCTCAGATTGTAGTCGGAGGCATGACGCTGGGAAGCCAGTATCAGCAGACATTTAATGTAATGATAAATTCAGTTGATGCCACGAATGGTCGGACTACTATTACAGTACCAACAGAAAGCCTTCCGTATATTGCAATGGGAATACCTGCTTACGTTGAGTCTGGATCTTCTACGTCATACAGCGGGTCTACTAGAGTATACAGTAGGGTTATGAACAGTGACGGAACCGCATCTAATCAGTATATTCTTGATGCAGTCGTAGGAGCCGCTGGTGACACATTGGTTATTAACCAATCGAAAATTTCCGGATATGTTGTCAAGGGTGACGTTGCATTTAACAACGTTACCGTCAGCACAGTAACAGCGTCTGGACTGATAAAAGCTGGTAGGATAACGGTTGGCGAAAATACCGTTGGGTCGATTGTAGCAGTGCCAGCTTCTGCAACGTCACTTGGAACACCTGGTCAGTGGGCGGTAGATGCATCATATTTATATGTTTGCGTTGCGTCTAACACATGGCGTAGGGTTGCAGTTGCATCATGGTAA

Genome Context

Tertiary structure

WWD14453.1
ESMFold structure
Source ESMFold
pLDDT 53.6
Oligomeric state monomer