Genbank accession
XSD88251.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,69
TF
Evidence RBPdetect2
Probability 0,82
Seq2Symm
C3 confidence 0,997 truncated
C3 0,997
C1 0,016
C6 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAIYRTGQASMDAQGYITGYGSKWREQLTLIRSGATIIFLSNPLQFGVITEVISDTSMRAVTTNKAVVPKVDYVIFLHDSITVDGLAQDVAETLRYYQGKETEFAHFIEFLKEFDFKKLEDLTNQTKQSAAAAKVSETNAKASEGKAKTSETNAKNSENAALSSKNAAKASQDAAKASETAALASKNAAAASQTAAKTSETNAKASENAAAASKNAAKTSETNAKASEEAAEASKNAAKNSENAAKASQTAAKTSETNAKNSENAAKASQAAAKTSETNAKNSENKAKEYADIAQGISSPMIQYNWPVGTGANERFVKIAKLTDPGSSESHVTLMITNGGNYGARQGSIDFLDASARSLGTTVINASNVRQFMQIRRLGDPSLAEDNQLRYGVVKGDGFFEIWAYQRAFINNVKVAILAKAGRVDLYIPSGYVSQEGAPDGWVKSEAIRVYDEVNKPSRSDLGLANVMEIGAFGLGGNGISYSDITSNADLMQRMKEKGGHFWRASQKSGSTSNIISHGSGVFSRCGDTNSAINIDYNSGKVVILAANDSSLAAGNVKVNTLYGTANKPSKSDVGLSNVTNDAQVKKAGDTMTGDLDISKGTPSIRLKSASGNAHLWFMNADGNERGVIWTPENSDSLGEVHIRAKTKGGTTGGDFIVRHDGRIEARDAKINYKIAARTADFANDDTNTGSTNLRVSGKQHTPVVLVRDADSNLSIGFKLNNMNQKLLGIDVDGDIAFGENADQRQNSKIVTRKMMDAGFSVAGLMNFTNGFAGTWEAENINDRTLDLNSLMIKKSNPGSIYVYQCISQDGGNNITNKPSGVTGNFILYVESIRKVSDTDFTNRQILFGTESNREFTRYCSNGTWSAWRESVVSGMNQDVSVKSMSASGRLSGGELAVGGAGALNGNLGVGGGTASKVPSSDKGIVIGRGAMVREGGEGRLILSASGGTDRQVQLRPAGATASDNGIEISCTSASGGDTKFAFGQGAAIRCNASGSPIISAKAGQLMYLRPNGDTSSDGQVTIAGNGKMVVNGEIESTGDMTCARVFSKGAIQTESGGIELYHASPFIDFHFNKSASDYTARIINDAADQLTFDCRSVRTLRDFTARGSIRGCYNDAFVAWPIEDPTGGNGTMLKAPSFISRFNTIGNAARCAMWLEEYRGYEHRAVIEVSKWGDSGTTQYWQFKANGKISSTTHGDVVFAGLSDINYKDNVVDYDGLQSLENIKAMNLVKFTYKDDEQKRERRGVIAQQVREIDPCYVKESDASYQDADGNVVENKRLVLDTNPLLMDALCAIKALSAQVEELKEEIKKLKGE
Physico‐chemical
properties
protein length:1314 AA
molecular weight: 140365,51800 Da
isoelectric point:6,73453
aromaticity:0,06925
hydropathy:-0,42100

Domains

View on InterPro
XSD88251.1
1 1314 aa
STR 785–870 · CHP 1204–1308 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

XSD88251.1
1 1314 aa
Domain Start End Length (AA) Confidence
N-terminal 1 298 298 0,8261
Central domain 299 497 200 0,6089
C-terminal 498 1314 816 0,6867
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Klebsiella phage vB_Kpn_K50_evo36 [NCBI] · taxon 3412926

Coding sequence (CDS)

Genbank protein accession
XSD88251.1 [NCBI]
Genbank nucleotide accession
PQ569677.1 [NCBI]
CDS location
range 24463 -> 28407
strand -
CDS
ATGGCTATTTATCGCACAGGACAGGCGTCAATGGACGCTCAAGGCTATATTACTGGCTACGGTTCGAAATGGCGTGAGCAACTAACGCTGATTCGCTCCGGCGCTACCATCATTTTTCTTTCTAACCCTTTGCAATTTGGCGTTATCACAGAGGTAATCAGTGATACCTCTATGCGAGCCGTAACCACTAACAAGGCGGTGGTTCCAAAGGTTGATTATGTGATCTTCCTGCACGACTCAATCACCGTTGACGGACTGGCCCAAGATGTTGCTGAAACACTGCGCTACTATCAAGGCAAAGAAACCGAGTTCGCGCACTTCATCGAGTTCTTGAAAGAGTTCGATTTCAAAAAACTTGAAGATCTGACCAATCAGACCAAGCAAAGCGCGGCGGCGGCTAAGGTTTCAGAAACCAACGCCAAGGCATCAGAGGGGAAAGCGAAAACCTCCGAAACCAACGCGAAGAATTCAGAAAATGCGGCGCTGTCAAGCAAGAATGCGGCGAAAGCAAGCCAGGATGCAGCGAAAGCAAGCGAGACGGCAGCGCTGGCAAGTAAGAACGCAGCGGCGGCAAGCCAGACGGCGGCTAAGACCTCCGAAACAAACGCTAAGGCGTCAGAAAACGCGGCGGCAGCGAGCAAGAACGCAGCCAAAACCAGCGAGACTAACGCCAAGGCAAGCGAAGAGGCGGCGGAAGCAAGCAAGAATGCGGCAAAGAATAGCGAGAACGCAGCCAAGGCAAGCCAGACAGCGGCTAAAACATCTGAGACTAACGCCAAGAATAGCGAGAACGCAGCCAAGGCCAGCCAGGCAGCAGCAAAGACAAGCGAGACAAACGCTAAAAACAGCGAGAACAAAGCAAAGGAGTATGCTGATATCGCTCAAGGCATCTCAAGTCCGATGATCCAATATAATTGGCCTGTTGGCACAGGGGCAAACGAAAGGTTTGTAAAAATCGCAAAGCTCACTGATCCGGGTTCGTCTGAATCCCACGTTACACTAATGATCACAAACGGCGGAAACTATGGAGCGCGTCAAGGCTCAATAGACTTTCTTGATGCGTCAGCGCGTAGCCTTGGAACAACCGTCATTAACGCTTCAAACGTTCGCCAGTTTATGCAGATTCGCCGCCTTGGTGATCCGAGCCTTGCGGAAGATAACCAATTGCGGTACGGGGTTGTTAAGGGTGATGGTTTCTTTGAGATTTGGGCTTACCAGCGAGCTTTCATTAACAATGTGAAGGTGGCGATTCTGGCGAAAGCAGGTCGAGTTGACCTCTATATTCCTAGCGGATATGTTAGCCAAGAGGGCGCGCCGGATGGTTGGGTGAAAAGCGAGGCTATTCGCGTATATGATGAGGTTAACAAGCCTTCTCGTAGTGATCTTGGCCTTGCTAACGTTATGGAAATTGGTGCTTTTGGTCTTGGCGGTAACGGGATTTCATACAGTGACATTACCAGCAACGCAGACTTAATGCAGCGCATGAAAGAGAAAGGCGGTCATTTTTGGCGCGCAAGTCAGAAGTCTGGCTCCACCTCAAATATTATATCTCACGGTTCCGGTGTGTTCTCTCGCTGCGGTGACACTAATTCAGCGATTAACATTGACTATAACAGTGGGAAGGTTGTGATACTAGCCGCCAATGACTCAAGTCTTGCCGCTGGGAATGTAAAGGTAAACACCCTTTATGGCACAGCAAACAAGCCGTCAAAGTCAGACGTTGGACTGAGCAATGTAACCAACGACGCGCAAGTTAAAAAAGCTGGCGACACAATGACTGGAGATCTTGATATCTCAAAAGGAACGCCGTCTATCAGGCTAAAATCTGCAAGCGGAAACGCTCACCTGTGGTTCATGAACGCGGACGGGAACGAGAGGGGTGTTATTTGGACTCCTGAGAACTCCGACTCACTCGGCGAGGTTCATATCCGGGCGAAAACGAAAGGCGGAACAACTGGTGGTGATTTTATCGTGCGCCATGATGGGCGAATTGAAGCGCGAGACGCAAAGATCAACTATAAGATCGCCGCTCGTACTGCCGACTTCGCCAATGACGACACGAACACAGGGTCAACAAACCTGCGGGTTAGCGGTAAGCAACACACTCCTGTAGTTCTTGTTCGCGATGCTGATTCCAATTTGTCTATTGGATTTAAGCTAAACAACATGAACCAGAAACTGCTAGGTATTGATGTTGATGGTGATATTGCCTTTGGTGAGAATGCAGACCAGAGGCAAAACAGCAAGATTGTAACGCGCAAGATGATGGATGCTGGTTTCTCTGTCGCCGGGCTAATGAATTTCACTAACGGATTTGCTGGCACTTGGGAAGCGGAAAACATTAACGACCGGACGCTTGATCTCAATTCATTGATGATCAAGAAAAGCAATCCTGGGTCGATTTATGTTTATCAGTGCATCAGTCAAGATGGCGGCAACAACATTACCAACAAGCCGAGCGGCGTAACTGGTAACTTCATCCTTTACGTCGAGTCGATCCGCAAAGTGAGTGACACTGATTTCACTAACCGCCAGATCCTTTTTGGCACTGAGTCAAATCGTGAATTCACTCGTTATTGCAGCAACGGCACCTGGTCGGCTTGGCGTGAGTCGGTTGTTAGCGGCATGAACCAAGATGTGAGCGTTAAGTCAATGAGCGCATCCGGTCGTCTTTCTGGTGGTGAGCTTGCGGTTGGCGGCGCTGGCGCTCTGAACGGAAACCTTGGCGTTGGTGGCGGCACCGCATCAAAAGTGCCATCGTCTGACAAGGGGATCGTAATTGGTCGCGGTGCAATGGTTCGCGAAGGTGGCGAGGGTCGCTTGATTCTGTCTGCCTCCGGTGGCACTGATAGGCAGGTTCAACTACGACCTGCTGGCGCTACGGCATCGGACAATGGGATCGAGATCTCTTGCACGTCTGCAAGTGGTGGAGATACCAAATTTGCATTTGGTCAAGGCGCTGCAATTCGTTGCAACGCTTCCGGCTCGCCAATCATTAGCGCGAAAGCTGGTCAGTTAATGTATCTGCGACCAAACGGCGACACATCGTCGGACGGCCAGGTGACGATTGCCGGAAACGGGAAAATGGTAGTTAATGGTGAGATTGAATCTACTGGCGATATGACTTGCGCAAGGGTGTTTAGTAAGGGAGCAATACAGACAGAAAGCGGAGGTATTGAGCTTTACCACGCCTCGCCGTTTATTGACTTTCATTTCAATAAGTCAGCAAGCGATTACACGGCAAGGATTATCAACGACGCTGCGGATCAGCTAACTTTTGATTGTCGAAGTGTGCGCACGTTGCGGGATTTCACGGCGCGAGGATCTATTAGAGGTTGTTACAATGACGCCTTCGTTGCCTGGCCAATTGAAGATCCTACTGGTGGAAATGGCACGATGCTTAAAGCACCATCTTTTATCTCAAGGTTTAACACAATTGGTAACGCTGCGCGTTGCGCTATGTGGCTTGAGGAATATAGGGGATATGAACATCGCGCCGTTATTGAGGTCAGCAAGTGGGGTGATTCTGGAACTACGCAGTATTGGCAGTTTAAGGCAAACGGCAAGATCTCAAGCACTACGCACGGCGACGTTGTTTTTGCTGGTCTTTCTGACATTAACTACAAAGACAATGTTGTTGACTATGACGGATTGCAGTCACTCGAAAACATCAAGGCGATGAATCTTGTCAAGTTCACATATAAGGATGATGAACAAAAACGAGAACGCCGTGGTGTTATTGCGCAGCAGGTGAGAGAAATTGATCCGTGCTATGTCAAGGAGAGCGACGCATCCTATCAGGACGCCGACGGGAACGTAGTCGAGAACAAGCGACTTGTCCTTGACACTAACCCGCTGTTAATGGATGCACTTTGCGCAATCAAGGCGCTGTCGGCCCAGGTTGAGGAATTGAAAGAGGAGATCAAAAAACTGAAAGGAGAGTAA

Genome Context

Tertiary structure

XSD88251.1
ESMFold structure
Source ESMFold
pLDDT 53.9
Oligomeric state monomer