UniProt accession
A0AAF0GD68 [UniProt]
Protein name
Tail fiber
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
Seq2Symm
C1 confidence 0,986 truncated
C1 0,986
C3 0,166
C2 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MTDKLIRELLIDVKQKGATRTAKSIENVSDALENAAAASELTNEQLGKMPKTLYSIERAADRAAKSLTKMQASRGMLSVTKSINDIGAKLDDLAIQLIEVTDKLEIGFDGVSRSVKAMGNDVAAATEKVQDRLYDTNRALGGTARGFNDTAGAAGRASRAIGNTSGSARGATRDFAAMAKIGGSLPIMYAALASNIFVLQSAFEQLKLGDQLNRLEKFGVIVGTQTGTPVQTLARSLQEAAGYAISFEEAMRQASSASAYGFDAEQLNKFGLVARRAAAVLGVDMTDALNRVIKGVSKQEIELLDELGVTIRLNDAYADYVKQLNAANTGITYNVNSLTTFQKQQAYANAVIAESTKRFGYLDEVLRATPWEQFAANADAALRKIQQAAAKYLGPVIDAINTVFYTSQASISAEAARAQEKTNRQIDPTNVGAVALSLAASEEGYNKALDMYKESLDKRNKLKSEFDKRMEQADFYTKLAIRQVGEGIPVGLAAAGASEANKQFVAETAAMGLQVTRLGKEVEDSTENLNAWKSAYQAAGAAAAKANPEFQKQINLQRDTTDPDAVYDFNSTVLKGLTEQQKAYNQTKKTASDLANDIQNVAQNTDTAAKTSATLADAIKNIESLSLGTGKSADEYVKNLNLGYNTLSEMKTASQALSEYVKLTGNETKNQLAVQQKIADVYNQTKDKEKAQEAGRRLELQQLEEQEAALRRVLQTNQGNKAVEKEIEKIQLEKLKLTNQGMEAQKKVKDYTDKILGVDREIALLNDRTMTTTQYRLAQLKLELTIEKEKYEWYTKQADKQKEAEQSRRAQAQISRELWEAEKQATATHVSALMDALEVSQTQRNVTGQSQILTERLSILQQQLELSKGNTEEEIKYRNEIYKTSAALEQLRKQRDSQMQQQVGSSVGAVYTPTTGLSGEDKDFADMQNRMASYDQAISKLSELNSEATAVAQSMGNLTNAMIQFSQGSLDTTSMIASGMQTVASMIQYSTSQQVSAIDQAIAAEQKRDGKSEASKAKLKKLEAEKLKIQQDAAKKQIIIQTAVAVMQAATAVPYPFSIPLMVAAGLAGALALAQASSASGMSSIADSGADTTSYLTLGERQKNIDVSMSANAGELSYIRGDQGIGSANSFVPRAEGGNMYPGVSYQMGEHGTEVVTPMVPMKATPNDELKTSSNSTSGRPIILNISAMDAASFREFASSNSSALRDAVELALNENGASLKTLGNS
Physico‐chemical
properties
protein length:1226 AA
molecular weight: 132505,37450 Da
isoelectric point:5,64811
aromaticity:0,05220
hydropathy:-0,41794

Domains

View on InterPro
A0AAF0GD68
1 1226 aa
TAS 1–81 · TAS 1189–1224 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WGG14761.1 [NCBI]
Genbank nucleotide accession
OQ680481 [NCBI]
CDS location
range 96037 -> 99717
strand +
CDS
ATGACTGATAAGCTAATACGAGAACTACTAATAGACGTTAAACAGAAGGGGGCAACTCGTACTGCAAAGTCTATTGAAAACGTATCTGATGCGTTAGAAAACGCTGCTGCTGCTTCCGAACTGACAAATGAGCAGTTAGGTAAAATGCCCAAAACTCTTTATTCCATTGAGAGGGCAGCGGATAGAGCAGCGAAAAGTCTTACTAAAATGCAAGCAAGCCGAGGTATGCTTAGTGTTACTAAATCTATAAATGATATAGGAGCTAAGTTAGATGATCTTGCTATCCAACTTATTGAAGTAACAGATAAGCTAGAAATTGGATTCGATGGAGTTTCTAGATCTGTTAAAGCAATGGGTAATGATGTTGCAGCTGCAACAGAAAAAGTCCAAGATAGATTATATGATACTAATAGAGCATTAGGTGGCACAGCTAGGGGTTTTAATGACACTGCTGGTGCCGCTGGTAGAGCTTCTAGAGCTATTGGTAATACTTCTGGTTCAGCACGCGGTGCAACTCGTGATTTTGCAGCAATGGCTAAGATAGGTGGTAGTTTACCTATTATGTACGCAGCTCTTGCTTCCAACATCTTCGTTTTGCAATCTGCATTCGAACAACTTAAACTAGGTGACCAGCTAAATCGTCTAGAAAAATTTGGTGTTATAGTAGGTACTCAGACAGGTACTCCTGTTCAGACCCTTGCTAGATCACTACAAGAAGCTGCTGGATATGCTATTTCTTTTGAGGAAGCAATGAGACAGGCATCTTCAGCATCTGCTTATGGGTTTGATGCTGAACAACTTAATAAATTTGGTTTAGTAGCTCGTCGTGCTGCTGCTGTTCTTGGTGTTGATATGACTGATGCACTTAACCGTGTAATTAAGGGCGTATCTAAACAAGAAATCGAACTTCTGGATGAACTTGGTGTCACCATCCGTCTTAATGACGCATATGCTGATTATGTTAAACAGTTAAATGCTGCAAACACAGGTATAACATATAATGTTAATAGTCTTACCACTTTCCAGAAACAACAAGCATACGCTAACGCGGTAATTGCTGAATCTACTAAGCGGTTTGGCTACCTAGATGAAGTACTACGTGCAACTCCATGGGAGCAATTTGCTGCTAATGCAGATGCTGCACTAAGAAAAATACAACAAGCTGCTGCTAAGTATTTAGGGCCAGTAATTGATGCTATCAACACAGTATTTTATACATCTCAGGCTTCTATATCTGCTGAGGCAGCTAGAGCTCAAGAAAAAACTAATAGACAGATAGACCCTACCAACGTTGGTGCTGTTGCTTTAAGTTTAGCTGCTTCTGAAGAAGGCTATAATAAAGCTCTAGATATGTATAAGGAATCTCTTGATAAGCGTAATAAGCTAAAATCTGAGTTCGATAAACGAATGGAACAAGCAGATTTCTATACAAAACTAGCTATACGTCAAGTTGGTGAAGGTATTCCTGTTGGTCTTGCAGCAGCAGGTGCTTCGGAGGCCAATAAGCAATTTGTAGCAGAAACTGCAGCTATGGGTCTACAAGTAACTAGACTTGGTAAGGAAGTAGAGGATTCTACAGAGAACCTCAATGCTTGGAAATCAGCGTATCAAGCTGCTGGAGCTGCTGCTGCAAAAGCTAACCCCGAGTTTCAGAAGCAAATTAATCTACAGAGAGATACTACTGATCCTGATGCTGTATACGATTTTAACTCTACTGTATTAAAAGGACTAACTGAGCAGCAGAAAGCGTACAATCAGACTAAGAAAACTGCTAGTGACTTAGCTAATGATATACAGAACGTTGCTCAGAATACAGATACTGCTGCTAAAACTAGTGCTACTTTAGCAGATGCTATAAAAAACATAGAATCTCTATCTCTAGGTACTGGTAAGAGTGCTGATGAATATGTTAAAAATCTTAACCTAGGCTACAACACTCTGTCTGAAATGAAAACTGCGTCTCAGGCCTTATCTGAGTACGTTAAACTAACTGGTAATGAGACTAAGAACCAGTTAGCAGTTCAACAGAAGATAGCTGATGTATATAACCAAACTAAGGATAAAGAAAAAGCACAGGAAGCCGGTAGGCGTTTAGAACTCCAACAGTTAGAAGAGCAAGAAGCTGCTTTACGCCGTGTTCTTCAAACAAACCAGGGAAATAAAGCTGTTGAGAAAGAAATTGAGAAAATTCAGCTGGAGAAACTTAAACTTACCAATCAGGGTATGGAGGCCCAGAAGAAGGTTAAGGATTACACAGATAAAATTCTTGGTGTAGATCGTGAGATAGCTCTTCTGAATGACCGCACTATGACTACTACTCAATATAGATTAGCTCAGCTAAAACTAGAACTAACTATAGAGAAAGAGAAGTACGAATGGTATACAAAACAAGCGGACAAACAAAAAGAGGCAGAACAGTCTAGACGTGCTCAAGCACAGATAAGTAGAGAGTTATGGGAAGCAGAGAAACAAGCTACTGCTACTCATGTATCTGCCCTTATGGATGCCTTAGAAGTTAGCCAAACGCAGAGAAATGTCACTGGTCAGTCCCAGATTCTCACTGAAAGGTTATCTATTCTGCAGCAGCAGCTGGAGCTGTCTAAAGGTAATACTGAAGAAGAAATTAAATATCGTAATGAGATTTATAAAACTTCAGCAGCCTTAGAACAGCTTAGAAAACAGAGAGATAGCCAGATGCAGCAACAGGTAGGGTCTTCTGTAGGTGCTGTGTACACCCCTACAACTGGATTATCTGGGGAAGATAAAGATTTTGCTGATATGCAAAATAGAATGGCTTCTTATGATCAGGCAATCTCTAAACTATCTGAGCTAAACTCTGAAGCAACCGCTGTAGCTCAAAGCATGGGTAACCTAACCAATGCTATGATTCAATTCTCTCAGGGATCTTTAGATACTACATCTATGATTGCTTCCGGTATGCAGACCGTAGCCTCTATGATTCAATATAGTACTAGTCAACAGGTTAGTGCAATTGATCAGGCTATTGCAGCAGAACAGAAACGTGACGGTAAATCAGAAGCATCTAAAGCTAAGTTGAAGAAGTTGGAAGCTGAAAAGCTGAAGATTCAACAAGACGCAGCTAAGAAGCAGATTATCATCCAAACTGCAGTAGCTGTAATGCAGGCAGCCACTGCTGTTCCATATCCGTTCTCTATTCCACTAATGGTTGCGGCAGGTTTAGCGGGTGCATTGGCATTAGCACAAGCATCTTCTGCATCTGGTATGTCAAGTATTGCAGATTCTGGAGCGGATACAACTAGTTACCTAACCTTAGGAGAACGTCAGAAGAATATAGATGTGTCCATGTCTGCTAATGCAGGTGAACTGTCTTATATTCGTGGCGATCAAGGTATAGGTAGCGCTAACTCTTTCGTTCCTCGTGCTGAGGGTGGTAATATGTACCCTGGGGTTAGCTATCAAATGGGTGAGCATGGTACAGAAGTAGTTACCCCTATGGTTCCTATGAAAGCTACACCTAATGATGAGCTAAAAACTTCATCTAACTCAACTTCAGGAAGACCTATCATCTTGAATATTAGTGCTATGGATGCTGCAAGTTTTAGAGAGTTTGCTTCTAGTAATAGTAGTGCTCTAAGAGACGCAGTAGAATTAGCTCTGAATGAGAACGGTGCTAGTCTGAAAACATTAGGAAATTCTTAA

Genome Context

Tertiary structure

A0AAF0GD68
ESMFold structure
Source ESMFold
pLDDT 60.6
Oligomeric state monomer