Genbank accession
WJN64210.1 [GenBank]
Protein name
tail fiber
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,68
Seq2Symm
C1 confidence 0,969 truncated
C1 0,969
C2 0,040
C3 0,015
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MASRKEMMGMDTETLRMLGLEAGLSFEPGLSKSKMVIQLETHQASGWLDVNSQLLHADAEGGFDHMQGFTGHEEQSISDAARVAQSLAGAGYTETFHSIMGGGRDHHVDALHQYMQKLGVSADDVWMHMPKANPNIPPQNFNMLKGYLNNHWDDYQDIMPPLEGHYAGDIMGEYSTNKGNVADSYNHLASMYLNKAAYNNPHAYEHDAALVATRLASAMGNQFLEVGYAAATGAKVGYHSILPQLGSDVVRGTQYPREPLNAAGLPLGATGSAVQGNRAHYSLVASLLGRPEGADEASSAIRQEVSSTMKSLASSYKGGGETGMNPYRHETSEHDLLLDSATRYVGIEEARSGYANLDDTSYNRNNIQAVIENSWDKMDAQAASAPSGVPNPDLRLPRRAEIGTQWSADLNEPLSWNSARSRRESIAIADLDAAHANFRDVADGSRGSSPVHFHNMEQGSDEWFKFREQYDITGSTVGGFLGSNSYTRPWAQFLDKLGVTRKDTAPNEFQEKMFAMGHQRENEARIRVSKQLGQDIQQVGAITNDMYPGMMYSPDGLIGDDALWEHKAPERAGKFADLSAGEHPDYMDQIQMGMLLSGRKKTLFSQTIGQETRNQWIDQDPDWYNKNQARLDSVLNRMQAGRDFLSNHADLPQDELKAGVRKAVTGEGIWKDVRQKSDRGYSPNAGTEADPFLIGGRRSYSDAAQGGSDYEPNFVTSANTGLVPVGGNGAETGMALAVKQGVLAAREEVKRGEASGNAAGFDAGGADADFDDLGMPRGFSRKAFDRANSDGAGGGGGNGGGRNGAGPGAFDNFGNGIASGLASGSLHGLQGGFQRELANMGPVGQTLLAGIGAASIGGEVISTMNDYLGNAQDFGSSNPIQFDAQQQGMEMLGLNKAQAQRANETVHSAFNMMANGDPSAAAQMSVATRGLITLADIRESGGDPIKLNRIFVERARSRGWSQERIAGAAQMAGLDGFARTASTSDRIRNAAEGLDDTRGRQDTSEFAGAVREDNATRAAVSPDYFVQRYGAQDYNALVGGLSGGMSKAYQLMDKAEQVTHAKSLAEATQMLESGGRDYDDKGNPLTSSTGAKYSMQVLPSTARDPGYGVKPAQSDTPEEYNRVGRELLDKMVGKYAGDYDKAAAAYTDGAGTVDRAVKQWGNDWLKHMPAQAQKRVADLHKLATGANGFAGGSTGPSVGTIQVNVTATVNGKQATATANVGNQSQSHTINVGGAVSQKR
Physico‐chemical
properties
protein length:1239 AA
molecular weight: 132534,66800 Da
isoelectric point:5,41371
aromaticity:0,07183
hydropathy:-0,57651

Domains

View on InterPro
WJN64210.1
1 1239 aa
STR 444–646 · RBD 1050–1061 · STR 1062–1163 · RBD 1164–1182 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WJN64210.1 [NCBI]
Genbank nucleotide accession
OQ818701.1 [NCBI]
CDS location
range 12658 -> 16377
strand -
CDS
ATGGCTAGCAGAAAAGAAATGATGGGCATGGATACGGAAACTCTCCGTATGCTTGGTCTTGAGGCCGGATTATCTTTTGAGCCCGGACTCTCGAAGTCCAAAATGGTTATACAACTGGAGACTCATCAAGCTTCCGGTTGGTTAGATGTGAACAGCCAACTTCTTCATGCAGATGCGGAAGGCGGCTTTGACCACATGCAGGGCTTTACAGGTCACGAAGAACAATCCATTTCTGACGCTGCAAGAGTTGCACAATCGTTGGCTGGTGCTGGTTACACTGAAACATTCCACTCCATAATGGGTGGCGGTCGTGACCATCATGTTGATGCCCTTCATCAATACATGCAGAAACTTGGTGTCTCTGCTGATGATGTTTGGATGCACATGCCAAAGGCGAATCCCAATATTCCGCCTCAGAATTTCAACATGCTGAAAGGTTATTTAAATAACCATTGGGATGATTATCAGGATATTATGCCTCCACTTGAAGGGCATTATGCTGGTGATATCATGGGCGAGTATTCTACGAATAAAGGCAACGTTGCTGATTCGTACAATCATCTTGCATCCATGTATTTAAATAAAGCTGCTTACAACAATCCTCACGCATATGAACATGATGCTGCGCTTGTTGCAACGCGTTTGGCTTCGGCAATGGGAAATCAATTCCTCGAAGTTGGTTATGCTGCTGCAACTGGTGCGAAGGTTGGATATCATTCTATTCTTCCGCAACTTGGCTCTGATGTTGTTCGTGGTACTCAGTATCCTCGCGAACCTCTGAATGCTGCTGGTTTACCTTTGGGTGCAACTGGTTCTGCTGTTCAGGGCAACCGCGCACATTATTCTTTGGTTGCTTCTTTGCTCGGTCGTCCAGAAGGTGCTGATGAAGCATCGAGTGCGATTCGTCAGGAAGTAAGCTCAACAATGAAGTCTCTGGCATCGTCTTATAAAGGCGGTGGTGAAACAGGAATGAATCCTTATCGCCACGAAACGTCAGAGCATGACTTATTGCTGGATAGTGCGACACGTTATGTTGGTATCGAAGAAGCTCGTTCAGGTTATGCAAACTTGGATGACACCTCATACAATCGCAACAACATTCAGGCAGTAATCGAAAACAGCTGGGACAAGATGGATGCTCAGGCAGCGTCTGCACCATCTGGTGTTCCCAATCCAGACCTTCGTTTACCACGTCGTGCGGAGATTGGTACTCAATGGAGTGCTGATTTAAACGAACCATTGTCTTGGAACTCTGCTCGTTCTCGTAGAGAGAGCATTGCAATTGCAGATTTGGATGCTGCTCATGCAAACTTTCGTGATGTTGCTGATGGAAGTCGTGGTTCAAGCCCTGTTCACTTCCACAACATGGAACAAGGAAGTGATGAATGGTTCAAGTTCCGTGAACAATATGATATTACCGGCTCAACAGTTGGTGGTTTCTTAGGTTCAAACAGCTACACCCGTCCGTGGGCACAGTTCTTGGACAAACTTGGGGTCACTCGTAAGGACACAGCGCCAAACGAATTCCAAGAAAAGATGTTTGCCATGGGACACCAGCGAGAAAATGAAGCTCGCATTCGTGTTTCCAAACAACTCGGTCAGGATATCCAACAAGTTGGTGCAATAACCAACGACATGTATCCCGGAATGATGTATTCACCAGATGGATTGATTGGTGATGACGCATTGTGGGAGCATAAAGCTCCTGAACGTGCTGGCAAGTTTGCGGATTTAAGTGCTGGCGAACATCCAGACTACATGGACCAGATTCAAATGGGCATGTTGTTATCTGGACGCAAGAAAACTCTATTCTCGCAGACGATTGGGCAAGAAACTCGCAACCAATGGATTGACCAAGACCCGGATTGGTATAACAAGAACCAAGCTCGTTTGGATTCTGTGCTCAACCGTATGCAAGCTGGTCGTGACTTCCTCTCGAATCATGCTGACCTTCCTCAAGATGAATTGAAAGCCGGTGTTCGTAAAGCTGTAACAGGCGAAGGAATCTGGAAAGATGTTCGTCAGAAATCAGACCGTGGTTACTCGCCAAATGCTGGTACAGAAGCTGACCCATTCTTAATAGGCGGTCGTCGTTCTTATAGTGACGCTGCTCAAGGTGGCTCAGATTACGAACCGAACTTTGTGACTAGTGCCAATACTGGCCTCGTTCCAGTGGGCGGTAACGGCGCTGAGACGGGCATGGCGCTTGCGGTTAAGCAAGGTGTACTGGCGGCAAGGGAAGAGGTAAAACGCGGCGAGGCTTCGGGTAACGCAGCAGGATTTGATGCTGGCGGTGCCGATGCGGACTTTGACGATTTGGGTATGCCTCGCGGCTTCTCACGTAAGGCGTTCGACCGGGCAAACAGTGACGGCGCTGGCGGGGGCGGTGGAAACGGCGGTGGACGCAATGGCGCTGGCCCAGGCGCGTTTGACAACTTCGGCAATGGGATTGCATCGGGTTTGGCAAGCGGCTCACTGCATGGCCTACAGGGAGGATTCCAGCGTGAACTAGCAAACATGGGGCCGGTTGGTCAAACTCTGTTGGCTGGTATCGGAGCGGCGTCAATTGGTGGTGAAGTCATTTCAACAATGAATGACTATCTTGGAAATGCTCAGGACTTTGGTTCAAGCAATCCAATTCAATTTGACGCTCAACAGCAAGGCATGGAAATGCTTGGGCTTAACAAAGCTCAGGCCCAACGTGCAAATGAAACAGTTCACTCTGCTTTCAACATGATGGCGAATGGCGACCCAAGTGCTGCCGCTCAAATGTCTGTTGCAACTCGTGGACTTATCACGCTTGCTGATATCCGTGAAAGCGGTGGCGACCCAATCAAGTTAAACCGCATCTTTGTTGAACGTGCCCGTTCTCGTGGCTGGAGTCAGGAAAGAATTGCTGGTGCTGCTCAAATGGCAGGACTTGATGGATTTGCTCGTACTGCCTCAACTTCTGACCGAATCCGAAATGCTGCGGAAGGTCTTGATGACACTCGTGGTCGTCAGGATACTTCTGAGTTTGCTGGTGCTGTTCGTGAAGACAATGCAACTCGTGCTGCTGTATCTCCTGACTATTTCGTTCAACGTTATGGTGCCCAGGATTACAACGCATTGGTTGGTGGTTTGTCTGGTGGTATGTCAAAAGCATATCAGCTTATGGACAAAGCCGAACAAGTTACTCATGCCAAATCTCTTGCAGAAGCAACACAAATGCTTGAGTCTGGTGGTCGTGATTACGATGATAAGGGTAATCCGTTAACCAGTTCTACTGGTGCCAAATACTCAATGCAGGTTCTTCCTTCTACTGCACGTGACCCAGGATATGGAGTCAAGCCTGCTCAAAGTGATACACCAGAAGAATACAATCGTGTTGGTCGAGAACTTCTCGATAAGATGGTTGGTAAGTATGCTGGTGATTATGACAAAGCGGCTGCTGCATATACTGACGGTGCCGGTACTGTAGACAGAGCGGTTAAGCAATGGGGCAATGACTGGCTTAAACATATGCCAGCACAGGCTCAGAAACGTGTTGCTGATTTGCATAAACTGGCAACTGGTGCAAATGGATTTGCTGGTGGTTCTACTGGCCCATCTGTTGGAACTATCCAAGTTAATGTCACTGCGACTGTTAATGGTAAGCAAGCAACTGCAACTGCAAATGTCGGCAATCAATCTCAGTCTCACACTATTAATGTGGGTGGCGCTGTTTCTCAGAAGCGTTAA

Genome Context

Tertiary structure

WJN64210.1
ESMFold structure
Source ESMFold
pLDDT 46.1
Oligomeric state monomer