Genbank accession
WVX87425.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,80
TF
Evidence RBPdetect2
Probability 0,83
Seq2Symm
C3 confidence 0,994
C3 0,994
C1 0,167
C6 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAWHTGNLRFEVQGDTLRYRGFKIFTENDFPTPQELNLYSKEESDARFAPIHPAGYVKKDGDNMSGALGVVNTLTVTGAVPGVKLVQSGDDKQWHLTSQNGSLSIGEDTSTNYRMIMTPNGDAIQLNFDEIRLKGGAAFRVLGDNWLRINDTKQFTNGVNFGTSPIVGLGSLTIGSNSTAGLYVTSSALNWKGSPVLTENNWAPMDARFVKKAGDSMTGDLFTTGVSVPAMNGYLQRHRHFPTVGGGSYNSGTSSEVGMIKIKIPGGFRATMISFWVDVYRYNGNDTMSFFVSGYIYSNNESWINTSASQVGGSAQLPVSFGKDAEGNPIVAIGSAGSNHSYPQVLVRDVQAGYSGGNNSDIYRNGWEIEVSPDALAATHATVTKPAMYSDRIKPTPADIGALALTGGTVGGGVVIEDDDASPLRIKRTNATDNISIAFIGSNNVPTYVGINQQGRLAYHSTQSLSAAGSELVYSTGFKPTPAELGAVNKAGDTMTGNLTAPEFRATGNIAIRRGDNFLALDSSNNTYLASASGAALGLVDNGANPRFKSAAGNWYSLYHAGNLSLSTLGGMPIAGGNFTGLIGAPNNPTSWINGIKNPTYNVNGSGSASAYAAWMSGRTGSNGAFSFGVLGETFYVRYATKAQWDGNINSPAQVLAISSSGVITGHGGGLTNLNAGSLVGTIPTGNLSGAYAIDITGNAKTANSATVADRVSPRSSTSTTFYNINWVSGDNSTIYHSNGKVQIRPSDGYLSAGYMRGLSGVYDGSQRVFSANNRPTWNDITGKPTIDVEPWNVFYNNINVPIRLYAIPTAARNAMASGKNVMFRVGVRNGRDFGTRDVMFHASMWNLGSQAQINSVVEGLSFFWIHNGNSTWGSVANYFESEHTRTVYLAWKIVT
Physico‐chemical
properties
protein length:896 AA
molecular weight: 95269,71060 Da
isoelectric point:8,26570
aromaticity:0,09933
hydropathy:-0,23728

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WVX87425.1 [NCBI]
Genbank nucleotide accession
PP209424.1 [NCBI]
CDS location
range 52405 -> 55095
strand -
CDS
ATGGCGTGGCACACTGGCAACCTTCGTTTTGAAGTACAGGGTGACACACTGCGTTATCGTGGATTCAAAATCTTCACCGAAAATGACTTCCCAACCCCACAAGAACTAAACCTATACAGTAAAGAAGAATCAGACGCCCGTTTTGCACCAATCCATCCAGCCGGATACGTCAAGAAAGACGGGGACAATATGTCCGGGGCGCTTGGGGTTGTCAATACGCTTACTGTAACCGGTGCGGTGCCCGGTGTCAAGCTGGTTCAATCAGGTGACGACAAACAATGGCATCTGACGTCACAGAACGGGTCGCTGTCAATTGGTGAAGACACATCAACCAACTATCGAATGATTATGACACCAAACGGCGACGCCATACAGCTCAACTTTGACGAGATCCGTCTGAAAGGTGGTGCGGCGTTCCGGGTACTGGGTGATAATTGGCTGCGTATCAATGACACGAAGCAATTTACCAACGGTGTTAATTTTGGTACTAGCCCTATTGTTGGATTGGGGTCGCTGACTATCGGGTCGAATTCAACTGCCGGTTTGTATGTCACTTCGTCGGCATTGAACTGGAAGGGTAGCCCAGTGCTGACCGAAAACAACTGGGCACCAATGGATGCCCGGTTTGTCAAAAAAGCCGGTGATTCAATGACCGGTGACTTGTTCACAACCGGGGTGAGCGTCCCGGCAATGAACGGTTATCTCCAGCGTCATCGTCATTTCCCGACCGTGGGCGGTGGTAGCTATAACAGCGGAACGTCTTCTGAAGTCGGAATGATTAAAATCAAAATCCCCGGCGGCTTCCGGGCGACGATGATCAGTTTCTGGGTGGACGTATATCGTTACAACGGCAATGACACAATGAGCTTCTTTGTGTCGGGTTATATATACTCCAATAACGAGAGTTGGATTAATACCAGTGCGAGCCAAGTTGGTGGTTCGGCACAACTCCCGGTGTCGTTTGGTAAAGATGCCGAGGGCAACCCGATCGTCGCGATTGGTAGTGCTGGGAGTAATCACAGTTACCCACAGGTGTTAGTTCGGGATGTTCAGGCTGGGTATTCCGGTGGTAATAACTCGGACATATATCGTAATGGGTGGGAAATTGAAGTAAGCCCAGACGCACTCGCGGCGACACACGCAACCGTGACTAAACCGGCAATGTACAGCGACCGGATAAAGCCAACCCCGGCTGACATTGGTGCACTGGCACTCACGGGCGGAACAGTTGGAGGTGGAGTTGTCATTGAAGACGACGACGCCAGTCCATTACGGATCAAGAGAACGAATGCGACGGATAACATTTCGATTGCGTTTATTGGTTCTAACAACGTTCCAACCTATGTCGGTATCAACCAACAAGGACGGCTTGCATATCACAGCACACAAAGCTTGTCGGCTGCCGGGTCTGAACTGGTATACAGTACCGGGTTCAAACCAACCCCGGCTGAACTTGGCGCGGTGAACAAAGCCGGTGATACGATGACTGGTAACCTGACAGCTCCGGAGTTCCGGGCAACTGGAAATATAGCTATACGTCGCGGGGATAACTTCCTTGCGCTGGATAGTTCCAATAACACTTATTTGGCATCGGCATCCGGTGCGGCGTTGGGACTGGTTGACAATGGGGCGAATCCAAGATTCAAATCCGCTGCCGGTAACTGGTACTCGCTGTATCACGCTGGTAACTTGTCACTGTCGACGCTCGGTGGTATGCCCATCGCCGGTGGGAACTTTACAGGTTTGATCGGTGCACCAAATAACCCGACTAGCTGGATCAATGGTATAAAGAACCCGACATATAATGTAAATGGATCGGGTAGTGCAAGTGCCTATGCTGCGTGGATGTCCGGTCGAACTGGTTCGAATGGGGCATTCTCGTTTGGTGTTCTGGGCGAAACGTTCTATGTCCGCTATGCAACCAAAGCACAGTGGGACGGGAATATCAACAGCCCGGCACAGGTACTGGCAATTAGTTCAAGTGGTGTTATCACCGGGCATGGTGGAGGTCTGACAAACCTGAACGCCGGGTCGTTGGTCGGAACAATCCCAACAGGCAACCTATCCGGGGCGTATGCGATCGATATCACCGGGAACGCAAAGACGGCAAACAGCGCCACCGTAGCCGACCGGGTCTCGCCACGTTCATCGACGTCAACCACGTTTTACAACATCAACTGGGTATCTGGCGATAATAGCACAATATATCACAGTAACGGAAAAGTGCAAATCCGACCAAGTGACGGTTATCTGTCGGCTGGTTATATGCGCGGTCTATCTGGGGTGTATGACGGAAGTCAGCGAGTGTTCAGTGCAAACAACCGCCCAACGTGGAATGATATTACCGGTAAGCCGACGATTGACGTCGAACCGTGGAATGTGTTCTATAACAATATCAACGTGCCGATCCGTCTTTATGCAATCCCAACGGCAGCCAGAAACGCCATGGCAAGTGGCAAAAACGTCATGTTTAGGGTGGGCGTTCGTAATGGTCGTGACTTCGGAACTCGGGATGTAATGTTCCATGCGTCAATGTGGAATCTTGGGTCACAGGCTCAGATCAACTCGGTAGTCGAGGGTCTAAGTTTCTTCTGGATCCACAACGGAAACAGTACGTGGGGATCTGTTGCGAACTACTTCGAATCGGAGCACACCCGGACGGTTTATCTGGCATGGAAAATCGTGACATGA

Genome Context

Tertiary structure

WVX87425.1
ESMFold structure
Source ESMFold
pLDDT 57.7
Oligomeric state monomer