Genbank accession
WRQ05709.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,65
Seq2Symm
C1 confidence 0,888
C1 0,888
C3 0,513
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAHGETGLYPFDPNGTNPQNFIKGERQTLQVPDGDDYYFIIPFAAPFFVDSLRLFNPLTNQTYVEGVDYLIGHWFIEAMESIGRPIAGSIRIMKRSINAMIGMDYRTIGGQWGFSNQQILAELARKQYNPLIRSWGAIGPLPASFPPLEHNQPIDSLVGSKEILEGIEGIIEAIRAAAAGTTDQHIHDYNNPHRVTKAQVGLSLVPNYAMASDQQHLDANRNDLFTNPRGTLALVNKFAVNPLNAHIAARGNVHGLTAADINLGNVPNYPAATPTTAVDVTNDSVLLTPYTASILYSQIGDASRINELEEKLNQHISNENNPHVVTADQVNAYTKTQVDQLLAGLGGGDASTFGGLTPEQWKDEFPSFGDIERMAAGYNANWDDVQLKIDTLPVIVDDTSEYDRMELIQGVTAGFHAYAGFNSWWDCTIVRDDCVVHPKSPANPYAVIPERLGYAQESWVSHRYGQYWVENGVAKSACIDETKVDEMIPIPVEWTAPIDGNIPSSIWANKTSLYMLTGKFIFSSTGESAIFEHQDLYRCVKGGTSELLVPAANKPWAIFTNTEDTYPGEMTVVVNIGPASSADYVYTAYGIPSFISAFNDFVNNTIKPLNHVIDSMSIGCTHIIMHSIDPLVAPEDYTSESSKVHVMEIIRNGNDTSFMVISPLWFDGRGNDVTANVNSNPIGGVSGLYTHYTVMYGNGQIAFFGNNDEGQCDVDDHAGPYIQLAAGHNFTVTVNTLNQVMFWGDSPDNSLLWNGRGTRVKHIEPTPPTGP
Physico‐chemical
properties
protein length:771 AA
molecular weight: 84618,59410 Da
isoelectric point:4,75296
aromaticity:0,09857
hydropathy:-0,23009

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WRQ05709.1 [NCBI]
Genbank nucleotide accession
OR608733 [NCBI]
CDS location
range 119633 -> 121948
strand -
CDS
ATGGCCCACGGTGAAACTGGGTTATATCCATTCGACCCCAATGGAACAAATCCCCAGAACTTTATTAAAGGTGAGCGCCAAACTCTCCAGGTACCAGATGGTGATGATTATTATTTCATTATACCATTTGCTGCACCTTTCTTTGTAGATTCATTACGACTATTTAACCCACTGACCAATCAGACTTATGTAGAAGGTGTTGATTACCTTATTGGGCATTGGTTTATTGAAGCTATGGAATCGATAGGTAGACCTATCGCTGGATCTATACGTATCATGAAGCGTTCGATAAACGCTATGATTGGTATGGATTATCGTACAATAGGTGGGCAATGGGGATTTAGTAATCAGCAGATCCTGGCTGAGCTTGCACGCAAACAGTATAACCCCTTGATTCGGTCATGGGGTGCAATTGGTCCATTACCTGCTTCTTTCCCACCTTTAGAACACAATCAACCTATTGATTCATTAGTAGGTAGTAAAGAGATTCTTGAAGGTATCGAAGGGATTATAGAAGCTATCCGTGCTGCGGCTGCCGGTACAACTGACCAACATATTCATGATTATAATAACCCACACAGGGTAACTAAAGCACAAGTTGGCTTGTCACTAGTTCCAAACTATGCAATGGCAAGTGATCAACAGCATTTAGATGCTAATCGTAATGATCTATTTACGAACCCACGTGGTACATTAGCATTAGTTAATAAGTTTGCCGTAAATCCGCTTAATGCCCACATAGCGGCTAGGGGTAACGTACACGGTCTAACAGCAGCTGATATTAATTTAGGTAATGTTCCTAACTACCCAGCTGCAACACCAACTACCGCGGTAGATGTAACTAATGATTCGGTATTATTAACACCTTATACTGCATCTATTCTCTATAGTCAGATTGGTGATGCTTCTAGAATTAATGAACTAGAAGAGAAACTTAATCAACATATTAGTAATGAAAATAACCCACACGTTGTAACTGCCGACCAGGTTAATGCATATACTAAAACACAAGTTGATCAACTACTGGCAGGACTAGGTGGTGGTGATGCTTCTACCTTTGGTGGATTAACACCTGAGCAATGGAAAGATGAATTCCCATCATTCGGTGATATTGAAAGGATGGCAGCCGGCTATAACGCTAACTGGGATGATGTACAATTAAAGATAGATACATTACCAGTTATTGTGGATGATACTAGTGAATATGACCGAATGGAATTAATTCAAGGTGTCACGGCAGGTTTCCATGCTTATGCTGGATTTAATAGTTGGTGGGATTGTACAATTGTCAGAGATGACTGTGTAGTTCATCCTAAATCACCAGCTAACCCTTATGCTGTTATACCAGAGCGTTTAGGATATGCTCAGGAATCCTGGGTATCTCACCGATATGGTCAGTATTGGGTAGAAAATGGTGTAGCCAAGTCAGCATGTATCGATGAAACTAAAGTCGATGAGATGATACCAATTCCAGTAGAATGGACTGCACCTATAGATGGGAATATTCCTTCAAGTATCTGGGCGAATAAAACATCTCTGTATATGTTAACAGGTAAGTTCATCTTTAGTTCAACAGGTGAATCAGCAATCTTTGAGCACCAAGATCTTTATCGTTGTGTTAAAGGTGGTACATCTGAACTATTAGTACCTGCTGCTAATAAACCATGGGCTATATTTACCAATACTGAAGACACCTATCCTGGTGAAATGACAGTTGTTGTAAACATAGGTCCAGCTAGCAGTGCTGACTATGTATATACAGCTTATGGTATCCCAAGCTTCATTAGTGCTTTTAATGATTTTGTTAACAACACAATTAAACCATTGAATCATGTTATTGATTCAATGTCAATTGGTTGCACCCACATCATCATGCATTCAATAGATCCATTAGTTGCTCCTGAAGATTATACATCTGAATCTAGTAAAGTACATGTCATGGAAATCATCCGCAATGGTAATGATACATCCTTTATGGTTATCTCGCCATTATGGTTTGATGGACGTGGTAACGATGTAACTGCTAATGTAAATAGTAACCCAATTGGTGGTGTATCAGGATTGTATACACATTACACTGTGATGTATGGTAATGGCCAAATCGCTTTCTTTGGAAATAACGATGAAGGGCAATGTGACGTAGATGATCATGCTGGACCATATATTCAATTGGCAGCTGGGCATAATTTCACTGTGACGGTAAATACTTTGAATCAAGTCATGTTTTGGGGAGATTCACCTGATAACTCCTTATTATGGAATGGCAGGGGTACACGTGTGAAACATATTGAACCAACTCCACCCACTGGTCCATAA

Genome Context

Tertiary structure

WRQ05709.1
ESMFold2 structure
Source ESMFold2
pLDDT 64.8
Oligomeric state monomer