Protein
- UniProt accession
- M4QF76 [UniProt]
- Protein name
- Virion structural protein
- RBP type
-
TSP
- Seq2Symm
-
C1 confidence 0,506 truncated
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C1 0,506 I 0,117 C2 0,034 - Protein sequence
-
MAKRQIRDYVFSPGIAGVGTLKILDKVDVDQILLITNTTSNQFLYNFSDPSLPISVAFTSTSDGSDPDFPYSNTLSNGVTTITFLYDTSAQFATDKILIFVEAEEQKMRPYDFGTDAIERMRMAEPQSMLDADFEYGIQPTKWQSLDLLRGYPSIYEVPGSDIGLIAVTTDASSGSGAIGPSKITIDTVLDHGLDVGDPISIKGLDDAVSGFAKAEGSFIIDSVPSNTQFTYYAKAKVGTTPATALLSSFTVLKQAGFYTGAAIGTNPVFSVVTNGASGSFQTKGSNPQGTTRIGVQPSSTLPPIGAPLSGIGVPTGTQVTSVISTNATLNITDSFVAPVSEITFNDTASIEVGSSLDDGSGNAIFVTNISGNIVTLSSPYQIDKTGNSFVSQPTSGSQVNFGNGTGAQFDITRENGVYSTVIINTQNYYNNVDGAYSGQLGNGASFVVERTGGASPSYTNVFTQQSGGNYSVSETITISGTDLGGAASTNDLTITIDAVGVNGEITGISFAGVASANLSAGGTNYAAGEDLVVYGNALGGTSPLNDMIISITSVGSAGDIEGFNITGVGVPSTAFYSGVEQSSTSGSGINAGFNIERVGAGASTAQVDNVVIGGSIETDDTFRITIDGTNDYTYTAQVGETIVAVRNGLIAAINDLSTGSTTVQATTGATSDTLEITALNPGTSFTIAVLTEDQGGNAADTQTMTTNNVVPNNSSVSTPAYNVIVANPGQSYANGDTITLNGDQLGGSTGVNDLTITVQTVNAQGGITGITTSGTPWDGNRTFLNMNPNPVAFNATFIPRISSGNYSPEIANAGEGYKLGYQFIIPGTSLGGASPTNDMTITVDDVDASGAIQLASATGTPVSGDTIAFFPAVSLSAATTNIIGANATVTYSAIAKINVQFTSNHGLVPGDTILTSITSNGSGHDLASGPFFVDEVPGLDNFTFTARSTGNVSGGITGVVYPRTDSFYTHRPFDGGVQLGTGSPAHGAQAVRQSKKYIRYQSGKGIMYTTGALFAPSYDLRSVGADGTAIGSIITCVTDDLNHGLQVGAEIQLVGLTTAGYNDHYTVASIIDEITFTVIAKNSLAQTQAEFGDQPVVALYRWQGATVRAGAFDDQNGIFFQYDGTNIAVGLRSSTYQIAGTVSATPDSNELTGTNTKFTEQLSVGDRIVIRGMSHVVTDIQGDTQLSVNPDFRGVASATNVKAALTKEIIIPQSQWNIDRADGTGKSGYDIEINRMQMIGFQYTWYGAGFIDWMFRGPSGNFIFVHRLKNNNRNNEAFMRSGNLPVRYEVINEGAKNKLASNMTSTETDSMLLKDASLFPPSGIVLINNEIVRYTSKLNNTLSGLTRSANYTNFVAGSQRTFLAGSADSHDSNAGVILLSNTATPQINHWGSAFLTDGGFDEDRGYLFNYQEKEVEINTTKSTIFLIRLSPSVSNAITGDLGERELINRAQLLLKNIEITTQGGSSSQGIIVEGVLNPKNYPTNPNDVTWAGLNTGGAGGQPSFAQIASGGDITFLGGVAPVTASNAGTQNYTSNYVFFNTSDIGGVQIGFEVTGGDLRGGATVVRIFRRNNSTTWIQFSDRTRAGSAGSTTYTFQPLTGAATPGEQVFAFTAAPGSRDTIDLSELKELTNTPIGGRGTFPNGPDVLAINAYLTSGSAINATINVRWSEAQA
- Physico‐chemical
properties -
protein length: 1673 AA molecular weight: 174680,64910 Da isoelectric point: 4,45171 aromaticity: 0,08308 hydropathy: -0,08261
Taxonomy
Coding sequence (CDS)
Genbank protein accession
AGH26949.1
[NCBI]
Genbank nucleotide accession
HQ634177
[NCBI]
CDS location
range 169811 -> 174832
strand -
strand -
CDS
ATGGCAAAAAGACAAATTAGAGACTATGTATTCTCCCCAGGCATTGCTGGTGTCGGTACATTAAAAATCCTGGATAAGGTAGATGTCGATCAGATTCTGCTGATCACTAACACTACTAGCAATCAATTTTTATACAACTTCAGTGATCCGTCATTACCGATCTCGGTAGCTTTCACATCAACATCAGACGGATCTGACCCAGACTTCCCATACAGTAATACGTTATCAAATGGTGTGACCACCATTACGTTCCTGTATGACACTTCTGCACAGTTTGCTACTGACAAGATTCTAATCTTTGTCGAAGCAGAAGAACAGAAGATGCGTCCATACGACTTCGGTACTGATGCTATCGAACGTATGAGGATGGCAGAACCTCAATCGATGCTTGACGCTGACTTTGAGTATGGCATTCAACCAACCAAGTGGCAGTCTCTTGACTTGCTGCGTGGTTATCCTTCTATCTACGAAGTTCCTGGATCCGATATCGGTCTAATCGCTGTAACAACTGATGCATCTTCTGGATCAGGTGCTATCGGTCCTTCTAAAATTACTATTGATACTGTCCTAGATCACGGTCTAGATGTTGGAGATCCTATTTCTATCAAGGGTCTAGACGATGCTGTTTCTGGTTTCGCAAAAGCAGAAGGTTCGTTCATCATCGACTCTGTTCCTAGCAACACACAGTTCACCTACTATGCTAAAGCAAAAGTAGGAACAACCCCTGCTACTGCGCTACTATCTTCATTCACTGTATTGAAGCAAGCAGGTTTCTATACTGGCGCTGCAATTGGTACTAACCCTGTATTCAGTGTAGTAACCAATGGTGCTTCGGGAAGCTTCCAAACAAAAGGATCTAACCCACAAGGAACGACAAGAATTGGTGTACAACCTTCGTCTACTTTACCACCTATCGGTGCTCCTCTATCAGGAATCGGTGTTCCAACTGGCACACAGGTAACTTCTGTTATCAGTACAAACGCCACACTAAACATTACTGACTCCTTCGTTGCTCCAGTGTCGGAGATCACATTCAACGATACTGCTTCTATTGAGGTAGGTTCTTCTCTAGATGATGGTAGCGGCAATGCTATCTTCGTTACTAACATTTCTGGAAATATTGTAACCTTATCTTCCCCATATCAGATCGATAAGACTGGTAACAGTTTTGTTTCACAACCAACATCAGGAAGTCAAGTAAACTTCGGTAATGGTACTGGAGCACAGTTTGATATCACCAGAGAGAATGGTGTTTATTCTACAGTTATTATCAACACCCAAAATTATTATAACAACGTTGATGGTGCATACTCTGGTCAACTAGGTAATGGCGCATCGTTTGTTGTAGAAAGAACTGGTGGTGCATCACCATCTTATACGAATGTCTTTACACAACAATCTGGTGGCAACTATTCAGTATCAGAAACTATCACTATTTCTGGTACAGATCTAGGTGGTGCTGCTAGCACAAATGATCTAACTATCACTATCGATGCAGTTGGCGTCAACGGAGAAATTACTGGTATTAGTTTTGCTGGTGTTGCATCAGCAAATCTGTCCGCTGGTGGAACAAACTACGCTGCAGGCGAAGACTTGGTTGTATATGGTAATGCACTTGGTGGTACTTCTCCACTGAATGACATGATCATCTCGATCACATCAGTAGGTTCTGCTGGAGACATTGAAGGATTTAACATCACTGGTGTTGGTGTACCATCAACAGCATTCTACTCTGGTGTCGAACAGAGCTCCACTAGTGGTTCTGGTATCAACGCTGGTTTCAATATCGAAAGAGTTGGTGCTGGCGCGTCAACTGCACAAGTAGATAACGTTGTTATCGGTGGTTCTATTGAAACAGATGATACATTCAGAATCACTATCGATGGAACAAATGATTACACCTACACAGCACAAGTAGGAGAAACTATTGTTGCAGTCAGAAATGGTTTGATTGCTGCTATTAACGATCTTTCTACAGGATCTACAACTGTACAGGCAACTACTGGTGCTACAAGTGATACATTAGAAATCACTGCATTGAATCCTGGTACATCATTCACAATTGCTGTACTGACAGAAGATCAAGGTGGTAACGCTGCTGACACGCAGACAATGACTACCAACAATGTAGTTCCAAACAACTCTAGCGTTTCCACACCAGCTTACAATGTTATCGTTGCTAACCCTGGTCAGTCTTATGCTAACGGCGACACCATTACACTCAATGGTGATCAACTAGGTGGATCCACTGGTGTCAATGACTTAACTATTACAGTACAAACTGTTAATGCACAGGGTGGTATTACTGGTATCACTACATCTGGTACTCCATGGGATGGCAACAGAACATTCCTGAATATGAATCCAAACCCAGTTGCATTCAACGCAACCTTCATTCCTAGAATTTCTAGCGGTAATTATTCCCCTGAAATTGCTAACGCTGGTGAAGGTTACAAACTAGGTTACCAATTCATTATCCCAGGTACTTCTTTGGGTGGTGCTTCGCCAACTAACGACATGACAATTACTGTCGATGACGTTGATGCATCTGGCGCAATCCAATTAGCAAGTGCTACTGGTACTCCTGTTAGTGGCGACACTATTGCATTCTTCCCAGCAGTCTCTCTGTCTGCAGCAACTACCAATATCATTGGTGCAAACGCTACAGTCACATACTCTGCTATTGCAAAGATCAATGTACAGTTCACATCAAACCACGGTCTGGTTCCTGGTGACACTATTCTAACATCTATCACATCCAATGGCAGTGGTCATGATCTGGCATCTGGTCCGTTCTTCGTTGACGAAGTACCTGGACTAGATAACTTCACCTTCACCGCAAGATCGACAGGTAATGTCTCTGGTGGTATTACTGGTGTTGTATATCCAAGAACTGACTCGTTCTATACACACAGACCATTTGACGGTGGTGTTCAGTTGGGTACAGGTTCTCCTGCTCACGGCGCACAGGCAGTTCGTCAATCCAAGAAGTATATCAGATATCAGTCTGGTAAAGGTATCATGTATACCACTGGTGCCCTGTTCGCACCTTCTTATGACTTGAGAAGTGTTGGTGCAGATGGAACTGCAATCGGCAGTATCATCACTTGCGTTACTGACGACCTCAACCACGGTCTACAGGTTGGTGCAGAAATTCAGTTGGTTGGTTTAACCACAGCAGGATACAATGATCACTACACTGTAGCGTCAATCATTGATGAAATTACGTTCACTGTTATTGCGAAGAATAGTCTAGCACAGACACAAGCAGAATTTGGCGACCAACCAGTTGTTGCTCTGTATAGATGGCAGGGTGCTACGGTTCGTGCTGGTGCATTTGATGACCAGAACGGTATCTTCTTCCAGTATGACGGAACAAACATTGCTGTCGGTTTAAGATCTTCTACTTATCAGATTGCTGGTACAGTATCTGCTACACCAGACTCTAACGAACTGACTGGAACAAACACCAAGTTTACTGAACAGTTATCTGTTGGTGACAGAATTGTCATTCGTGGTATGTCCCACGTCGTTACTGATATCCAAGGCGACACACAGTTGTCCGTCAACCCTGACTTTAGAGGTGTTGCTAGTGCAACCAATGTCAAGGCAGCACTGACTAAAGAAATCATTATTCCCCAGAGTCAGTGGAATATTGATAGGGCAGACGGTACAGGTAAGTCTGGATATGACATCGAGATCAACCGAATGCAGATGATCGGATTCCAGTATACCTGGTATGGTGCTGGATTCATCGACTGGATGTTCAGAGGTCCATCTGGTAACTTCATCTTCGTACACAGACTGAAGAACAACAACAGAAACAACGAAGCATTCATGCGTTCTGGTAACCTACCTGTTCGCTATGAGGTTATCAACGAAGGTGCGAAGAACAAACTAGCAAGTAATATGACTTCCACTGAAACAGACAGCATGCTGCTTAAGGATGCTTCCCTGTTCCCACCAAGTGGTATTGTACTAATCAACAACGAGATTGTTAGATACACATCTAAACTGAACAACACTCTCTCTGGTCTAACCAGATCTGCAAACTACACCAACTTCGTTGCTGGTTCTCAAAGAACTTTCCTCGCAGGCAGTGCTGATAGTCATGACTCCAACGCTGGTGTTATCTTACTATCCAACACAGCAACTCCACAGATTAATCACTGGGGTTCTGCATTCCTGACTGACGGTGGATTTGATGAAGACCGTGGATACCTCTTTAACTACCAAGAAAAAGAAGTTGAGATTAATACTACCAAATCTACTATCTTCCTGATCAGACTATCGCCTAGTGTTTCCAATGCTATCACTGGTGACCTAGGTGAAAGAGAACTGATCAACAGAGCACAGTTGCTACTCAAGAACATTGAGATTACCACACAGGGTGGATCAAGTTCGCAGGGTATCATCGTTGAGGGTGTTCTTAATCCCAAGAACTACCCAACTAATCCAAACGACGTTACCTGGGCAGGTTTGAATACAGGCGGTGCAGGTGGACAACCATCGTTTGCACAGATTGCATCTGGTGGTGATATTACCTTCCTTGGTGGTGTTGCTCCAGTTACAGCATCAAACGCTGGAACACAGAACTACACTTCTAACTATGTCTTCTTCAATACCTCCGACATCGGTGGTGTACAGATTGGTTTTGAGGTAACTGGTGGTGACTTGAGAGGAGGAGCGACGGTTGTCCGAATCTTCAGAAGAAATAACAGCACAACATGGATCCAGTTCTCTGACAGAACTAGAGCAGGAAGCGCAGGTAGCACAACCTACACGTTCCAGCCTCTAACGGGTGCAGCAACTCCTGGAGAGCAGGTCTTCGCTTTCACGGCAGCACCTGGTTCTAGAGATACAATCGATCTTTCCGAACTGAAGGAACTTACCAACACTCCAATCGGTGGTAGAGGTACATTCCCCAACGGTCCCGACGTTCTAGCAATTAATGCATACCTAACTTCTGGTAGTGCAATTAATGCAACGATTAACGTTCGCTGGTCTGAAGCACAGGCATAA