Protein
- Genbank accession
- ASU03816.1 [GenBank]
- Protein name
- putative virion structural protein
- RBP type
-
TSP
- Seq2Symm
-
C1 confidence 0,454 truncated
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C1 0,454 C3 0,150 I 0,025 - Protein sequence
-
MTMNFPIVQQYKFDIDGTNPENKITDEPIKTPAGIWNRIIVPVNGPFFVDTLVLTLPNGKPLVEEVDYRIFRMMGKLSEFCARDVACIIELIKPEITDVFATYHTVGETTLFDRSMLLLIMDAVNDDRPVWWENVLNKPVAFPPILHGHSLIYEMVAFQDMVSMIDELLDFLNDGHRDLLELKIDHLSTLIDWYISLYTQTLTKYLERHEASYNAHGLTAAQAGADLIDNFPTATLTQSLQGERSDLVIKPAGLKALMQEYGYNSDFFLETNIIPLSRYGARSFIPPSIDGNFEGLGAEVETTGICMESDGSLSILSNHWDGRTEGLYFSTCPNYQVKVERIFTGFKYTHQKIIANGQEVTRVIGGTNHEVIMVGRPGTPNWFVGLSKGTLNPSKHILSKVNMKPINDAIGNPNGQNYNSHDKLSVHLMGNWVYLIQTYSGPLGENGSKRLFRVPRASVEAGLDVTPTPIKITYKNWDGKQYNSVDEFIWGSPTFDSNNAATRYLFNFNPAVPTATTGGLYRAAVTLSCAIPNKANTYVLKFMSHFWIPYIAGNVSTAIDCSPELVYEFNPDTGVMTLISKSDEPGVVDMTKGNVSVNTLNENSNGLIVANWSRQAAVVLPNGDVVFGGSSLYSYPHYLYIYKTGQRTPYETMKLWWSRRNFPASGYASATEIPVSPIVSGIQQIGVTYDNEGEFYTAYPQNALNTKYLYHRTVTGDYAKREGVNNLIYPNYYSRPVGGVVKRIMAMCNTPRINITGTATQISKYGLNLGWTGFGMGPEERFWRRTQNSNWTPGTNDNDIMLVTAHNKRDNGDGTISLIPTKQVLWPAAIVNQLKNLIPAAYRSSPDIAVSIIDFSDGPEGKFGSFPAIVQIYYVDVSRAMARQMFLTVRPTYSAPSGIRRTVTGYTILGSLDVDVMGSQTDVSTWQPYFVGGVNGSVAKADIYLNDDGTMEVDICSGVASQHAGNNSMACARFTINKSTGQLVGGIPYNYQEAMQSGRHAVPKVGIGQNVFWGTGSGGSALINGAGGNYYMLASCYPESGWVVYFQKAQEVVFNGTSYTLPQGTIDLRDIEPSPGNKTFYLYCEVKENKAAYQISTQKLEDTPFHMWIGIIRTNEKQILTIDRFNVFTLNGQRVSETRRGSALPASSGAINSLGQIPWLKPSEIIQG
- Physico‐chemical
properties -
protein length: 1168 AA molecular weight: 129468,17310 Da isoelectric point: 5,86416 aromaticity: 0,10788 hydropathy: -0,20445
Taxonomy
Coding sequence (CDS)
Genbank protein accession
ASU03816.1
[NCBI]
Genbank nucleotide accession
MF459647
[NCBI]
CDS location
range 99874 -> 103380
strand +
strand +
CDS
TTGACCATGAATTTCCCCATTGTACAACAATATAAGTTTGATATTGATGGGACCAACCCTGAGAACAAAATCACTGACGAACCCATCAAAACCCCAGCCGGTATTTGGAACCGCATTATTGTTCCGGTAAACGGTCCGTTCTTTGTTGACACCCTGGTGCTGACACTGCCTAACGGTAAACCGCTGGTAGAAGAGGTTGATTATCGCATCTTCCGTATGATGGGGAAACTGTCGGAGTTCTGTGCCAGGGATGTGGCCTGCATCATTGAACTGATTAAGCCGGAAATTACTGACGTCTTTGCTACCTACCATACCGTAGGGGAAACCACCCTGTTTGACCGCAGCATGCTGCTATTGATTATGGACGCCGTCAATGACGACCGTCCGGTGTGGTGGGAGAACGTCCTGAACAAACCGGTGGCTTTCCCGCCGATTCTGCACGGTCACAGTTTGATTTATGAAATGGTGGCCTTCCAGGACATGGTGTCGATGATCGACGAGTTGTTGGATTTCCTCAACGACGGACACCGTGATTTGCTGGAGCTCAAAATCGACCACCTGAGCACGCTGATTGATTGGTACATCAGCCTGTATACCCAAACCCTGACGAAGTACCTGGAGCGTCATGAAGCGTCTTACAACGCCCATGGGTTAACAGCTGCACAGGCCGGTGCCGATTTAATCGACAACTTCCCAACGGCTACCTTAACCCAATCGTTACAGGGTGAACGGTCTGACCTGGTCATTAAACCAGCGGGATTAAAAGCACTGATGCAGGAGTACGGTTACAACAGTGACTTCTTCCTGGAAACCAACATCATTCCGCTTTCCCGTTACGGTGCGCGTAGCTTCATCCCGCCTTCTATTGACGGTAACTTCGAAGGTCTGGGGGCGGAAGTTGAAACCACCGGTATCTGCATGGAATCCGACGGGTCATTGAGTATCTTGAGCAACCACTGGGATGGACGTACCGAAGGCTTGTACTTTAGCACCTGTCCAAACTATCAGGTAAAGGTGGAACGTATCTTCACCGGCTTTAAATACACACATCAGAAAATCATTGCCAACGGTCAGGAAGTCACCCGTGTTATTGGTGGCACTAACCATGAAGTGATTATGGTGGGGCGTCCAGGTACACCGAACTGGTTTGTGGGGTTAAGTAAAGGTACGTTGAACCCGTCGAAGCATATTCTCTCTAAAGTGAATATGAAACCGATTAACGATGCCATTGGTAACCCTAACGGCCAGAACTACAACAGCCACGATAAGCTGTCTGTGCACCTCATGGGGAATTGGGTTTACCTTATCCAGACTTACAGTGGTCCGTTAGGCGAAAACGGCAGCAAGCGGCTTTTCCGGGTTCCTCGTGCATCGGTAGAAGCAGGTCTTGATGTAACGCCTACACCGATTAAAATCACGTACAAGAACTGGGACGGTAAACAGTACAACAGTGTTGATGAGTTCATCTGGGGTTCTCCAACGTTCGACAGTAACAATGCCGCAACGCGTTACCTGTTTAACTTTAACCCAGCTGTTCCGACTGCCACTACGGGTGGACTGTACCGTGCTGCAGTTACCCTTTCCTGTGCCATTCCGAACAAAGCCAACACCTATGTGCTGAAGTTCATGAGTCACTTTTGGATTCCGTATATTGCCGGTAACGTCTCCACCGCTATCGATTGCTCTCCAGAACTGGTATACGAATTTAATCCGGACACCGGGGTAATGACGTTAATCAGTAAGAGCGATGAACCCGGTGTTGTGGACATGACGAAAGGCAACGTTTCAGTCAACACCCTTAACGAAAACTCCAACGGGTTAATCGTTGCTAACTGGTCTCGTCAGGCTGCAGTGGTGTTGCCCAATGGCGATGTGGTGTTTGGGGGGAGTTCACTTTATTCGTACCCGCACTACCTCTACATTTACAAAACCGGCCAACGTACACCGTATGAAACCATGAAGCTATGGTGGTCACGTCGTAACTTCCCGGCGTCGGGATATGCAAGTGCGACTGAAATACCGGTGTCACCTATTGTGAGCGGCATTCAACAGATTGGGGTGACGTACGACAATGAAGGTGAGTTCTACACAGCCTATCCGCAAAACGCATTGAATACCAAGTACCTGTACCACCGTACGGTTACCGGTGACTATGCCAAACGCGAAGGGGTCAACAACCTGATCTATCCGAACTACTACTCTCGCCCAGTGGGTGGTGTGGTTAAACGGATCATGGCGATGTGTAACACTCCCCGCATCAATATCACCGGCACGGCTACCCAGATTTCCAAATATGGATTGAACCTGGGATGGACTGGATTTGGTATGGGTCCTGAGGAACGTTTCTGGCGTCGTACCCAGAACTCGAACTGGACACCGGGAACGAACGATAATGACATCATGCTGGTCACGGCACACAACAAGCGTGACAACGGCGACGGTACCATATCGTTGATTCCAACCAAACAGGTGCTCTGGCCTGCGGCCATTGTCAATCAGTTAAAGAACCTGATTCCTGCAGCGTACCGCAGCTCTCCGGATATCGCAGTCAGTATCATTGACTTCAGTGATGGTCCGGAAGGTAAGTTCGGCAGCTTCCCGGCAATCGTCCAGATTTATTATGTGGACGTTTCTCGTGCTATGGCACGTCAGATGTTCTTAACCGTTCGTCCGACGTACAGTGCGCCGTCAGGGATTCGCCGTACGGTAACAGGTTACACCATTCTGGGGTCATTGGACGTTGACGTCATGGGCAGCCAAACCGACGTCTCAACGTGGCAACCGTATTTTGTGGGTGGGGTAAACGGTAGTGTAGCGAAAGCCGATATCTACCTGAATGATGACGGCACCATGGAAGTGGACATTTGTTCAGGGGTCGCGTCACAGCATGCTGGTAACAACAGTATGGCGTGTGCACGTTTCACCATTAACAAGTCCACGGGTCAGTTGGTTGGCGGTATTCCGTATAACTATCAGGAAGCTATGCAGTCTGGTCGTCATGCGGTACCGAAGGTTGGGATTGGACAGAACGTGTTCTGGGGAACCGGCAGTGGCGGGTCTGCGTTGATTAACGGTGCAGGCGGTAACTACTACATGCTGGCATCATGTTATCCAGAATCCGGATGGGTGGTCTACTTCCAGAAAGCTCAGGAAGTGGTGTTTAACGGCACGTCGTATACTCTGCCGCAAGGTACCATTGACTTGCGTGATATTGAGCCGAGCCCTGGGAATAAAACTTTCTACCTTTACTGTGAGGTGAAAGAGAACAAGGCCGCGTATCAAATCAGTACGCAGAAGCTGGAAGATACACCGTTCCACATGTGGATTGGTATTATCCGTACCAACGAGAAACAAATCCTCACCATTGATCGTTTCAACGTCTTTACCTTGAACGGTCAGCGTGTGTCGGAGACACGTCGTGGTTCTGCACTGCCAGCCTCTTCTGGTGCAATTAACAGTCTGGGTCAGATTCCGTGGCTGAAACCTTCTGAGATTATTCAGGGTTAA
Genome Context
Tertiary structure
ASU03816.1
ESMFold2 structure
Source
ESMFold2
pLDDT
48.4
Oligomeric state
monomer