Genbank accession
ASU03816.1 [GenBank]
Protein name
putative virion structural protein
RBP type
TSP
Evidence RBPdetect2
Probability 0,75
Seq2Symm
C1 confidence 0,454 truncated
C1 0,454
C3 0,150
I 0,025
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MTMNFPIVQQYKFDIDGTNPENKITDEPIKTPAGIWNRIIVPVNGPFFVDTLVLTLPNGKPLVEEVDYRIFRMMGKLSEFCARDVACIIELIKPEITDVFATYHTVGETTLFDRSMLLLIMDAVNDDRPVWWENVLNKPVAFPPILHGHSLIYEMVAFQDMVSMIDELLDFLNDGHRDLLELKIDHLSTLIDWYISLYTQTLTKYLERHEASYNAHGLTAAQAGADLIDNFPTATLTQSLQGERSDLVIKPAGLKALMQEYGYNSDFFLETNIIPLSRYGARSFIPPSIDGNFEGLGAEVETTGICMESDGSLSILSNHWDGRTEGLYFSTCPNYQVKVERIFTGFKYTHQKIIANGQEVTRVIGGTNHEVIMVGRPGTPNWFVGLSKGTLNPSKHILSKVNMKPINDAIGNPNGQNYNSHDKLSVHLMGNWVYLIQTYSGPLGENGSKRLFRVPRASVEAGLDVTPTPIKITYKNWDGKQYNSVDEFIWGSPTFDSNNAATRYLFNFNPAVPTATTGGLYRAAVTLSCAIPNKANTYVLKFMSHFWIPYIAGNVSTAIDCSPELVYEFNPDTGVMTLISKSDEPGVVDMTKGNVSVNTLNENSNGLIVANWSRQAAVVLPNGDVVFGGSSLYSYPHYLYIYKTGQRTPYETMKLWWSRRNFPASGYASATEIPVSPIVSGIQQIGVTYDNEGEFYTAYPQNALNTKYLYHRTVTGDYAKREGVNNLIYPNYYSRPVGGVVKRIMAMCNTPRINITGTATQISKYGLNLGWTGFGMGPEERFWRRTQNSNWTPGTNDNDIMLVTAHNKRDNGDGTISLIPTKQVLWPAAIVNQLKNLIPAAYRSSPDIAVSIIDFSDGPEGKFGSFPAIVQIYYVDVSRAMARQMFLTVRPTYSAPSGIRRTVTGYTILGSLDVDVMGSQTDVSTWQPYFVGGVNGSVAKADIYLNDDGTMEVDICSGVASQHAGNNSMACARFTINKSTGQLVGGIPYNYQEAMQSGRHAVPKVGIGQNVFWGTGSGGSALINGAGGNYYMLASCYPESGWVVYFQKAQEVVFNGTSYTLPQGTIDLRDIEPSPGNKTFYLYCEVKENKAAYQISTQKLEDTPFHMWIGIIRTNEKQILTIDRFNVFTLNGQRVSETRRGSALPASSGAINSLGQIPWLKPSEIIQG
Physico‐chemical
properties
protein length:1168 AA
molecular weight: 129468,17310 Da
isoelectric point:5,86416
aromaticity:0,10788
hydropathy:-0,20445

Taxonomy

Coding sequence (CDS)

Genbank protein accession
ASU03816.1 [NCBI]
Genbank nucleotide accession
MF459647 [NCBI]
CDS location
range 99874 -> 103380
strand +
CDS
TTGACCATGAATTTCCCCATTGTACAACAATATAAGTTTGATATTGATGGGACCAACCCTGAGAACAAAATCACTGACGAACCCATCAAAACCCCAGCCGGTATTTGGAACCGCATTATTGTTCCGGTAAACGGTCCGTTCTTTGTTGACACCCTGGTGCTGACACTGCCTAACGGTAAACCGCTGGTAGAAGAGGTTGATTATCGCATCTTCCGTATGATGGGGAAACTGTCGGAGTTCTGTGCCAGGGATGTGGCCTGCATCATTGAACTGATTAAGCCGGAAATTACTGACGTCTTTGCTACCTACCATACCGTAGGGGAAACCACCCTGTTTGACCGCAGCATGCTGCTATTGATTATGGACGCCGTCAATGACGACCGTCCGGTGTGGTGGGAGAACGTCCTGAACAAACCGGTGGCTTTCCCGCCGATTCTGCACGGTCACAGTTTGATTTATGAAATGGTGGCCTTCCAGGACATGGTGTCGATGATCGACGAGTTGTTGGATTTCCTCAACGACGGACACCGTGATTTGCTGGAGCTCAAAATCGACCACCTGAGCACGCTGATTGATTGGTACATCAGCCTGTATACCCAAACCCTGACGAAGTACCTGGAGCGTCATGAAGCGTCTTACAACGCCCATGGGTTAACAGCTGCACAGGCCGGTGCCGATTTAATCGACAACTTCCCAACGGCTACCTTAACCCAATCGTTACAGGGTGAACGGTCTGACCTGGTCATTAAACCAGCGGGATTAAAAGCACTGATGCAGGAGTACGGTTACAACAGTGACTTCTTCCTGGAAACCAACATCATTCCGCTTTCCCGTTACGGTGCGCGTAGCTTCATCCCGCCTTCTATTGACGGTAACTTCGAAGGTCTGGGGGCGGAAGTTGAAACCACCGGTATCTGCATGGAATCCGACGGGTCATTGAGTATCTTGAGCAACCACTGGGATGGACGTACCGAAGGCTTGTACTTTAGCACCTGTCCAAACTATCAGGTAAAGGTGGAACGTATCTTCACCGGCTTTAAATACACACATCAGAAAATCATTGCCAACGGTCAGGAAGTCACCCGTGTTATTGGTGGCACTAACCATGAAGTGATTATGGTGGGGCGTCCAGGTACACCGAACTGGTTTGTGGGGTTAAGTAAAGGTACGTTGAACCCGTCGAAGCATATTCTCTCTAAAGTGAATATGAAACCGATTAACGATGCCATTGGTAACCCTAACGGCCAGAACTACAACAGCCACGATAAGCTGTCTGTGCACCTCATGGGGAATTGGGTTTACCTTATCCAGACTTACAGTGGTCCGTTAGGCGAAAACGGCAGCAAGCGGCTTTTCCGGGTTCCTCGTGCATCGGTAGAAGCAGGTCTTGATGTAACGCCTACACCGATTAAAATCACGTACAAGAACTGGGACGGTAAACAGTACAACAGTGTTGATGAGTTCATCTGGGGTTCTCCAACGTTCGACAGTAACAATGCCGCAACGCGTTACCTGTTTAACTTTAACCCAGCTGTTCCGACTGCCACTACGGGTGGACTGTACCGTGCTGCAGTTACCCTTTCCTGTGCCATTCCGAACAAAGCCAACACCTATGTGCTGAAGTTCATGAGTCACTTTTGGATTCCGTATATTGCCGGTAACGTCTCCACCGCTATCGATTGCTCTCCAGAACTGGTATACGAATTTAATCCGGACACCGGGGTAATGACGTTAATCAGTAAGAGCGATGAACCCGGTGTTGTGGACATGACGAAAGGCAACGTTTCAGTCAACACCCTTAACGAAAACTCCAACGGGTTAATCGTTGCTAACTGGTCTCGTCAGGCTGCAGTGGTGTTGCCCAATGGCGATGTGGTGTTTGGGGGGAGTTCACTTTATTCGTACCCGCACTACCTCTACATTTACAAAACCGGCCAACGTACACCGTATGAAACCATGAAGCTATGGTGGTCACGTCGTAACTTCCCGGCGTCGGGATATGCAAGTGCGACTGAAATACCGGTGTCACCTATTGTGAGCGGCATTCAACAGATTGGGGTGACGTACGACAATGAAGGTGAGTTCTACACAGCCTATCCGCAAAACGCATTGAATACCAAGTACCTGTACCACCGTACGGTTACCGGTGACTATGCCAAACGCGAAGGGGTCAACAACCTGATCTATCCGAACTACTACTCTCGCCCAGTGGGTGGTGTGGTTAAACGGATCATGGCGATGTGTAACACTCCCCGCATCAATATCACCGGCACGGCTACCCAGATTTCCAAATATGGATTGAACCTGGGATGGACTGGATTTGGTATGGGTCCTGAGGAACGTTTCTGGCGTCGTACCCAGAACTCGAACTGGACACCGGGAACGAACGATAATGACATCATGCTGGTCACGGCACACAACAAGCGTGACAACGGCGACGGTACCATATCGTTGATTCCAACCAAACAGGTGCTCTGGCCTGCGGCCATTGTCAATCAGTTAAAGAACCTGATTCCTGCAGCGTACCGCAGCTCTCCGGATATCGCAGTCAGTATCATTGACTTCAGTGATGGTCCGGAAGGTAAGTTCGGCAGCTTCCCGGCAATCGTCCAGATTTATTATGTGGACGTTTCTCGTGCTATGGCACGTCAGATGTTCTTAACCGTTCGTCCGACGTACAGTGCGCCGTCAGGGATTCGCCGTACGGTAACAGGTTACACCATTCTGGGGTCATTGGACGTTGACGTCATGGGCAGCCAAACCGACGTCTCAACGTGGCAACCGTATTTTGTGGGTGGGGTAAACGGTAGTGTAGCGAAAGCCGATATCTACCTGAATGATGACGGCACCATGGAAGTGGACATTTGTTCAGGGGTCGCGTCACAGCATGCTGGTAACAACAGTATGGCGTGTGCACGTTTCACCATTAACAAGTCCACGGGTCAGTTGGTTGGCGGTATTCCGTATAACTATCAGGAAGCTATGCAGTCTGGTCGTCATGCGGTACCGAAGGTTGGGATTGGACAGAACGTGTTCTGGGGAACCGGCAGTGGCGGGTCTGCGTTGATTAACGGTGCAGGCGGTAACTACTACATGCTGGCATCATGTTATCCAGAATCCGGATGGGTGGTCTACTTCCAGAAAGCTCAGGAAGTGGTGTTTAACGGCACGTCGTATACTCTGCCGCAAGGTACCATTGACTTGCGTGATATTGAGCCGAGCCCTGGGAATAAAACTTTCTACCTTTACTGTGAGGTGAAAGAGAACAAGGCCGCGTATCAAATCAGTACGCAGAAGCTGGAAGATACACCGTTCCACATGTGGATTGGTATTATCCGTACCAACGAGAAACAAATCCTCACCATTGATCGTTTCAACGTCTTTACCTTGAACGGTCAGCGTGTGTCGGAGACACGTCGTGGTTCTGCACTGCCAGCCTCTTCTGGTGCAATTAACAGTCTGGGTCAGATTCCGTGGCTGAAACCTTCTGAGATTATTCAGGGTTAA

Genome Context

Tertiary structure

ASU03816.1
ESMFold2 structure
Source ESMFold2
pLDDT 48.4
Oligomeric state monomer