Genbank accession
APL99377.1 [GenBank]
Protein name
virion structural protein
RBP type
TF
Evidence RBPdetect2
Probability 0,63
Seq2Symm
C1 confidence 0,842
C1 0,842
C3 0,127
C2 0,016
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MVLCHGPVDRLQRIDVDDRTAWAGFNQGGRININNPNLFGGESREGGVSGPVDIMMGETGQGKNDYLVAKLGAQVPSFRGVVSAVLRQCYLGMNPYLKPWSFRVQRILKRGGGQAQWYPTKASIGTVNRAALYFALDVSNSMAGERLANLKTAITSVLEAFLGVGPSSQMDIRVVAFGETSTSITRYNVGTSDIQDIINWVNSRTVTGGTNYATGMGGAPTFFANTGSKPRYVFFMTDGEPFPTSSAADAVAIRDGLPPTEVYCFNIDLADTTYTGMLDNTPRDGVPIVPGGDPAPLANAVMSALFVQLDMNPAHIIRECLTDTEWGMGYLEADLDDVSFRAAADRLHQEQMGMSLLWTKQTEIEEFIKEVLKHINAVVRVNRRTGKFELKLIRDDYDEETLLELNPGNIERLTDFSRPSFGELVNSVTVNYWDPVTGGDASLTVQDIALSEAQRAVVNTTLQYPGFTNNILASRVAERDLRTLSSPLVSCVIYTDTIAKDLGVGDVFKLVWPDYLIAGMVMRVTQIAYGNGRSNKIKITCTQDVFALPETVAFEPEPPVWVDPDGPPVAVQNRLAQEMPYYELVQRVGQTGIQAELDNNPEMGYVMVSGVRPNTAAISARLASDGGSGLFEDIKSIDFSPGATLASPVSRGDTVFVIQDGVDLDLVSPGTWAYIGTEMVAVVAVDSQQGLLQVQRAILDTVPVEHEAGELIIFADEYAENDETEYVQSDTVQVSILTVTGQGTLPLGSAPVDTVEINARAVRPYRPGNVRLNGELYPQEDGFPSYPLNLTWSHRNRILETVPTFTSWSDGNVTLEPGVSYRIDVYALDENKQEVGFVGSIPKAGTETSAQVDGSMIESAFPGSPWARVEVWATRDGWDSWQSAQFVVRGPLMPPSALQAQYVSPTPPGITGFSVTP
Physico‐chemical
properties
protein length:917 AA
molecular weight: 99737,13890 Da
isoelectric point:4,55777
aromaticity:0,08506
hydropathy:-0,13272

Taxonomy

Coding sequence (CDS)

Genbank protein accession
APL99377.1 [NCBI]
Genbank nucleotide accession
KY000220 [NCBI]
CDS location
range 56037 -> 58790
strand +
CDS
ATGGTCCTCTGTCACGGGCCGGTGGACCGGCTCCAGCGGATCGACGTGGACGACCGAACCGCCTGGGCGGGCTTCAACCAGGGCGGTCGGATCAACATCAACAACCCCAACCTGTTCGGCGGGGAAAGCCGCGAAGGCGGCGTGTCTGGTCCCGTGGACATAATGATGGGGGAAACCGGCCAAGGCAAGAATGATTACTTGGTCGCCAAGCTGGGTGCCCAAGTCCCGTCCTTCCGGGGCGTAGTGTCCGCGGTCCTGCGACAGTGCTACCTGGGCATGAACCCGTACCTGAAGCCTTGGTCCTTCCGCGTCCAGCGTATCCTGAAGCGCGGCGGAGGACAGGCGCAGTGGTATCCCACGAAAGCGTCTATTGGGACCGTCAACCGCGCCGCGCTGTATTTTGCCCTGGACGTGTCGAACTCTATGGCGGGGGAACGCCTCGCAAACCTCAAGACGGCCATCACGTCCGTACTGGAAGCCTTTTTGGGCGTGGGTCCCTCCTCCCAGATGGATATACGGGTTGTTGCCTTCGGGGAAACCTCCACGAGCATCACCCGCTACAACGTGGGCACCAGCGACATCCAGGATATCATCAACTGGGTGAACTCCCGGACGGTTACGGGAGGGACAAACTACGCCACCGGCATGGGCGGAGCGCCCACCTTCTTCGCCAACACCGGAAGTAAACCCCGGTACGTGTTCTTCATGACGGACGGGGAACCCTTCCCGACCTCCAGCGCGGCGGACGCGGTGGCAATCCGGGACGGGCTCCCGCCCACGGAAGTCTATTGCTTCAACATCGACCTCGCCGACACTACCTACACGGGGATGCTGGACAATACCCCGCGGGACGGGGTGCCCATCGTTCCCGGGGGCGACCCCGCCCCGCTCGCCAACGCCGTCATGTCGGCGCTGTTCGTTCAGTTGGATATGAACCCCGCCCACATAATCCGCGAGTGCTTGACGGACACGGAATGGGGGATGGGCTACTTGGAGGCCGACCTGGATGACGTTTCGTTCCGGGCCGCGGCGGATCGGCTCCACCAGGAGCAGATGGGGATGAGTCTGCTGTGGACGAAGCAGACGGAGATTGAGGAGTTCATCAAGGAGGTCCTGAAGCATATCAACGCCGTGGTCCGGGTCAACCGCCGCACGGGCAAGTTCGAGCTGAAGTTGATCCGGGACGACTACGATGAAGAAACCCTCCTGGAGCTGAACCCGGGTAATATCGAGCGCCTGACGGACTTCTCCCGCCCGTCCTTCGGGGAGCTGGTCAACTCCGTGACGGTCAATTACTGGGACCCGGTCACCGGGGGCGACGCCTCCCTGACGGTCCAGGACATCGCCTTGTCGGAGGCCCAGCGCGCGGTGGTGAACACCACGCTCCAATACCCGGGCTTCACGAACAACATATTGGCGTCCCGGGTCGCGGAGCGGGACCTGCGGACGTTGTCCAGCCCCCTGGTGAGCTGCGTGATCTACACGGACACCATCGCCAAAGACCTGGGCGTGGGGGACGTGTTCAAGCTGGTTTGGCCGGACTACCTGATTGCCGGTATGGTGATGCGCGTCACCCAGATCGCCTACGGCAACGGACGCAGCAACAAGATCAAGATCACTTGTACCCAGGACGTGTTCGCGCTGCCGGAGACGGTCGCGTTTGAGCCTGAGCCGCCGGTCTGGGTTGACCCGGACGGCCCCCCGGTGGCCGTTCAGAACCGGCTCGCTCAGGAAATGCCCTATTATGAATTGGTCCAAAGGGTCGGACAAACGGGCATACAGGCGGAGCTGGACAACAACCCTGAGATGGGTTATGTCATGGTATCCGGGGTCCGCCCGAACACGGCGGCCATTTCCGCTCGCTTGGCCTCTGACGGGGGTTCCGGCCTGTTCGAGGACATCAAGTCTATTGACTTCAGCCCCGGGGCCACGCTCGCCTCCCCGGTATCCCGCGGTGACACCGTGTTCGTCATTCAAGATGGCGTGGACCTTGACTTGGTGAGCCCGGGAACTTGGGCGTACATCGGGACGGAAATGGTGGCCGTGGTGGCCGTGGACTCCCAACAAGGGCTTCTCCAGGTTCAGCGCGCCATACTGGACACTGTGCCCGTAGAACACGAAGCTGGGGAATTGATCATATTCGCGGATGAGTACGCGGAGAACGACGAAACGGAATATGTACAATCCGACACGGTCCAGGTATCCATCCTGACGGTCACCGGACAAGGAACCCTGCCCCTGGGCTCCGCTCCAGTTGATACCGTTGAAATCAACGCGCGGGCGGTTCGCCCCTACCGCCCGGGCAACGTCCGCCTGAACGGGGAGCTGTACCCGCAAGAGGATGGTTTCCCCAGCTACCCCCTGAACCTGACTTGGTCTCATCGCAATCGGATTCTTGAGACCGTCCCAACCTTCACTTCCTGGAGTGACGGGAATGTGACTCTGGAGCCGGGGGTGAGCTATCGGATCGACGTGTATGCCCTGGACGAAAACAAGCAGGAGGTCGGTTTTGTCGGGTCGATTCCCAAGGCGGGGACGGAAACAAGCGCCCAGGTGGACGGCTCCATGATAGAAAGCGCCTTCCCCGGGAGCCCCTGGGCGAGGGTCGAGGTTTGGGCCACACGGGACGGTTGGGATTCTTGGCAATCCGCCCAGTTCGTCGTGCGCGGGCCGTTGATGCCTCCGTCCGCCCTTCAGGCCCAATACGTCAGCCCGACGCCCCCGGGAATCACCGGATTCTCCGTGACACCTTGA

Genome Context

Tertiary structure

APL99377.1
ESMFold2 structure
Source ESMFold2
pLDDT 85.6
Oligomeric state monomer