Genbank accession
QMV29934.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,52
Seq2Symm
C3 confidence 0,367 truncated
C3 0,367
C1 0,203
C2 0,031
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MGKAKKITVGFKYFMGLFMGVCRGPVNAITEIRVGGRTAWKGEITNNRTLDIDAPELFGGTKAEGGVQGPLEIYMGAPTQTISQRLKNMLGGLQPEYRGVLTMYFDGMVSAMSPYPKDWTFKMWRTTAGWIDGVWYAEKCTIEMEGYDGEGGKHIIKAMNPAHILYESQTNYEWGRGLDRSLMDEVAFRRVADTLFDENFGLCIRWARQDTLESFIQMVLDHIGGVMYVSKITGKYTIKLIRDDFVAEDLPIFDANSGLLSIEEATNASPASMINEVIVEYLNPIINETQQVRSHNLAQIQNQGSLNSVTTTYVGAPTGKLAMQLAQRDLRVASTNVRRFSLILDRRAWSIQPADVFKIRDPNTRGISEVIVRVGSVEDGTLPDGKIKIVALQDQFAFRLNTFNQVQPPDGYKPDLAPALARRVVYEMPYIDMVQQIPEGEFNTISPNETFVNSQAEKPTPMSAAYDMGMKADGEAEYDVRGNGDFGAMAELSMAADYLDTVFTVRDMTEEWEDVVPGNIARIAKPFVRGDESPMDLSEEFVEIVSVNGNQITVKRGVIDTIPFRHQVGELLWVTTMDGGSDWQRYGGAEAIDVKILPWTLGGGRFKIEDAPVDHLQFNFRQTRPYAPGRATHTLLSEPTVRNWFMPTNLTATANSGETPDVLTLNWAHRDRVLQADKPVGHVEPSIGPEPGTSYTIEVFDGTGGLVRTESGITGTSWVWPYETAAADVNVEASQFESVLATVRLTAVRSGFRSWEYYDYRVEVFKKPPQYVYDASLMHQAVQPYNVNSDPNPTPSTDGPAVASFMQAVAQPYNEASDPNPTPSMSGPTIALMPHQVTQESSMISPLDTLLFETPYLQLVRDGEPTDVSTVSAYVARSSDRTVDSYTLFTKHQADANYFDAGVQPWTPWGMTAEGIGFFNDEIVLDLTSDKDGVPLTPVNVGDLLLIDRELLSVKAVDGKRYTVGRGCADTIPAQHYSQRPVWLISTGHGYSRMPFGDTEKAMVIVRPDTYGTQIPLNKIYPKQLEMQYRPKRPYPPGMMMIGGVPFFNRARGLADDFDPYKNLKARDVLVTYAHRNRISQGTTVRDHFAVGINPEPGMHYRVRIGYGYFVPFSGYSFKLLKEFTTEDAGFTIAAADIERWGLQAGRAQQSAGWSVLTVSVNAERDGMLNWQGYEMQFSAPSYPLPPGEKPGGNNGGGNNGGGTTPPVEPPDRPDPSNPGGGGGDGPDEPKPPVDPVDPENPDTDPPLPPDPEPDPGPMPGWSISWDHGWATTLPDQRYVPEDTDNA
Physico‐chemical
properties
protein length:1287 AA
molecular weight: 142307,39710 Da
isoelectric point:4,83446
aromaticity:0,09713
hydropathy:-0,39759

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QMV29934.1 [NCBI]
Genbank nucleotide accession
MT675124 [NCBI]
CDS location
range 28982 -> 32845
strand +
CDS
ATGGGTAAGGCCAAGAAAATCACGGTCGGCTTTAAATACTTCATGGGGTTATTCATGGGTGTTTGTCGCGGCCCGGTTAACGCTATTACGGAAATTCGAGTTGGCGGCCGTACTGCGTGGAAAGGCGAGATCACAAATAACCGGACTCTCGATATCGATGCGCCAGAATTATTCGGTGGCACCAAAGCAGAGGGCGGCGTGCAAGGCCCGTTAGAGATTTACATGGGCGCGCCAACCCAAACCATTAGCCAACGACTGAAAAACATGCTGGGCGGGCTACAACCCGAATACCGTGGCGTGCTAACGATGTATTTCGATGGCATGGTCAGTGCGATGAGCCCATACCCGAAAGATTGGACATTCAAGATGTGGCGTACGACTGCCGGTTGGATCGACGGCGTTTGGTATGCGGAGAAATGTACTATCGAAATGGAAGGGTATGACGGCGAGGGCGGCAAGCACATTATTAAAGCGATGAACCCGGCTCACATCCTATATGAATCCCAGACAAACTATGAATGGGGGAGGGGGTTAGACCGCAGCTTAATGGATGAGGTCGCATTCCGTCGCGTGGCCGATACCCTATTCGATGAGAATTTCGGGTTATGCATTCGTTGGGCTCGACAGGACACGCTCGAATCTTTCATTCAGATGGTACTCGATCACATCGGCGGCGTGATGTACGTCAGCAAGATCACCGGTAAATACACGATTAAACTTATTCGTGACGACTTTGTGGCCGAAGACCTGCCGATATTCGATGCCAACTCGGGATTGCTGTCAATCGAAGAAGCGACTAACGCCTCGCCTGCATCAATGATTAATGAAGTAATCGTGGAATACCTTAACCCGATTATTAACGAAACTCAGCAGGTGCGTAGCCATAACTTAGCGCAGATCCAGAACCAAGGCAGTCTGAATAGCGTCACCACAACATACGTCGGCGCTCCGACAGGCAAGTTGGCCATGCAGCTAGCGCAACGTGATTTACGTGTGGCGTCGACCAACGTTCGCCGTTTCTCCTTGATTCTCGACCGACGCGCATGGTCAATTCAACCGGCTGACGTGTTTAAAATTCGTGACCCGAATACACGCGGTATTTCCGAAGTCATCGTACGAGTCGGATCGGTTGAGGATGGAACACTGCCTGACGGGAAAATCAAGATAGTCGCGCTGCAAGACCAATTTGCGTTCCGCTTGAATACGTTCAATCAGGTTCAACCGCCTGACGGCTACAAACCAGACTTAGCACCTGCATTGGCCAGACGAGTCGTTTATGAAATGCCGTACATCGACATGGTACAGCAAATCCCAGAGGGCGAGTTCAACACGATCAGCCCGAATGAAACGTTCGTCAACTCACAAGCAGAGAAACCGACACCTATGTCTGCCGCGTATGACATGGGTATGAAAGCTGACGGGGAAGCAGAATACGACGTACGCGGTAACGGTGACTTTGGCGCAATGGCCGAACTATCGATGGCCGCTGATTACCTCGATACGGTATTCACGGTGCGCGACATGACCGAAGAGTGGGAAGACGTTGTGCCAGGGAATATCGCTCGTATCGCTAAACCGTTCGTACGTGGCGATGAAAGCCCGATGGATCTGTCAGAAGAGTTCGTGGAAATCGTCAGCGTAAACGGAAACCAAATCACGGTTAAACGCGGTGTCATCGATACAATCCCATTTCGTCATCAAGTTGGCGAGCTATTGTGGGTTACAACGATGGACGGCGGATCTGACTGGCAGCGCTACGGTGGTGCAGAGGCAATCGACGTTAAAATCCTACCGTGGACACTCGGGGGCGGCCGCTTCAAGATCGAGGACGCACCGGTAGACCATTTGCAGTTTAATTTCCGCCAAACGCGCCCATATGCCCCAGGGCGAGCAACGCATACCCTTTTATCGGAACCAACCGTACGCAACTGGTTTATGCCTACCAACCTGACGGCCACAGCGAACTCCGGTGAAACACCAGACGTTCTGACGCTAAACTGGGCGCACCGTGACCGCGTATTACAAGCAGATAAACCGGTTGGCCATGTTGAACCGTCTATCGGCCCAGAGCCGGGCACGTCTTACACGATTGAAGTTTTCGACGGTACTGGCGGTTTGGTTCGTACGGAATCCGGTATTACTGGAACTTCTTGGGTATGGCCATACGAAACCGCAGCAGCAGACGTGAATGTCGAGGCTAGCCAATTCGAGTCAGTGTTGGCCACGGTAAGATTAACGGCCGTTAGAAGTGGTTTCCGGTCATGGGAGTATTACGACTACCGCGTTGAAGTGTTTAAGAAGCCACCGCAGTACGTGTATGACGCGAGTTTAATGCATCAAGCCGTTCAGCCATATAACGTGAATAGCGACCCTAACCCGACACCGAGTACAGATGGCCCCGCCGTAGCGTCGTTTATGCAGGCAGTCGCACAACCGTACAACGAGGCTAGCGATCCGAACCCAACCCCGAGTATGAGCGGGCCAACTATCGCATTGATGCCGCACCAAGTTACACAGGAAAGCTCGATGATTTCTCCATTGGACACGCTGTTATTCGAAACGCCATACCTGCAATTGGTTCGTGATGGTGAGCCGACAGACGTTTCAACGGTGAGTGCATATGTTGCTCGCTCGTCGGATCGTACGGTCGACAGCTATACGCTTTTCACGAAACACCAAGCAGACGCGAACTACTTCGATGCGGGTGTGCAGCCGTGGACGCCTTGGGGTATGACCGCTGAGGGGATTGGCTTCTTTAACGATGAAATCGTGTTAGACCTTACCTCCGATAAAGATGGCGTGCCTCTCACTCCGGTTAACGTGGGCGACCTGTTACTTATCGACAGAGAGCTATTATCGGTCAAAGCGGTAGACGGCAAACGCTATACGGTCGGTCGTGGTTGTGCGGATACCATCCCAGCGCAGCACTACAGCCAACGCCCTGTCTGGTTAATCTCAACTGGTCATGGCTACTCACGCATGCCATTCGGTGATACTGAAAAAGCGATGGTCATCGTGCGCCCTGATACATATGGCACACAGATACCGCTTAATAAGATCTATCCGAAGCAACTGGAAATGCAATACCGTCCGAAACGTCCATACCCACCGGGAATGATGATGATTGGCGGTGTGCCATTCTTCAACCGTGCAAGAGGGCTGGCGGATGACTTCGATCCGTACAAGAACTTGAAAGCGCGCGATGTGTTGGTAACGTATGCCCACCGCAACCGTATATCGCAAGGCACAACCGTACGTGACCACTTTGCCGTCGGGATTAACCCTGAGCCAGGCATGCATTATCGCGTTCGTATCGGGTATGGCTATTTCGTACCGTTTAGCGGTTATTCGTTTAAACTGTTAAAAGAGTTCACCACGGAAGACGCGGGCTTTACGATTGCGGCCGCTGATATCGAACGTTGGGGATTACAGGCCGGACGTGCTCAGCAGTCAGCCGGTTGGTCAGTATTAACAGTTAGTGTTAACGCCGAACGCGATGGGATGCTAAACTGGCAAGGTTACGAAATGCAGTTCTCGGCACCGTCCTACCCGTTACCACCGGGAGAGAAGCCGGGCGGGAATAACGGGGGTGGGAACAATGGCGGCGGAACTACTCCACCGGTTGAGCCACCAGACAGGCCAGACCCGAGCAACCCAGGTGGCGGTGGAGGCGATGGCCCAGATGAGCCAAAACCACCGGTTGACCCAGTCGACCCCGAGAACCCAGATACGGATCCGCCATTACCGCCTGACCCAGAACCAGACCCAGGGCCGATGCCTGGATGGTCAATAAGTTGGGATCACGGATGGGCGACCACTTTACCAGATCAACGATACGTACCAGAGGATACAGATAATGCCTAA

Genome Context

Tertiary structure

QMV29934.1
ESMFold2 structure
Source ESMFold2
pLDDT 70.3
Oligomeric state monomer