Genbank accession
XQP09632.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,53
Seq2Symm
C1 confidence 0,998
C1 0,998
C2 0,005
C3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MYPIPLFMSTTSASVVTATSITTSSIGIAIVGSKKQLTYTVSPEDGALFDIAFSSSDNTKMVIDNNGMMEFVAEGGFDAIMTAKNNLGAVLTDQSGGYASELSVYTESLSAMDAGTTQQLVATISPEGAKDLPDMVITYTTTDPEVATVSPTGLITALKDGSCRIGCTATYQGTVVASDSSYLGVNAVPVISNVTAVANSYGDIRVAWDVADPLDGDTYTVEVLDLSNNSVQWTTTTTNTYAYFDISDSIPLYGFAPTYLKISVKSTKAAAVIFNNSIATDDSFIKEVIVFAGQDNVNAHFTELSGANKAAMSSTTARNAYATQRGLANAEVLPLNTASGSSAADKYADDKAGTGTPDNYWYDLDNTADGPCLTNFITKVTPYASKVKAIIWGQGENDAVSASSTVAGRYSNTTRYHDATIAIFDKMRTIVPASQAKIVWQILGRSYLYGVEVNGVDWQKYRNVQRTISTARDDVIIGSWVDGAERYSGYVYEEGIDGRIHYISSVYQTAATKLAKSAADGTDLTSTSPVWVDMAVPTGATATSQPNQDTILAWDAQGYSKHYFRNINVLTASVLTEQTLNTNSYTFTYADQVEQYGFAAGTTIFDVAYYDEANDVLSPLVRFNVSVTAGKVEDKPVVMDYDLTQETLPSDVKVNGGNSFARASGDTLVATNTLVAPLEYVGTTPVGRRVTANTATQIFVNNALTSASPWVKTNLTVAASSDKSPAGTTANVFKLTPTTTSGSHILTATYTNAYNISAGRNWSASVFLKANGITKAKLRLKAGTEVNEGTFDLAAGTFTGSEANIISMGNGWYRAILHKTGIAKQSSISFEIIALDATGAEIFAGDGTSNLAVWLPQLEGASTGETSKAGSPYVCTYPGNLGGVSFTIPRNGHTGVDVYYSNGDVVRDVFSGTASTWTINYSSLYDWGSVFITGLKYYD
Physico‐chemical
properties
protein length:939 AA
molecular weight: 99803,59150 Da
isoelectric point:4,63973
aromaticity:0,09798
hydropathy:-0,07465

Taxonomy

Coding sequence (CDS)

Genbank protein accession
XQP09632.1 [NCBI]
Genbank nucleotide accession
PV159336 [NCBI]
CDS location
range 90415 -> 93234
strand +
CDS
ATGTATCCTATTCCTTTATTTATGTCAACAACATCAGCTTCAGTAGTAACAGCTACATCTATAACCACTTCCTCTATTGGTATTGCAATAGTTGGTAGTAAAAAGCAACTGACATACACAGTTTCACCGGAAGATGGTGCGTTATTTGATATAGCTTTTTCATCTTCAGATAATACCAAAATGGTTATAGATAATAACGGTATGATGGAGTTTGTTGCTGAAGGCGGTTTTGATGCAATAATGACAGCTAAAAATAATTTAGGTGCTGTCTTAACTGATCAGTCTGGTGGCTATGCTTCAGAATTAAGTGTGTACACTGAAAGTCTGTCTGCTATGGATGCAGGAACTACTCAACAATTGGTTGCTACAATCAGTCCAGAAGGTGCTAAAGACCTTCCAGACATGGTAATTACGTACACCACAACAGATCCAGAAGTAGCTACTGTAAGCCCTACAGGATTAATAACTGCTCTTAAAGATGGCAGTTGCCGTATAGGTTGCACTGCAACTTATCAAGGAACAGTGGTGGCCTCTGATAGTTCTTATTTAGGTGTTAATGCTGTTCCTGTTATTTCTAATGTAACAGCCGTGGCAAACAGCTATGGAGACATTCGTGTTGCTTGGGATGTAGCTGATCCGCTAGATGGTGATACTTATACTGTAGAAGTATTAGATTTAAGTAATAACAGTGTCCAGTGGACTACAACAACCACGAATACTTACGCCTACTTTGATATCTCTGACTCTATTCCTCTTTATGGGTTTGCTCCAACATACCTTAAAATTAGCGTTAAGAGCACCAAAGCAGCAGCCGTTATCTTTAATAACTCAATAGCTACAGATGATTCATTCATTAAAGAAGTTATTGTCTTTGCTGGACAAGATAACGTAAATGCACACTTTACAGAACTATCTGGTGCAAATAAAGCAGCAATGAGTAGCACAACAGCCCGTAATGCATATGCTACGCAACGTGGTTTAGCAAATGCTGAAGTTCTCCCGTTAAATACAGCTTCTGGATCATCAGCAGCAGATAAATATGCAGATGATAAAGCCGGAACAGGTACACCAGACAACTACTGGTATGATCTGGATAACACAGCAGATGGGCCATGCTTAACTAACTTTATCACTAAAGTCACACCTTATGCAAGTAAGGTTAAAGCAATTATTTGGGGACAAGGTGAAAATGATGCTGTATCAGCATCTTCGACTGTTGCAGGAAGATACAGTAACACTACACGTTACCATGATGCTACGATAGCTATCTTTGATAAGATGCGTACAATAGTTCCTGCTTCTCAAGCAAAAATTGTTTGGCAGATCCTAGGACGTTCTTATCTGTATGGTGTAGAAGTTAATGGTGTGGATTGGCAGAAATACAGAAATGTACAAAGAACCATCTCTACAGCACGTGACGATGTTATCATTGGTTCTTGGGTAGATGGTGCTGAACGTTACAGTGGTTATGTTTATGAAGAAGGTATTGATGGTCGTATCCATTATATTTCTTCTGTATACCAGACAGCAGCTACAAAACTTGCTAAATCAGCAGCAGACGGTACAGACCTAACATCAACGTCACCTGTTTGGGTTGATATGGCTGTTCCAACTGGAGCAACAGCTACTTCCCAACCTAATCAAGATACAATCTTAGCATGGGATGCTCAAGGTTATAGTAAACACTACTTCCGTAATATTAACGTCTTAACAGCATCTGTATTAACTGAACAAACGCTTAATACGAACAGTTATACGTTTACCTATGCAGATCAAGTAGAACAATATGGTTTTGCAGCAGGTACTACGATATTTGATGTTGCATATTATGACGAAGCAAATGATGTGTTATCTCCTTTAGTACGTTTTAATGTTAGCGTTACAGCAGGAAAAGTAGAAGATAAACCTGTCGTGATGGACTATGATTTGACGCAAGAAACTCTCCCATCAGATGTTAAGGTTAATGGTGGAAACTCTTTTGCTCGTGCTTCTGGAGATACACTTGTAGCCACTAACACCTTGGTTGCTCCGTTGGAGTATGTTGGCACTACCCCTGTAGGTAGACGTGTAACAGCTAACACAGCTACACAAATTTTTGTCAACAACGCCTTAACAAGCGCAAGCCCGTGGGTAAAGACCAACTTAACTGTTGCAGCTTCATCTGATAAATCTCCGGCTGGAACTACTGCTAATGTATTCAAATTAACTCCGACTACAACCTCTGGTAGTCATATCTTAACTGCAACATATACTAACGCGTACAACATATCTGCCGGACGTAACTGGTCTGCCTCTGTTTTCTTGAAAGCGAACGGGATTACTAAGGCCAAACTAAGATTAAAAGCAGGGACTGAAGTTAATGAAGGTACTTTTGATTTAGCAGCAGGTACATTCACAGGAAGTGAAGCTAATATTATATCTATGGGCAACGGTTGGTATCGTGCTATTCTGCATAAAACAGGGATAGCCAAACAGTCCTCCATAAGTTTTGAAATAATTGCCTTGGATGCTACTGGTGCGGAGATTTTCGCTGGGGATGGTACTAGTAACCTTGCAGTTTGGTTGCCACAGCTTGAAGGTGCTTCTACAGGAGAAACATCAAAAGCTGGATCGCCTTATGTCTGCACATATCCTGGAAATTTAGGAGGAGTATCCTTCACTATACCAAGGAACGGACATACTGGTGTGGATGTTTACTATTCCAACGGAGACGTTGTTCGTGACGTATTCTCTGGTACGGCATCTACTTGGACAATAAACTACTCCAGCTTGTACGATTGGGGATCAGTCTTTATTACAGGTTTGAAATATTACGACTAA

Genome Context

Tertiary structure

XQP09632.1
ESMFold2 structure
Source ESMFold2
pLDDT 76.6
Oligomeric state monomer