Genbank accession
XEN13268.1 [GenBank]
Protein name
minor tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,69
Seq2Symm
C3 confidence 0,955 truncated
C3 0,955
C1 0,775
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MRLLLRDLTPGTNYNIQLRANDGTNVSDWSRIFPLTTIQDTLAPAHPVNLTWVVNRTAFSAKWDAVTQNEDASPLEDFSHYLVRLTDGTTVVNVKTTNTFYDLAFETNKAFFGTPKATVSITVFAVDLTGNVSEPSTTLSATNPPPPDPTGVAAAGIVGGVSMKWDVQVIDDLAAYDVYMSTTGSGFTPTNANRVYSGTGNTFVFDSSSLGVVHYFKIRSRDVFDSISNYVTVSATPISPTDVDTTAPGVPTGLAVTMAVDTNDSAFATAALSWTAPSDTDLAGYVVRYKQNASSTYDYVNVPVGTTSITIGGLVVGVQYNFSVQSFDRSTNRSAFSAAVNGTAVNTAPSTPAAPTAVADVMSIQVSHSLQKATSGRLESDVSYFEVHLGTTSTFTASDSTMIGQLQVEPGSTFVSEVFTTPAQDVSLARWVRVIAVDRGGLKSAASAVASVTVGLISNAYIANATITSAKINNLDANKITAGTGIINALLIKNSLTVDTGGTVKSTNYAAGSTGYQLSNNTLEINQGTIRAAALLLQDAPNIVQPQYADFEFQSTWYTGKTVTFNDGGTTTWAIATAPEVTSKFGTQCLKHTWTGGGTFSRVYQGASYTDYNVIVEPNTDYIASVWVFNPTGSGDKTVGFGVKMGDGATYPQPGGTPVVVANGTWTRISGTFNTGANSSLMTYMSLYNTGSVYFDGIQIERKLTSATTASPWRAPSTTSIDGGIIRTGEIRSTALANGLSGQPAWSINMTGGAQFGDATVRGRIVVGDPANPTADGTNSRIHSANYSAGVNGWIIRNDGYAEFRQLAVNSIKVTALDSPMQNNTYAKLFDYMQDGTLWLTSGAVTQKTDPGAYSAESLFEFTGPGLVLRNAVGVTKVAYDPTILYRISARIRAYEVATLNANPDFETNTSGWFAYGSNSIARDTTKKFAGTASVRWDQVGTSNGVYGMGTVVNVKAGRTYNFAARVLPNSTVIRDNLKMNIVWKDAANATISTTFNDMAPPVDENGVEIPIDGVTWIQFASQGVAPVGAVTASFEIQAGIAGSPVAGIQGWFDDVLITTAPRVKVGLFGFDNSNNVIDWDFVDAATTPTKMHAMPTDYSQLASLAGAQYMMVSNDQEVAIASGTGSTTADWITVTGYVRGRGGTGTDGLFGTQGQANDPYAPAALNQSVRYLVPYVEFDIATGSKAQLDQFSIEAYENGAPAKIDTTDISGTKGISIENIEDDSEFDHAIRFYTGASDEMRPGMIGHILDGDLNSAGHLRISPPMLNNESTYGKVYMGIYDRNPNYIYDSSFQKGITNWTANTATPGSAVSWDETVGRIELGSLKITTTGTPVAATEIYGKYDIYTADHPDLIGRNISVSGWFKPGMIRPIRLYLNCHDETGAIILSYYFQKTPVNTTDWIRQAWTMPVVVPDNTYYLRYFWWWNNAAAGDTIWVDEVQLETGGVSNYRDAQASLISLTSDTVRSTGSIIVSTSDLDLPTNVWGGGAKRRDVTTYPSFVSQTDGGSGIFRAINYTDSYGNRASTTISNFAPDGTEEAAVRIYAGQDDRYPGRIALTNLSGSFALSTYADDGADMTTSTNVRVGGHLDVQGNPPWVAPTLSNGVNYSSAYNVSYFKSNGNVYLRGVIQTYSKTTTLFTLPSGYRPAQTVYLNAIQWSSTTSIGAVLLQVNTSGTVQVTSSASTLSQLSLDGLWFSIAPEAAAPPVTGDTTPPAAPSGFSINAYSSGSSTGVYQLKWTNPSTSDTAGVKIIWRTDRYPTVTIPTSGTRTLTTDGSIITVTGTPSQAKSYNHSGLPVNKTIYYRIVAYDKSGNHSGYLSASRYLLASPFTIYATDSDAYRLGYGGMWRNDGDAPYQGDWTENDNHRGLFFYGDGIYNKLATGGVVRTPTKMTVYVQRQSTSHGNNAGVGLNLRGHTYGSKPSGDPVGKMTNEGSDGDAIVYLSRGEAATVTIPSSWYNNFVDSTSANRLRGVGCYGSTTSEYLVLYGKSSGSSHGKITVYHKG
Physico‐chemical
properties
protein length:2001 AA
molecular weight: 213645,19920 Da
isoelectric point:5,13969
aromaticity:0,10195
hydropathy:-0,18346

Taxonomy

Phage
Streptomyces phage WhereRU [NCBI] · taxon 3241799

Coding sequence (CDS)

Genbank protein accession
XEN13268.1 [NCBI]
Genbank nucleotide accession
PP978780 [NCBI]
CDS location
range 44379 -> 50384
strand +
CDS
ATGAGACTTCTACTTAGAGACCTTACACCAGGCACGAACTACAATATCCAGCTACGTGCAAATGATGGAACGAACGTTTCCGATTGGAGCCGTATCTTCCCTCTTACCACGATTCAGGATACTCTAGCTCCAGCACACCCAGTCAATCTGACATGGGTTGTCAATCGAACCGCATTCTCAGCAAAATGGGATGCGGTTACTCAGAATGAAGACGCAAGCCCTCTGGAAGACTTCTCTCACTATCTCGTCAGGCTTACTGATGGAACGACTGTCGTTAACGTCAAGACAACCAATACGTTCTACGACCTCGCCTTCGAGACAAACAAGGCTTTCTTCGGTACTCCAAAGGCTACTGTCAGCATTACCGTATTTGCAGTTGACCTTACCGGCAACGTTTCAGAGCCATCAACAACTCTGTCTGCAACCAATCCACCACCACCTGACCCAACTGGTGTAGCTGCGGCCGGTATTGTTGGTGGCGTCAGCATGAAGTGGGATGTACAGGTAATTGATGACCTTGCAGCCTATGACGTATACATGAGCACCACTGGTTCAGGATTCACTCCAACCAATGCGAATCGAGTATACAGCGGAACGGGAAACACTTTTGTTTTCGACAGCAGCTCTCTGGGAGTCGTTCACTACTTCAAGATTCGCTCTCGTGACGTATTCGATAGCATTTCAAACTACGTCACTGTTTCAGCGACTCCAATTTCACCAACTGATGTAGACACAACAGCGCCCGGTGTTCCAACAGGTCTAGCAGTTACTATGGCTGTGGATACCAATGACTCAGCCTTCGCAACGGCTGCCCTATCTTGGACTGCACCATCCGATACCGACCTTGCTGGATACGTTGTAAGATACAAGCAGAATGCAAGTAGCACCTACGACTACGTAAATGTCCCTGTAGGCACGACCTCAATTACAATTGGAGGTCTAGTTGTTGGTGTCCAGTACAACTTCTCAGTGCAGTCATTCGATAGAAGCACAAATAGAAGTGCATTTTCTGCGGCAGTCAATGGCACTGCTGTCAATACTGCACCTTCAACTCCAGCGGCTCCAACCGCTGTAGCAGACGTAATGAGCATTCAGGTAAGCCACTCTTTGCAGAAGGCTACCTCCGGACGCCTTGAATCTGACGTAAGCTATTTCGAGGTTCACCTAGGAACAACCTCTACATTCACTGCAAGCGACTCCACGATGATTGGACAATTGCAGGTAGAGCCTGGTAGCACATTCGTTTCCGAAGTTTTCACCACGCCTGCTCAGGACGTTTCTCTGGCCCGTTGGGTGCGAGTCATCGCCGTTGACCGAGGTGGATTGAAGTCTGCTGCTTCCGCAGTAGCCTCTGTCACTGTCGGTCTAATCAGTAATGCCTACATTGCCAATGCGACCATTACCTCTGCCAAGATTAACAACCTGGATGCAAACAAGATTACGGCCGGTACTGGTATCATCAACGCTTTGCTTATCAAGAATTCTCTGACTGTTGATACTGGCGGTACCGTAAAGAGCACAAACTATGCAGCGGGCTCAACTGGATATCAGCTATCCAACAATACCCTTGAAATCAATCAAGGTACGATTCGTGCTGCCGCACTTCTATTGCAGGATGCCCCTAACATTGTTCAGCCTCAGTACGCTGACTTTGAATTCCAGTCAACTTGGTACACCGGAAAGACCGTTACATTCAATGACGGTGGAACAACGACATGGGCAATTGCAACTGCTCCGGAAGTAACTTCTAAGTTCGGTACTCAGTGTCTCAAGCACACTTGGACCGGTGGAGGAACATTCTCCCGAGTTTACCAGGGTGCTAGTTACACAGACTACAATGTCATCGTAGAGCCAAACACTGATTACATTGCCTCTGTATGGGTATTCAACCCAACAGGCTCCGGTGATAAGACAGTCGGATTTGGTGTCAAGATGGGTGACGGTGCCACTTATCCACAGCCTGGTGGAACTCCAGTTGTTGTGGCTAATGGAACATGGACCAGAATTTCAGGTACATTCAACACTGGCGCAAATAGCTCACTCATGACTTACATGAGCCTTTACAACACTGGCTCCGTCTACTTTGATGGAATTCAGATTGAGCGCAAGCTAACCAGTGCAACGACTGCTTCTCCATGGCGTGCACCAAGCACCACCTCTATTGATGGTGGAATTATCCGTACTGGTGAAATCCGTTCTACCGCCCTGGCAAATGGCCTTTCTGGTCAGCCAGCATGGTCAATCAACATGACTGGTGGGGCGCAGTTTGGTGATGCCACGGTTCGAGGACGTATTGTTGTAGGTGACCCTGCTAACCCAACCGCTGACGGAACGAATTCACGAATCCACTCCGCTAACTATTCAGCCGGTGTGAATGGATGGATTATCCGTAATGACGGATATGCAGAATTCCGTCAGCTAGCAGTCAACTCAATCAAGGTAACTGCGCTGGACTCTCCAATGCAGAACAACACCTATGCAAAGCTATTTGACTACATGCAGGACGGAACCCTTTGGCTTACTTCTGGTGCTGTAACTCAGAAGACTGACCCTGGTGCTTATTCCGCTGAATCACTCTTTGAATTCACGGGTCCTGGCCTTGTTCTGAGAAATGCAGTTGGTGTTACCAAGGTTGCTTATGACCCTACCATTCTGTATCGTATCTCAGCTCGTATCCGTGCGTATGAGGTAGCGACTCTGAACGCCAACCCAGACTTTGAAACAAACACGTCTGGATGGTTTGCTTATGGCTCAAACAGCATTGCCCGAGACACCACCAAGAAGTTTGCTGGAACCGCGTCTGTTCGTTGGGACCAGGTTGGCACTTCAAATGGTGTTTACGGAATGGGAACTGTCGTCAATGTCAAGGCCGGTAGAACATACAACTTTGCTGCTCGTGTACTTCCAAACAGCACGGTCATCCGAGACAATCTCAAGATGAACATTGTCTGGAAGGACGCTGCAAATGCAACGATTTCTACCACCTTCAATGACATGGCACCACCTGTTGACGAGAATGGTGTAGAAATTCCAATTGATGGAGTAACCTGGATTCAGTTTGCTTCTCAGGGTGTCGCTCCAGTGGGTGCGGTGACCGCTAGCTTTGAAATTCAGGCTGGTATTGCTGGAAGCCCAGTAGCGGGTATTCAGGGATGGTTTGACGATGTTCTGATTACCACGGCTCCTCGTGTCAAGGTGGGTCTATTCGGCTTCGACAATTCAAACAATGTCATTGACTGGGACTTTGTTGATGCTGCAACGACTCCTACCAAGATGCACGCAATGCCTACAGACTACAGCCAGCTAGCCAGCTTGGCTGGTGCTCAATACATGATGGTATCAAATGACCAGGAAGTAGCAATTGCTTCTGGTACTGGTAGCACTACTGCCGACTGGATTACCGTAACTGGTTATGTTCGTGGCCGTGGTGGTACTGGAACAGACGGTCTATTCGGTACTCAGGGACAGGCAAACGACCCATACGCACCTGCTGCTCTGAACCAGTCTGTTCGATACCTCGTGCCTTATGTAGAATTCGACATTGCAACGGGTTCAAAGGCTCAGCTCGACCAGTTCTCAATTGAAGCATATGAGAATGGTGCTCCAGCAAAGATTGACACAACTGATATCAGTGGAACAAAGGGTATCTCAATTGAGAATATTGAAGACGACTCCGAGTTCGACCACGCTATCAGATTCTACACTGGTGCATCAGACGAAATGAGGCCCGGCATGATTGGTCACATCCTTGATGGTGACCTTAACAGTGCTGGACACCTTCGTATCTCTCCTCCAATGCTCAACAACGAGAGTACATACGGCAAGGTTTACATGGGTATCTACGACAGAAACCCTAACTACATCTACGACTCTTCATTCCAGAAGGGTATTACGAACTGGACTGCCAACACGGCTACACCTGGTTCCGCTGTCTCCTGGGATGAAACTGTCGGACGAATTGAATTGGGTTCCTTGAAGATTACCACAACAGGTACTCCCGTTGCAGCAACTGAAATCTATGGAAAGTACGACATTTACACGGCTGACCATCCAGACCTTATCGGAAGAAACATCTCCGTATCAGGTTGGTTCAAGCCTGGAATGATTAGGCCAATTCGTCTGTATCTCAACTGTCACGACGAAACAGGTGCAATTATTCTTAGCTACTACTTCCAGAAGACTCCTGTCAATACAACTGACTGGATTCGACAGGCATGGACAATGCCAGTCGTTGTTCCTGACAATACGTATTACCTACGTTACTTCTGGTGGTGGAACAATGCTGCGGCCGGTGACACAATTTGGGTTGATGAAGTTCAGCTAGAAACCGGTGGTGTTTCCAACTATAGAGACGCACAGGCTTCATTGATTTCTCTGACAAGTGACACTGTAAGGTCAACGGGTTCAATCATTGTTTCAACCTCTGACCTCGACCTCCCTACAAACGTTTGGGGTGGTGGAGCTAAGCGTAGAGACGTGACAACTTATCCATCATTTGTATCTCAAACTGATGGTGGTAGCGGTATCTTTAGAGCGATTAACTACACAGACTCTTATGGAAACCGTGCGTCTACAACTATTTCAAACTTTGCTCCAGACGGGACAGAAGAGGCGGCAGTAAGAATTTATGCCGGTCAGGATGACCGTTATCCAGGTCGAATTGCATTGACAAACCTTTCAGGTAGCTTTGCACTTTCAACCTATGCCGATGATGGCGCTGACATGACTACGAGCACCAACGTTCGAGTTGGAGGCCATTTGGATGTTCAGGGTAATCCACCTTGGGTAGCCCCAACGCTTTCAAATGGTGTGAACTATTCATCAGCGTATAATGTGTCCTACTTCAAGAGCAATGGAAATGTTTATCTGCGTGGAGTTATCCAGACATACTCAAAGACAACAACGTTGTTCACCCTGCCTTCTGGATATCGCCCAGCACAGACGGTATACTTGAATGCCATTCAGTGGAGCAGCACGACATCAATTGGTGCTGTATTGCTCCAGGTCAATACAAGTGGAACTGTTCAGGTTACTTCATCTGCGAGCACGTTGTCTCAGCTATCTCTTGATGGTTTGTGGTTCAGCATTGCTCCAGAAGCGGCTGCGCCTCCTGTAACTGGTGACACTACGCCTCCTGCTGCGCCTTCTGGCTTTAGCATCAATGCGTACAGCTCCGGTTCCTCAACGGGCGTTTACCAATTGAAGTGGACGAATCCAAGCACTTCTGACACGGCCGGTGTCAAGATTATCTGGAGGACTGACCGTTATCCAACAGTCACGATTCCTACATCTGGTACAAGGACACTGACTACTGATGGAAGCATTATCACAGTAACTGGTACTCCTTCTCAGGCCAAGTCTTACAACCATTCTGGACTTCCAGTCAATAAGACTATCTATTACAGAATTGTTGCTTACGACAAGTCAGGAAACCATTCTGGATATCTATCCGCATCAAGGTATCTGCTTGCATCACCATTCACCATTTATGCCACGGATTCAGATGCTTACCGTCTTGGATACGGTGGTATGTGGCGTAATGACGGTGACGCTCCTTACCAGGGTGACTGGACTGAAAATGACAACCACAGAGGTCTGTTCTTCTACGGAGATGGAATCTACAACAAACTGGCAACAGGTGGTGTAGTGAGAACTCCTACCAAGATGACAGTCTATGTTCAGAGGCAAAGCACTTCTCACGGTAACAATGCTGGAGTTGGATTGAATCTACGAGGTCACACCTATGGCTCAAAGCCTTCTGGAGACCCGGTAGGTAAGATGACCAATGAGGGTTCTGATGGAGATGCAATTGTATATCTATCAAGAGGAGAGGCAGCAACCGTTACAATTCCTTCAAGCTGGTACAACAACTTCGTAGATTCAACTTCTGCGAACAGGCTCAGGGGTGTAGGTTGTTATGGTAGCACAACAAGCGAATATCTCGTCCTCTACGGAAAGAGTTCAGGTTCTTCTCATGGAAAGATTACCGTCTACCACAAGGGATGA

Genome Context

Tertiary structure

XEN13268.1
ESMFold2 structure
Source ESMFold2
pLDDT 66.5
Oligomeric state monomer