Genbank accession
WNM74725.1 [GenBank]
Protein name
minor tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,68
Seq2Symm
C3 confidence 0,974 truncated
C3 0,974
C1 0,762
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MRLLLRDLTPGTNYNIQLRANDGTNVSDWSRIFPLTTIQDTLAPAHPVNLTWVVNRTAFSAKWDAVTQNEDASPLEDFSHYLVRLTDGTTVVNVKTTNTFYDLAFETNKAFFGTPKATVSITVFAVDLTGNVSEPSTTLSATNPPPPDPTGVAAAGIVGGVSMKWDVQVIDDLAAYDVYMSTTGSGFTPTNANRVYSGTGNTFVFDSSSLGVVHYFKIRSRDVFDSISNYVTVSATPISPTDVDTTAPGVPTGLAVTMAVDTNDSAFATAALSWTAPSDTDLAGYVVRYKQNASSTYDYVNVPVGTTSITIGGLVVGVQYNFSVQSFDRSTNRSAFSAAVNGTAVNTAPSTPAAPTAVADVMSIQVSHSLQKATSGRLESDVSYFEVHLGTTSTFTASDSTMIGQLQVEPGSTFVSEVFTTPAQDVSLARWVRVIAVDRGGLKSAASAVASVTVGLISNAYIANATITSAKINNLEANKITAGTGIINALLIKSSLTVDTGGTVKSTNYAAGSTGYQLSNNTLEINQGTIRAAALLLQDAPNIVQPQYADFEFQSTWYTGKTVTFNDGGTTTWAIATAPEVTPKFGTQCLKHTWTGGGTFSRVYQGASYTDYNVIVEPNTDYIASVWVYNPSGSGDKTVGFGVKTDLATYPQPGGTPVVVANGTWTRIQGTFNSGASSTLMTYMSLYNAGSVYFDGIQIERKLTSATTASPWRAPSTTSIDGGIIRTGEIRSTALANGLSGQPAWSINMTGGAQFGDATVRGRIVVGDPANPTADGTNSRIHSANYSAGVNGWIIRNDGYAEFRQLAVNSIKVTALDSPMQNNTYAKLFDYMQDGTLWLTSGAVTQKTDPGAYSAESLFEFTGSGLVLRNAVGVTKVAYDPTILYRISARIRAYDVATLNANSGFETNTSGWFAYGSNSITRDTTKKYAGTASVRWDQVGTSNGVYGMGTVVNVKAGRTYNFAARVLPNSTVIRDNLKMNIVWKDAANATISTTFNDMAPPVDENGVAIPIDGVTWIQFASQGVAPVGAVTASFEIQAGISGSPVAGIQGWFDDVLITTAPRVKVGLFGFDNSNNVIDWDFVDAATTPTKMHAMPTDYSQLATLAGAQYMMVSNDQEVAIASGTGSTTADWITVTGYVRGRGGTGTDGLFGTQGQANDPYAPAALNQSVRYLVPYVEFDIATGSKAQLDQFSIEAYENGAPAKIDTTDISGTKGISIENIEDDSEFDHAIRFYTGASDEMRPGMIGHILDGDLNSAGHLRISPPMLNNESTYGKVYMGIYDRNPNYIYDSSFQKGITNWTANTATPGSAVSWDETVGRIELGSLKITTTGTPVAATEIYGKYDIYTADHPDLIGRNISVSGWFKPGMIRPIRLYLNCHDETGAIILSYYFQKTPVNTTDWIRQAWTMPVVVPDNTYYLRYFWWWNNAAAGDTIWVDECQLETGGVSNYRDAQASLISMTSDTVRSTGSIIISSSDLDLPLNIWGGGARRRDVSTYPSFISQTDGGSGIFRAINYTDSYGNRASTQMSNFSADGIEEAAVRIYAGQDDRYPGRIALTNLSGSFALSTYADDGADMTTSTNVRVGGHLDVQGNPPWVAPTLSNGVNYSSAYNVAYYKSNGNVYLRGVIQTYAKATTLFTLPSGYRPAQTVYLNAIQWSSTTSLGAVLLQVNTTGTVQVTSSASTLSQLSLDGLWFSIAPEAAAPPVTGDTTPPAAPSGFSINAYSSGSSTGVYQLKWTNPSTSDTAGVKIIWRTDRYPTVTIPASGTRTLTTDGSIITVTGTPSQAKSYNHSGLPVNKTIYYRIVAYDKSGNHSGYLSASRYLLASPFTIYATDSDAYRLGYGGMWRNDGDAPYQGDWTENDNHRGLFFYGDGIYNKLATGGVVRTPTKMTVYVQRQSTSHGNNAGVGLNLRGHTYGSKPSGDPVGKMTNEGSDGDAIVYLSRGEAATVTIPSSWYNNFVDSTSANRLRGVGCYGSTTSEYLVLYGKSSGSSHGKITVYHKG
Physico‐chemical
properties
protein length:2000 AA
molecular weight: 213584,25020 Da
isoelectric point:5,18635
aromaticity:0,10200
hydropathy:-0,17845

Taxonomy

Phage
Streptomyces phage PinkiePie [NCBI] · taxon 3075177
Host No host information

Coding sequence (CDS)

Genbank protein accession
WNM74725.1 [NCBI]
Genbank nucleotide accession
OR253911 [NCBI]
CDS location
range 44944 -> 50946
strand +
CDS
ATGAGACTTCTACTTAGAGACCTTACACCAGGCACGAACTACAATATCCAGCTACGTGCAAATGATGGAACGAACGTTTCCGATTGGAGCCGTATCTTTCCTCTTACCACGATTCAGGATACTCTAGCTCCAGCACACCCAGTCAATCTGACATGGGTTGTCAATCGAACCGCATTCTCAGCAAAATGGGATGCGGTTACTCAGAATGAAGACGCAAGCCCTCTGGAAGACTTCTCTCACTATCTCGTCAGGCTTACTGATGGAACGACTGTCGTTAACGTCAAGACAACCAATACGTTCTACGACCTCGCCTTCGAGACAAACAAGGCTTTCTTCGGTACTCCAAAGGCTACTGTCAGCATTACCGTATTTGCAGTTGACCTTACCGGCAACGTTTCAGAGCCATCAACAACTCTGTCTGCAACCAATCCACCACCACCTGACCCAACTGGTGTAGCTGCGGCCGGTATTGTTGGTGGCGTCAGCATGAAATGGGATGTACAGGTAATTGATGACCTTGCAGCCTATGACGTATACATGAGCACCACTGGTTCAGGATTCACTCCAACCAATGCGAATCGAGTATATAGCGGCACAGGAAATACTTTTGTTTTCGACAGCAGCTCTCTTGGAGTTGTTCACTACTTCAAGATTCGCTCTCGTGACGTATTCGATAGCATTTCAAACTACGTCACTGTTTCAGCGACTCCAATTTCACCAACTGATGTAGACACAACAGCGCCCGGTGTTCCAACAGGTCTAGCAGTCACTATGGCTGTAGATACCAATGACTCAGCCTTTGCAACGGCTGCCCTATCTTGGACTGCACCATCTGACACCGACCTTGCTGGATACGTTGTACGATACAAGCAGAATGCAAGTAGCACCTACGACTACGTAAATGTCCCTGTAGGCACGACCTCAATTACAATTGGAGGTCTAGTTGTTGGTGTCCAGTACAACTTCTCCGTACAGTCATTCGACAGAAGCACGAACAGAAGTGCATTTTCTGCGGCAGTCAATGGCACTGCTGTCAATACTGCACCTTCAACTCCAGCGGCTCCAACTGCTGTAGCAGACGTAATGAGCATTCAGGTAAGTCACTCTTTGCAGAAGGCTACCTCTGGACGACTTGAATCTGACGTAAGCTATTTCGAAGTTCATCTGGGAACAACCTCTACATTCACTGCAAGCGACTCCACGATGATTGGACAATTGCAGGTAGAGCCTGGTAGCACATTCGTTTCCGAAGTTTTCACCACGCCTGCTCAGGACGTTTCTCTGGCCCGTTGGGTGCGAGTCATTGCCGTTGACCGAGGTGGATTGAAGTCTGCTGCTTCCGCAGTTGCTTCTGTCACTGTCGGTCTAATCAGTAATGCCTACATTGCCAATGCGACCATTACCTCTGCCAAGATTAACAATCTGGAAGCGAACAAGATTACGGCCGGTACTGGTATCATCAACGCTCTGCTTATCAAGAGTTCTCTAACTGTTGATACGGGTGGTACTGTAAAGAGCACAAACTATGCAGCGGGCTCAACTGGATATCAGCTATCCAACAATACCCTTGAAATCAATCAGGGTACAATTCGTGCTGCTGCACTTCTATTGCAGGACGCTCCTAACATCGTTCAGCCTCAGTACGCTGACTTTGAATTCCAGTCAACCTGGTACACAGGAAAGACTGTGACCTTCAATGACGGTGGAACAACGACATGGGCGATTGCAACCGCACCAGAAGTCACACCTAAGTTCGGTACTCAGTGCCTCAAGCACACATGGACTGGTGGAGGAACATTTTCCCGAGTTTACCAAGGTGCTAGCTACACAGACTACAATGTCATTGTAGAGCCAAACACTGATTACATTGCCTCTGTATGGGTTTACAATCCATCTGGTTCAGGTGACAAGACTGTTGGATTCGGTGTAAAGACCGACCTCGCAACTTATCCACAGCCTGGTGGAACGCCAGTTGTTGTCGCTAATGGAACGTGGACCAGAATTCAGGGTACATTCAACTCTGGAGCAAGCAGCACGCTCATGACATACATGAGCCTCTACAATGCTGGTTCTGTGTACTTCGATGGTATTCAGATTGAACGAAAGCTAACTAGCGCAACAACTGCTTCTCCATGGCGTGCACCAAGCACTACCTCTATTGATGGTGGAATTATCCGTACGGGTGAAATCCGCTCTACCGCTCTGGCAAATGGCCTTTCTGGTCAGCCAGCATGGTCAATCAACATGACTGGTGGAGCGCAGTTTGGTGATGCCACGGTTCGAGGACGCATTGTTGTAGGTGACCCTGCTAACCCAACCGCTGACGGAACGAATTCACGAATCCATTCCGCCAACTATTCAGCCGGTGTGAATGGATGGATTATCCGCAATGATGGATATGCAGAATTCCGTCAGCTAGCAGTCAACTCAATCAAGGTAACTGCACTGGACTCTCCAATGCAGAACAACACCTATGCAAAGCTGTTCGACTACATGCAGGATGGAACCCTTTGGCTTACCTCTGGTGCTGTAACTCAGAAGACTGACCCTGGTGCTTACTCCGCTGAATCCCTCTTTGAATTCACCGGTTCTGGACTGGTTCTCAGAAATGCAGTCGGTGTTACTAAGGTTGCTTATGACCCAACCATTCTGTACCGTATCTCAGCTCGTATCCGTGCGTATGACGTAGCAACGCTGAACGCCAACTCAGGATTTGAAACAAACACGTCTGGCTGGTTCGCCTATGGCTCAAACAGCATTACCCGAGACACCACCAAGAAGTATGCCGGAACTGCATCTGTTCGCTGGGACCAGGTTGGTACTTCAAATGGTGTTTATGGAATGGGAACTGTCGTTAATGTAAAGGCTGGTAGAACGTATAACTTCGCTGCTCGTGTACTGCCAAATAGCACAGTCATTCGAGACAATCTCAAGATGAACATTGTCTGGAAGGATGCTGCAAATGCAACGATTTCAACCACCTTCAACGATATGGCACCACCTGTAGACGAGAATGGTGTAGCAATTCCAATTGATGGAGTAACCTGGATTCAGTTTGCTTCTCAGGGTGTCGCTCCAGTAGGTGCGGTAACCGCTAGCTTTGAAATTCAGGCCGGTATCTCTGGAAGCCCTGTAGCGGGTATTCAGGGATGGTTTGACGATGTTCTGATTACCACAGCTCCTCGTGTCAAGGTAGGTCTATTCGGTTTTGACAATTCAAACAATGTCATCGACTGGGACTTTGTTGATGCCGCAACGACACCTACCAAGATGCACGCAATGCCTACAGATTACAGCCAGCTAGCAACTTTGGCCGGTGCTCAGTACATGATGGTATCAAACGACCAGGAAGTAGCAATTGCTTCTGGTACTGGTAGCACCACTGCTGACTGGATTACTGTAACTGGTTATGTCCGTGGTCGTGGTGGTACTGGAACAGATGGTCTATTCGGTACTCAGGGACAGGCAAATGACCCGTATGCACCTGCTGCCCTGAATCAGTCTGTTCGATACCTCGTGCCTTATGTAGAATTCGACATTGCAACCGGTTCAAAGGCTCAGCTCGACCAGTTCTCAATTGAAGCATATGAGAATGGTGCTCCAGCAAAGATTGACACAACTGATATCAGTGGAACAAAGGGTATTTCAATCGAAAACATTGAGGATGACTCCGAGTTTGACCACGCTATCAGATTCTACACTGGCGCATCAGATGAAATGAGGCCCGGCATGATTGGTCACATCCTTGATGGTGACCTTAACAGTGCTGGACATCTCCGTATTTCTCCTCCAATGCTCAACAATGAGAGCACATACGGCAAGGTTTACATGGGTATCTATGACAGAAACCCTAACTACATCTACGACTCCTCATTCCAAAAGGGAATTACGAACTGGACTGCCAATACGGCAACGCCTGGCTCTGCTGTCTCTTGGGATGAAACTGTTGGACGAATTGAGTTGGGTTCCTTGAAGATTACCACAACAGGTACTCCCGTTGCAGCAACCGAAATCTATGGAAAGTACGACATCTACACGGCTGACCATCCAGACCTTATCGGAAGAAACATCTCCGTATCAGGTTGGTTCAAGCCTGGAATGATTAGGCCAATTCGTCTGTATCTCAACTGTCACGACGAGACGGGTGCAATTATTCTTAGCTACTACTTCCAGAAGACTCCCGTCAATACAACTGACTGGATTAGGCAGGCATGGACAATGCCAGTTGTTGTTCCTGACAATACGTATTACCTACGTTACTTCTGGTGGTGGAACAATGCTGCGGCCGGTGACACGATTTGGGTTGATGAATGTCAGCTAGAAACTGGTGGAGTCTCTAACTATAGAGATGCACAAGCTTCATTGATTTCAATGACAAGTGACACCGTTCGTTCTACTGGTTCAATCATCATTTCATCATCTGACCTGGACCTCCCTCTAAACATTTGGGGCGGTGGAGCAAGGCGTAGAGATGTCTCAACCTATCCATCATTCATTTCTCAGACTGATGGTGGTAGTGGTATCTTCCGTGCAATTAACTACACGGACTCTTATGGAAACCGTGCATCAACCCAGATGTCAAACTTCTCCGCAGATGGTATAGAAGAAGCAGCAGTAAGAATTTACGCTGGCCAGGATGACCGTTATCCAGGAAGAATTGCATTGACAAACCTTTCAGGTAGCTTTGCACTTTCAACCTATGCCGATGATGGCGCTGACATGACTACAAGCACCAACGTTCGAGTTGGAGGTCATTTGGATGTTCAGGGTAACCCACCTTGGGTAGCTCCAACGCTTTCAAATGGTGTCAACTATTCATCAGCGTATAATGTGGCTTACTACAAAAGCAATGGAAACGTCTATCTTCGTGGAGTTATCCAGACATACGCAAAGGCAACGACCCTGTTTACCTTGCCTTCTGGATATCGTCCGGCACAGACTGTTTACCTCAATGCCATTCAGTGGAGCAGCACGACATCACTAGGTGCTGTATTGCTCCAGGTAAACACAACTGGAACTGTTCAGGTTACTTCATCTGCGAGCACGTTGTCCCAGCTATCTCTTGATGGTCTGTGGTTCAGCATTGCTCCAGAAGCGGCTGCGCCTCCTGTAACTGGTGACACTACGCCTCCTGCTGCGCCTTCTGGCTTTAGCATCAATGCGTACAGCTCCGGCTCCTCAACAGGCGTTTACCAATTGAAGTGGACGAATCCAAGCACTTCTGACACGGCCGGTGTCAAGATTATCTGGAGAACTGACCGTTATCCAACAGTCACGATTCCTGCATCTGGCACAAGGACACTGACTACTGATGGAAGCATTATCACAGTAACTGGTACTCCTTCTCAGGCCAAGTCTTACAACCATTCTGGACTTCCAGTCAATAAGACTATCTATTACAGAATTGTTGCTTACGACAAGTCAGGAAACCACTCTGGATATCTATCCGCATCAAGGTATCTGCTTGCATCACCATTCACCATTTACGCTACGGATTCAGATGCTTACCGTCTTGGATACGGTGGTATGTGGCGTAATGACGGTGACGCCCCTTACCAGGGTGACTGGACTGAAAATGACAACCACAGAGGTCTGTTCTTCTACGGAGATGGAATCTACAACAAACTGGCAACAGGTGGTGTAGTGAGAACTCCTACCAAGATGACAGTCTATGTTCAGAGGCAAAGCACTTCTCACGGTAACAATGCTGGAGTTGGATTGAATCTACGAGGTCACACCTATGGCTCAAAGCCTTCTGGAGACCCGGTAGGTAAGATGACCAATGAGGGTTCTGATGGAGATGCAATTGTATATCTATCAAGAGGAGAGGCAGCAACCGTTACAATTCCTTCAAGCTGGTACAACAACTTCGTAGATTCAACTTCTGCGAACAGGCTCAGGGGTGTAGGTTGTTATGGTAGCACAACAAGCGAATATCTCGTCCTCTACGGAAAGAGTTCAGGTTCTTCTCATGGAAAGATTACCGTCTACCACAAGGGATGA

Genome Context

Tertiary structure

WNM74725.1
ESMFold2 structure
Source ESMFold2
pLDDT 66.5
Oligomeric state monomer