Genbank accession
YP_009611502.1 [GenBank]
Protein name
minor tail protein
RBP type
TSP
Evidence RBPdetect2
Probability 0,47
Seq2Symm
C3 confidence 0,948 truncated
C3 0,948
C1 0,832
I 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MRILLRDLTPGTDYNIQLRSNDGTNVSDWSRIFPLTTIQDTLAPAHPVNLSWVVNRTAFSAKWDAVTQNEDASPLEDFSHYVVRLTDGTTVVEVKTANTFYDLAFETNKAFFGTPKPTVSITVFAVDLTGNRSVASTTISATNPPPPDPTGVAAAGIVGGVSMKWDVQVIDDLAAYDVYMSTTGSGFTPSNSNRIYSGTGNAVVFDSSSLGIVHYFKIRSRDVFDSISNYVTVSATPISPTDVDTTAPGVPTGLAVTMAVDTNDSAFATAALSWTAPSDTDLAGYVVRYKQNASSTYDYVNVPVGTTSITIGGLVVGVQYNFSVQSFDRSTNRSAFSTAVNGTAVNTAPSTPAAPTAVADVMSIQVSHALQKATSGRLESDVSYLEVHLGTTSTFTASDSTMIGQLQVEPGSTFVSEVFNTPAQDTSLARWVRVIAVDRGGLKSSASAVASVTVGLISNAYIANATITSAKINNLDANKITAGTGIINALLIKSSLTVDTGGTVKSTNYAAGSTGYQLSNNTLEINQGTIRAAALLLQDAPNIVLPQYADFEFQSSWYTGKQVTFNDGGTTTWAIATAPEVTPKYGTQCLKHTWTGGGTFSRVYQGLSYTDYNVIVEPNTDYIASVWVYNPSGSGDKVVGFGVKMGDGATYPQPGGTPTVVANGTWTRIQGTFNTGANSTLMTYMSLYNAGSVYFDGIQIERKLTSATTASPWRAPSTTSIDGGIIRTGEIRSTALANGLSGQPAWSINLTGGAQFGDATVRGRIVVGDPANPTADGTNSRIHSSNYSAGVSGWIIRNDGYAEFRQLAVNSIKVTALDSPMQNNTYAKLFDYMQDGTLWLTSGAVTQKTDPGAYSAESLFEFTGPGLVLRNAVGVTKVAYDPTILYRISARIRAYEVATLNANSGFETNTSGWFAYGSNSITRDTTKFFAGTASVRWDQVGTSNGVYGMGTVVNVKAGRTYNFAARVLPNSTVIRDNLKMNIVWKDAANATISTTFNDMAPPVDENGAAIPIDGVTWIQFTSQGVAPVGATTASFEIQAGISGSPVAGIQGWFDDVLITTPPRVKVGLFGFDNANNVIDWDFVDAATTPTKMHAMPTDYSQLSGLAGNQYMMVSNDQEVAIASGTGSTTADWITVTGYVRGRGGTGTDGLFGSQGQANDPYAPAALNQSVRYLVPYVEFDIATGSKAQLDQFSIEAYENGAPGKIDTTDINGTKGISIENIEDDSEFDHAIRFYTGASDEMKPGMIGHILDGDLNSAAHLRMSPPMLNNESTYGRVYMGIYDRNPNYIYDSSFQAGIVNWTANTATPGSAVSWDETVGHIELGSLKITTTGTPVAATEIYGKYDIYTEQHPDLIGKKISVSGWFKPGMIKPIRLYLNCHDETGAIIISYYFQKTPVNTTDWIKQAWTMPVVVPDNTYYLRYFWWWNNAAAGDTIWVDECQLETGGISNYRDAQSSLISLTSDTVRSTGSIIVSSSDLDLPLNIWGGGSRRRDVSTYPSFISQTDGGSGVFRAINYTDTYGNRASTQMSNYSADGIEEAAVRIYAGQDDRYPGRIALTNLSGSFALSTYADDGSDMTTSTNVRVGGHLDVQGNPPWVAPTLSNGVNYSSAYNVAYYKSNGNVYLRGVLQTYTKATTLFTLPSGYRPAQTVYLNAIQWSSTTSIGAVLLQVNTTGTVQVTSSASTLSQLSLDGLWFSIAPEAVAPPVTGDTTPPAAPSGFSINAYSSGSSTGVYQLKWTNPSTSDTAGVKIIWRTDRYPTVTIPASGTRTLTTDGSIITVTGTPSQAKSYNHSGLPVNKTIYYRIVAYDKSGNHSGYLSASRYLLASPFTIYATDSDAYRLGYGGMWRNDGDAPYQGDWTENDNHRGLFFYGDGIYNKLATGGVVRTPTKMTVYVQRQNTSHGNNSGVGLNLRGHTYGSKPSGDPVGKMTNEGSDGDSIVALSRGEAATVTIPSSWYNNFVDSTSANRLRGVGCYGSTTSEYLVLYGKSSGSSHGKITVYHKG
Physico‐chemical
properties
protein length:2001 AA
molecular weight: 213714,30090 Da
isoelectric point:5,16026
aromaticity:0,10095
hydropathy:-0,19190

Taxonomy

Phage
Streptomyces phage Samisti12 [NCBI] · taxon 2023995
Host No host information

Coding sequence (CDS)

Genbank protein accession
YP_009611502.1 [NCBI]
Genbank nucleotide accession
NC_042012 [NCBI]
CDS location
range 46744 -> 52749
strand +
CDS
ATGAGAATTCTACTAAGAGACCTTACACCAGGAACAGACTACAACATTCAGCTTCGGTCAAACGATGGAACAAACGTTTCAGACTGGAGCCGAATCTTTCCGCTTACTACGATTCAGGATACGCTGGCTCCAGCCCATCCTGTTAATCTGTCATGGGTAGTCAATCGAACCGCATTTTCCGCTAAATGGGATGCGGTTACTCAGAATGAGGATGCAAGCCCTCTTGAGGATTTCTCTCACTATGTAGTCAGACTGACTGATGGCACGACTGTTGTCGAAGTAAAGACTGCAAATACATTCTACGACCTAGCCTTCGAAACCAATAAGGCTTTCTTTGGCACGCCAAAGCCTACGGTCAGCATTACCGTATTTGCTGTTGACCTTACAGGTAACCGCTCTGTAGCCTCTACGACTATATCAGCAACCAACCCACCACCACCTGACCCAACTGGAGTAGCAGCAGCCGGTATCGTAGGTGGCGTTAGCATGAAGTGGGACGTTCAGGTAATCGATGACCTTGCAGCTTATGATGTATACATGAGCACCACTGGCTCTGGATTCACTCCAAGCAACTCTAACCGTATTTACAGCGGTACAGGAAATGCTGTCGTATTCGACTCAAGCTCTCTGGGAATTGTTCACTACTTCAAGATTCGCTCTCGTGACGTATTCGATAGCATTTCAAACTATGTCACTGTTTCTGCGACTCCTATTTCCCCAACTGATGTAGACACGACAGCGCCCGGTGTTCCAACAGGTCTAGCTGTAACCATGGCTGTAGATACTAATGACTCAGCCTTTGCGACAGCAGCTCTTTCATGGACCGCTCCATCTGATACCGACCTTGCTGGATATGTTGTCCGATACAAGCAGAATGCAAGTAGCACCTACGACTACGTAAATGTCCCTGTAGGCACGACCTCAATTACTATTGGAGGTCTAGTTGTTGGTGTCCAGTACAACTTCTCTGTACAGTCATTCGACCGAAGCACCAACAGAAGTGCATTCTCCACTGCGGTAAATGGAACAGCAGTTAACACTGCTCCGTCAACTCCAGCAGCTCCAACCGCTGTGGCTGACGTAATGAGCATTCAGGTAAGCCACGCATTGCAGAAGGCAACATCTGGTCGTCTTGAGTCTGACGTTAGCTACCTTGAGGTCCACCTAGGAACCACGTCTACGTTCACCGCAAGCGACTCTACGATGATTGGGCAATTGCAGGTAGAGCCTGGCAGCACCTTCGTTTCCGAAGTTTTCAATACGCCTGCCCAGGACACTTCTCTGGCACGTTGGGTACGAGTCATTGCCGTTGACCGAGGTGGATTGAAGTCTTCTGCTTCCGCAGTTGCTTCTGTCACTGTCGGTCTAATCAGCAATGCCTACATTGCTAATGCGACCATTACCTCTGCTAAGATTAACAATCTGGATGCCAACAAGATTACGGCCGGTACGGGTATTATCAATGCCCTTCTCATCAAGTCTTCTTTGACTGTAGACACAGGCGGTACTGTAAAGAGCACCAATTACGCAGCAGGCTCAACTGGATATCAGCTATCCAACAATACTCTGGAAATCAACCAGGGTACTATTCGAGCTGCCGCATTGCTTCTACAGGATGCTCCAAACATCGTTCTGCCTCAGTACGCTGACTTTGAATTCCAGTCAAGCTGGTACACCGGAAAGCAGGTTACCTTCAATGATGGTGGAACGACGACTTGGGCAATTGCAACTGCTCCAGAAGTTACACCAAAGTATGGAACTCAGTGTCTCAAGCACACCTGGACTGGTGGAGGAACATTCTCACGAGTTTACCAGGGTCTAAGCTACACAGACTACAATGTCATTGTAGAACCAAACACTGACTACATTGCCTCTGTATGGGTTTACAATCCATCAGGCTCCGGTGATAAGGTAGTCGGTTTTGGTGTAAAGATGGGCGACGGTGCAACTTATCCACAGCCTGGCGGAACGCCAACAGTTGTCGCAAATGGAACGTGGACTCGAATTCAGGGTACATTCAACACTGGTGCAAACAGCACTTTGATGACCTACATGAGCCTCTACAATGCTGGCTCTGTCTACTTCGATGGAATTCAGATTGAGCGAAAGCTCACCAGCGCAACGACAGCTTCACCATGGCGTGCACCAAGCACGACCTCAATTGATGGTGGAATCATTCGTACTGGTGAAATCCGTTCAACCGCTTTGGCAAATGGCCTCTCAGGACAGCCAGCCTGGTCAATTAACTTGACTGGTGGGGCTCAGTTTGGTGATGCCACAGTCCGAGGACGAATCGTAGTAGGTGACCCAGCGAACCCAACTGCTGACGGTACGAATTCACGTATCCACTCTTCAAACTATTCAGCCGGTGTAAGTGGTTGGATTATCCGTAATGATGGATATGCAGAATTCCGTCAGCTAGCTGTTAACTCAATCAAGGTAACTGCACTGGACTCCCCAATGCAGAACAACACCTACGCAAAGCTCTTTGACTACATGCAGGACGGAACGCTATGGCTGACCTCTGGTGCTGTGACTCAGAAGACTGACCCTGGTGCATACTCCGCTGAATCTCTATTCGAATTCACCGGACCTGGCCTGGTACTCAGAAATGCTGTCGGTGTTACCAAGGTTGCTTATGACCCAACCATTCTATACCGTATCTCAGCTCGTATCCGTGCATATGAGGTAGCGACGCTGAACGCCAACTCTGGCTTTGAGACAAACACGTCAGGGTGGTTTGCCTACGGCTCAAACAGCATTACCAGAGACACCACCAAGTTCTTTGCAGGCACCGCTTCTGTACGTTGGGACCAGGTTGGTACGTCCAATGGAGTCTACGGAATGGGAACGGTTGTCAACGTCAAGGCTGGTAGAACATACAACTTTGCAGCTCGTGTGCTTCCAAATAGCACTGTCATCCGAGACAATCTCAAGATGAACATTGTTTGGAAGGACGCAGCCAATGCAACGATTTCTACTACCTTCAATGACATGGCTCCACCTGTTGACGAGAATGGTGCAGCAATTCCTATTGATGGTGTGACCTGGATTCAGTTCACATCTCAGGGTGTTGCTCCAGTTGGTGCGACCACTGCCAGCTTTGAAATTCAGGCCGGTATTTCTGGTAGCCCTGTAGCTGGTATTCAGGGATGGTTTGATGACGTACTTATCACCACACCTCCACGAGTCAAGGTAGGTCTATTCGGTTTCGACAATGCCAACAATGTAATTGACTGGGATTTTGTTGACGCTGCAACGACTCCTACTAAGATGCACGCAATGCCTACCGACTACAGCCAGCTATCCGGACTTGCTGGTAATCAGTACATGATGGTTTCTAATGACCAGGAAGTAGCAATTGCTTCTGGTACAGGTAGCACTACTGCTGACTGGATTACCGTAACTGGTTATGTTCGCGGTCGTGGTGGTACTGGAACAGATGGTCTATTCGGTTCTCAGGGACAGGCAAATGACCCTTACGCCCCAGCAGCACTGAATCAGTCTGTTCGCTACCTTGTGCCTTATGTAGAATTCGATATTGCAACAGGTTCAAAGGCACAGCTTGACCAGTTCTCTATTGAAGCATATGAGAATGGTGCTCCAGGAAAGATTGATACAACTGATATCAACGGAACAAAGGGTATCTCAATTGAGAACATTGAGGATGACTCTGAGTTCGACCACGCTATCAGATTCTACACTGGTGCATCAGATGAAATGAAGCCTGGTATGATTGGTCACATTCTTGACGGTGACCTTAACAGCGCTGCTCATCTTCGTATGTCTCCACCAATGCTCAACAACGAGAGCACCTATGGTCGAGTCTACATGGGAATCTACGACAGAAACCCTAACTACATTTACGACTCTTCATTCCAGGCTGGAATTGTAAACTGGACTGCCAATACGGCAACTCCTGGTTCAGCAGTCTCTTGGGATGAAACTGTAGGCCATATTGAGCTAGGTTCCTTGAAGATTACTACAACTGGTACTCCAGTCGCAGCAACAGAAATCTATGGAAAGTATGACATCTACACAGAGCAGCATCCAGACCTTATTGGAAAGAAGATTTCCGTATCAGGTTGGTTCAAGCCTGGAATGATTAAGCCTATTCGTCTATATCTGAACTGTCATGACGAGACTGGCGCAATCATTATCAGTTACTACTTCCAGAAGACTCCTGTCAATACAACTGACTGGATTAAGCAGGCATGGACCATGCCAGTGGTTGTTCCTGACAATACGTACTATCTTCGTTACTTCTGGTGGTGGAACAATGCTGCGGCCGGTGACACCATTTGGGTTGATGAATGTCAGCTCGAAACTGGTGGTATCTCTAACTACAGAGATGCACAGTCATCACTTATCAGTCTTACTTCTGACACAGTTCGTTCAACTGGCTCAATCATTGTTTCAAGCTCTGACCTAGACCTTCCATTGAATATCTGGGGTGGAGGAAGCAGGCGTAGGGATGTTTCTACTTACCCATCATTCATTTCACAGACTGATGGTGGTAGTGGTGTATTCCGTGCGATTAACTATACTGACACCTACGGAAACCGTGCATCTACTCAGATGTCAAACTATTCTGCGGATGGAATCGAAGAGGCAGCAGTAAGAATCTATGCTGGACAGGATGATAGATATCCTGGACGAATTGCATTGACAAACCTTTCTGGAAGCTTTGCATTGTCAACATATGCTGACGATGGTTCCGACATGACTACAAGCACAAACGTTCGTGTCGGTGGTCACCTAGATGTACAGGGTAACCCACCTTGGGTCGCTCCAACATTGTCTAATGGTGTCAACTATTCATCTGCATACAATGTAGCTTACTACAAGAGCAACGGAAATGTTTACCTGCGTGGTGTACTCCAGACTTATACAAAGGCGACGACTTTGTTCACCTTGCCTTCTGGATATCGCCCGGCACAGACTGTGTACCTCAATGCTATTCAGTGGAGCAGCACGACATCAATTGGTGCTGTATTGCTCCAGGTAAATACTACTGGAACTGTACAGGTTACGTCTTCTGCAAGCACGCTGTCTCAGCTATCACTCGATGGTCTATGGTTCAGCATCGCTCCAGAAGCGGTAGCGCCTCCTGTCACTGGTGACACTACGCCCCCTGCTGCGCCTTCTGGCTTTAGCATCAATGCGTATAGCTCAGGTTCCTCAACTGGCGTTTACCAATTGAAGTGGACCAACCCAAGCACCTCTGACACGGCTGGTGTCAAGATTATCTGGAGAACTGACCGCTATCCAACAGTCACGATTCCTGCATCTGGTACAAGGACGCTTACCACTGATGGAAGCATCATTACAGTTACAGGAACTCCTTCTCAGGCTAAGTCTTACAACCATTCTGGACTTCCGGTCAACAAGACCATCTACTACAGAATTGTTGCTTACGATAAGTCTGGAAACCACTCTGGATATCTATCAGCTTCAAGGTATCTTCTTGCAAGCCCATTCACGATTTATGCTACGGATTCTGACGCATATCGTCTTGGATACGGAGGAATGTGGCGTAACGACGGTGACGCTCCTTATCAGGGTGACTGGACAGAGAATGACAACCACAGAGGACTATTCTTCTACGGAGATGGAATTTACAACAAGCTGGCAACTGGTGGTGTTGTAAGAACTCCTACCAAGATGACAGTTTATGTCCAAAGACAGAATACGTCTCATGGTAACAACTCTGGTGTTGGATTGAATCTACGTGGACACACATACGGTTCAAAGCCTTCTGGAGACCCGGTAGGTAAGATGACCAATGAAGGTTCTGATGGAGATAGCATTGTAGCTCTTTCAAGAGGAGAGGCTGCAACGGTTACAATTCCATCAAGCTGGTATAACAACTTTGTAGATTCAACATCTGCAAACCGACTAAGAGGTGTAGGTTGTTATGGTAGCACGACAAGCGAATATCTTGTCTTGTACGGAAAGAGTTCTGGTTCATCCCATGGAAAGATTACGGTCTATCACAAGGGATGA

Genome Context

Tertiary structure

YP_009611502.1
ESMFold2 structure
Source ESMFold2
pLDDT 66.4
Oligomeric state monomer