Protein
- Genbank accession
- YP_009611502.1 [GenBank]
- Protein name
- minor tail protein
- RBP type
-
TSP
- Seq2Symm
-
C3 confidence 0,948 truncated
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C3 0,948 C1 0,832 I 0,002 - Protein sequence
-
MRILLRDLTPGTDYNIQLRSNDGTNVSDWSRIFPLTTIQDTLAPAHPVNLSWVVNRTAFSAKWDAVTQNEDASPLEDFSHYVVRLTDGTTVVEVKTANTFYDLAFETNKAFFGTPKPTVSITVFAVDLTGNRSVASTTISATNPPPPDPTGVAAAGIVGGVSMKWDVQVIDDLAAYDVYMSTTGSGFTPSNSNRIYSGTGNAVVFDSSSLGIVHYFKIRSRDVFDSISNYVTVSATPISPTDVDTTAPGVPTGLAVTMAVDTNDSAFATAALSWTAPSDTDLAGYVVRYKQNASSTYDYVNVPVGTTSITIGGLVVGVQYNFSVQSFDRSTNRSAFSTAVNGTAVNTAPSTPAAPTAVADVMSIQVSHALQKATSGRLESDVSYLEVHLGTTSTFTASDSTMIGQLQVEPGSTFVSEVFNTPAQDTSLARWVRVIAVDRGGLKSSASAVASVTVGLISNAYIANATITSAKINNLDANKITAGTGIINALLIKSSLTVDTGGTVKSTNYAAGSTGYQLSNNTLEINQGTIRAAALLLQDAPNIVLPQYADFEFQSSWYTGKQVTFNDGGTTTWAIATAPEVTPKYGTQCLKHTWTGGGTFSRVYQGLSYTDYNVIVEPNTDYIASVWVYNPSGSGDKVVGFGVKMGDGATYPQPGGTPTVVANGTWTRIQGTFNTGANSTLMTYMSLYNAGSVYFDGIQIERKLTSATTASPWRAPSTTSIDGGIIRTGEIRSTALANGLSGQPAWSINLTGGAQFGDATVRGRIVVGDPANPTADGTNSRIHSSNYSAGVSGWIIRNDGYAEFRQLAVNSIKVTALDSPMQNNTYAKLFDYMQDGTLWLTSGAVTQKTDPGAYSAESLFEFTGPGLVLRNAVGVTKVAYDPTILYRISARIRAYEVATLNANSGFETNTSGWFAYGSNSITRDTTKFFAGTASVRWDQVGTSNGVYGMGTVVNVKAGRTYNFAARVLPNSTVIRDNLKMNIVWKDAANATISTTFNDMAPPVDENGAAIPIDGVTWIQFTSQGVAPVGATTASFEIQAGISGSPVAGIQGWFDDVLITTPPRVKVGLFGFDNANNVIDWDFVDAATTPTKMHAMPTDYSQLSGLAGNQYMMVSNDQEVAIASGTGSTTADWITVTGYVRGRGGTGTDGLFGSQGQANDPYAPAALNQSVRYLVPYVEFDIATGSKAQLDQFSIEAYENGAPGKIDTTDINGTKGISIENIEDDSEFDHAIRFYTGASDEMKPGMIGHILDGDLNSAAHLRMSPPMLNNESTYGRVYMGIYDRNPNYIYDSSFQAGIVNWTANTATPGSAVSWDETVGHIELGSLKITTTGTPVAATEIYGKYDIYTEQHPDLIGKKISVSGWFKPGMIKPIRLYLNCHDETGAIIISYYFQKTPVNTTDWIKQAWTMPVVVPDNTYYLRYFWWWNNAAAGDTIWVDECQLETGGISNYRDAQSSLISLTSDTVRSTGSIIVSSSDLDLPLNIWGGGSRRRDVSTYPSFISQTDGGSGVFRAINYTDTYGNRASTQMSNYSADGIEEAAVRIYAGQDDRYPGRIALTNLSGSFALSTYADDGSDMTTSTNVRVGGHLDVQGNPPWVAPTLSNGVNYSSAYNVAYYKSNGNVYLRGVLQTYTKATTLFTLPSGYRPAQTVYLNAIQWSSTTSIGAVLLQVNTTGTVQVTSSASTLSQLSLDGLWFSIAPEAVAPPVTGDTTPPAAPSGFSINAYSSGSSTGVYQLKWTNPSTSDTAGVKIIWRTDRYPTVTIPASGTRTLTTDGSIITVTGTPSQAKSYNHSGLPVNKTIYYRIVAYDKSGNHSGYLSASRYLLASPFTIYATDSDAYRLGYGGMWRNDGDAPYQGDWTENDNHRGLFFYGDGIYNKLATGGVVRTPTKMTVYVQRQNTSHGNNSGVGLNLRGHTYGSKPSGDPVGKMTNEGSDGDSIVALSRGEAATVTIPSSWYNNFVDSTSANRLRGVGCYGSTTSEYLVLYGKSSGSSHGKITVYHKG
- Physico‐chemical
properties -
protein length: 2001 AA molecular weight: 213714,30090 Da isoelectric point: 5,16026 aromaticity: 0,10095 hydropathy: -0,19190
Taxonomy
Phage
Streptomyces phage Samisti12
[NCBI]
· taxon 2023995
Host
No host information
Coding sequence (CDS)
Genbank protein accession
YP_009611502.1
[NCBI]
Genbank nucleotide accession
NC_042012
[NCBI]
CDS location
range 46744 -> 52749
strand +
strand +
CDS
ATGAGAATTCTACTAAGAGACCTTACACCAGGAACAGACTACAACATTCAGCTTCGGTCAAACGATGGAACAAACGTTTCAGACTGGAGCCGAATCTTTCCGCTTACTACGATTCAGGATACGCTGGCTCCAGCCCATCCTGTTAATCTGTCATGGGTAGTCAATCGAACCGCATTTTCCGCTAAATGGGATGCGGTTACTCAGAATGAGGATGCAAGCCCTCTTGAGGATTTCTCTCACTATGTAGTCAGACTGACTGATGGCACGACTGTTGTCGAAGTAAAGACTGCAAATACATTCTACGACCTAGCCTTCGAAACCAATAAGGCTTTCTTTGGCACGCCAAAGCCTACGGTCAGCATTACCGTATTTGCTGTTGACCTTACAGGTAACCGCTCTGTAGCCTCTACGACTATATCAGCAACCAACCCACCACCACCTGACCCAACTGGAGTAGCAGCAGCCGGTATCGTAGGTGGCGTTAGCATGAAGTGGGACGTTCAGGTAATCGATGACCTTGCAGCTTATGATGTATACATGAGCACCACTGGCTCTGGATTCACTCCAAGCAACTCTAACCGTATTTACAGCGGTACAGGAAATGCTGTCGTATTCGACTCAAGCTCTCTGGGAATTGTTCACTACTTCAAGATTCGCTCTCGTGACGTATTCGATAGCATTTCAAACTATGTCACTGTTTCTGCGACTCCTATTTCCCCAACTGATGTAGACACGACAGCGCCCGGTGTTCCAACAGGTCTAGCTGTAACCATGGCTGTAGATACTAATGACTCAGCCTTTGCGACAGCAGCTCTTTCATGGACCGCTCCATCTGATACCGACCTTGCTGGATATGTTGTCCGATACAAGCAGAATGCAAGTAGCACCTACGACTACGTAAATGTCCCTGTAGGCACGACCTCAATTACTATTGGAGGTCTAGTTGTTGGTGTCCAGTACAACTTCTCTGTACAGTCATTCGACCGAAGCACCAACAGAAGTGCATTCTCCACTGCGGTAAATGGAACAGCAGTTAACACTGCTCCGTCAACTCCAGCAGCTCCAACCGCTGTGGCTGACGTAATGAGCATTCAGGTAAGCCACGCATTGCAGAAGGCAACATCTGGTCGTCTTGAGTCTGACGTTAGCTACCTTGAGGTCCACCTAGGAACCACGTCTACGTTCACCGCAAGCGACTCTACGATGATTGGGCAATTGCAGGTAGAGCCTGGCAGCACCTTCGTTTCCGAAGTTTTCAATACGCCTGCCCAGGACACTTCTCTGGCACGTTGGGTACGAGTCATTGCCGTTGACCGAGGTGGATTGAAGTCTTCTGCTTCCGCAGTTGCTTCTGTCACTGTCGGTCTAATCAGCAATGCCTACATTGCTAATGCGACCATTACCTCTGCTAAGATTAACAATCTGGATGCCAACAAGATTACGGCCGGTACGGGTATTATCAATGCCCTTCTCATCAAGTCTTCTTTGACTGTAGACACAGGCGGTACTGTAAAGAGCACCAATTACGCAGCAGGCTCAACTGGATATCAGCTATCCAACAATACTCTGGAAATCAACCAGGGTACTATTCGAGCTGCCGCATTGCTTCTACAGGATGCTCCAAACATCGTTCTGCCTCAGTACGCTGACTTTGAATTCCAGTCAAGCTGGTACACCGGAAAGCAGGTTACCTTCAATGATGGTGGAACGACGACTTGGGCAATTGCAACTGCTCCAGAAGTTACACCAAAGTATGGAACTCAGTGTCTCAAGCACACCTGGACTGGTGGAGGAACATTCTCACGAGTTTACCAGGGTCTAAGCTACACAGACTACAATGTCATTGTAGAACCAAACACTGACTACATTGCCTCTGTATGGGTTTACAATCCATCAGGCTCCGGTGATAAGGTAGTCGGTTTTGGTGTAAAGATGGGCGACGGTGCAACTTATCCACAGCCTGGCGGAACGCCAACAGTTGTCGCAAATGGAACGTGGACTCGAATTCAGGGTACATTCAACACTGGTGCAAACAGCACTTTGATGACCTACATGAGCCTCTACAATGCTGGCTCTGTCTACTTCGATGGAATTCAGATTGAGCGAAAGCTCACCAGCGCAACGACAGCTTCACCATGGCGTGCACCAAGCACGACCTCAATTGATGGTGGAATCATTCGTACTGGTGAAATCCGTTCAACCGCTTTGGCAAATGGCCTCTCAGGACAGCCAGCCTGGTCAATTAACTTGACTGGTGGGGCTCAGTTTGGTGATGCCACAGTCCGAGGACGAATCGTAGTAGGTGACCCAGCGAACCCAACTGCTGACGGTACGAATTCACGTATCCACTCTTCAAACTATTCAGCCGGTGTAAGTGGTTGGATTATCCGTAATGATGGATATGCAGAATTCCGTCAGCTAGCTGTTAACTCAATCAAGGTAACTGCACTGGACTCCCCAATGCAGAACAACACCTACGCAAAGCTCTTTGACTACATGCAGGACGGAACGCTATGGCTGACCTCTGGTGCTGTGACTCAGAAGACTGACCCTGGTGCATACTCCGCTGAATCTCTATTCGAATTCACCGGACCTGGCCTGGTACTCAGAAATGCTGTCGGTGTTACCAAGGTTGCTTATGACCCAACCATTCTATACCGTATCTCAGCTCGTATCCGTGCATATGAGGTAGCGACGCTGAACGCCAACTCTGGCTTTGAGACAAACACGTCAGGGTGGTTTGCCTACGGCTCAAACAGCATTACCAGAGACACCACCAAGTTCTTTGCAGGCACCGCTTCTGTACGTTGGGACCAGGTTGGTACGTCCAATGGAGTCTACGGAATGGGAACGGTTGTCAACGTCAAGGCTGGTAGAACATACAACTTTGCAGCTCGTGTGCTTCCAAATAGCACTGTCATCCGAGACAATCTCAAGATGAACATTGTTTGGAAGGACGCAGCCAATGCAACGATTTCTACTACCTTCAATGACATGGCTCCACCTGTTGACGAGAATGGTGCAGCAATTCCTATTGATGGTGTGACCTGGATTCAGTTCACATCTCAGGGTGTTGCTCCAGTTGGTGCGACCACTGCCAGCTTTGAAATTCAGGCCGGTATTTCTGGTAGCCCTGTAGCTGGTATTCAGGGATGGTTTGATGACGTACTTATCACCACACCTCCACGAGTCAAGGTAGGTCTATTCGGTTTCGACAATGCCAACAATGTAATTGACTGGGATTTTGTTGACGCTGCAACGACTCCTACTAAGATGCACGCAATGCCTACCGACTACAGCCAGCTATCCGGACTTGCTGGTAATCAGTACATGATGGTTTCTAATGACCAGGAAGTAGCAATTGCTTCTGGTACAGGTAGCACTACTGCTGACTGGATTACCGTAACTGGTTATGTTCGCGGTCGTGGTGGTACTGGAACAGATGGTCTATTCGGTTCTCAGGGACAGGCAAATGACCCTTACGCCCCAGCAGCACTGAATCAGTCTGTTCGCTACCTTGTGCCTTATGTAGAATTCGATATTGCAACAGGTTCAAAGGCACAGCTTGACCAGTTCTCTATTGAAGCATATGAGAATGGTGCTCCAGGAAAGATTGATACAACTGATATCAACGGAACAAAGGGTATCTCAATTGAGAACATTGAGGATGACTCTGAGTTCGACCACGCTATCAGATTCTACACTGGTGCATCAGATGAAATGAAGCCTGGTATGATTGGTCACATTCTTGACGGTGACCTTAACAGCGCTGCTCATCTTCGTATGTCTCCACCAATGCTCAACAACGAGAGCACCTATGGTCGAGTCTACATGGGAATCTACGACAGAAACCCTAACTACATTTACGACTCTTCATTCCAGGCTGGAATTGTAAACTGGACTGCCAATACGGCAACTCCTGGTTCAGCAGTCTCTTGGGATGAAACTGTAGGCCATATTGAGCTAGGTTCCTTGAAGATTACTACAACTGGTACTCCAGTCGCAGCAACAGAAATCTATGGAAAGTATGACATCTACACAGAGCAGCATCCAGACCTTATTGGAAAGAAGATTTCCGTATCAGGTTGGTTCAAGCCTGGAATGATTAAGCCTATTCGTCTATATCTGAACTGTCATGACGAGACTGGCGCAATCATTATCAGTTACTACTTCCAGAAGACTCCTGTCAATACAACTGACTGGATTAAGCAGGCATGGACCATGCCAGTGGTTGTTCCTGACAATACGTACTATCTTCGTTACTTCTGGTGGTGGAACAATGCTGCGGCCGGTGACACCATTTGGGTTGATGAATGTCAGCTCGAAACTGGTGGTATCTCTAACTACAGAGATGCACAGTCATCACTTATCAGTCTTACTTCTGACACAGTTCGTTCAACTGGCTCAATCATTGTTTCAAGCTCTGACCTAGACCTTCCATTGAATATCTGGGGTGGAGGAAGCAGGCGTAGGGATGTTTCTACTTACCCATCATTCATTTCACAGACTGATGGTGGTAGTGGTGTATTCCGTGCGATTAACTATACTGACACCTACGGAAACCGTGCATCTACTCAGATGTCAAACTATTCTGCGGATGGAATCGAAGAGGCAGCAGTAAGAATCTATGCTGGACAGGATGATAGATATCCTGGACGAATTGCATTGACAAACCTTTCTGGAAGCTTTGCATTGTCAACATATGCTGACGATGGTTCCGACATGACTACAAGCACAAACGTTCGTGTCGGTGGTCACCTAGATGTACAGGGTAACCCACCTTGGGTCGCTCCAACATTGTCTAATGGTGTCAACTATTCATCTGCATACAATGTAGCTTACTACAAGAGCAACGGAAATGTTTACCTGCGTGGTGTACTCCAGACTTATACAAAGGCGACGACTTTGTTCACCTTGCCTTCTGGATATCGCCCGGCACAGACTGTGTACCTCAATGCTATTCAGTGGAGCAGCACGACATCAATTGGTGCTGTATTGCTCCAGGTAAATACTACTGGAACTGTACAGGTTACGTCTTCTGCAAGCACGCTGTCTCAGCTATCACTCGATGGTCTATGGTTCAGCATCGCTCCAGAAGCGGTAGCGCCTCCTGTCACTGGTGACACTACGCCCCCTGCTGCGCCTTCTGGCTTTAGCATCAATGCGTATAGCTCAGGTTCCTCAACTGGCGTTTACCAATTGAAGTGGACCAACCCAAGCACCTCTGACACGGCTGGTGTCAAGATTATCTGGAGAACTGACCGCTATCCAACAGTCACGATTCCTGCATCTGGTACAAGGACGCTTACCACTGATGGAAGCATCATTACAGTTACAGGAACTCCTTCTCAGGCTAAGTCTTACAACCATTCTGGACTTCCGGTCAACAAGACCATCTACTACAGAATTGTTGCTTACGATAAGTCTGGAAACCACTCTGGATATCTATCAGCTTCAAGGTATCTTCTTGCAAGCCCATTCACGATTTATGCTACGGATTCTGACGCATATCGTCTTGGATACGGAGGAATGTGGCGTAACGACGGTGACGCTCCTTATCAGGGTGACTGGACAGAGAATGACAACCACAGAGGACTATTCTTCTACGGAGATGGAATTTACAACAAGCTGGCAACTGGTGGTGTTGTAAGAACTCCTACCAAGATGACAGTTTATGTCCAAAGACAGAATACGTCTCATGGTAACAACTCTGGTGTTGGATTGAATCTACGTGGACACACATACGGTTCAAAGCCTTCTGGAGACCCGGTAGGTAAGATGACCAATGAAGGTTCTGATGGAGATAGCATTGTAGCTCTTTCAAGAGGAGAGGCTGCAACGGTTACAATTCCATCAAGCTGGTATAACAACTTTGTAGATTCAACATCTGCAAACCGACTAAGAGGTGTAGGTTGTTATGGTAGCACGACAAGCGAATATCTTGTCTTGTACGGAAAGAGTTCTGGTTCATCCCATGGAAAGATTACGGTCTATCACAAGGGATGA
Genome Context
Tertiary structure
YP_009611502.1
ESMFold2 structure
Source
ESMFold2
pLDDT
66.4
Oligomeric state
monomer