Genbank accession
YP_009807150.1 [GenBank]
Protein name
minor tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,51
Seq2Symm
C1 confidence 0,987 truncated
C1 0,987
C3 0,246
C2 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNDNSKKAAEALVQHFQGMVDGQAGNIQDLFDSLLPVQDFVNAILETLGGNPTAMATFFATWAENLPWLKDFENWVPNIGADLAGLRDAVEGTYVGNDVVLNAIQRAVGAIRSLAGGLIDPSRIPQIFLGQLSNQPSPNLLSGFGDFSAAGTIDGGDVWVWDESEGHTTPGSVRGTADGERHVLTSELVSVSEGQKLDLSGWAKWAQPKWPNMLTYSQATLETDESVLVATPIARRLNSNNAVLTRDNSWSDGGNYSVKLTADNKADTNFNWGGDGVFAPPYNAPGSFRMGTQPGRTYRMCATFRLTEAMTSATTGNRSLGLTAWYTRGQGSHTKVNIGEAAPNAAGEYRLEGDFTIPADATGAFFRIYFGYTTGTIWIDRMGLFDITDSVPPAGYYVQPHNGIGDTYTLSVIPQSGDIAGAESVIKAIANPSASGGWSELNGTYTVPAGVDGVRVRLGIEAPASAGVAWFDDVSLRKTATSLPQQWVSGLAETLGDLWDGLGNLIDNLLASLGIPPTGTIVDRILDLSDEFGDWLDDTQTQAAKFADLVGDLLADPGKVLGTLPQTLVSGLSTSLNSLQSFIQNLLNAILQGIRGVPVVGGSIANVIEDLTGMNKDVAAAAESADVAQAQIVTIQQVFAVRSNRPLWEGLDPTGESTFPYTQLAQPAAHGHTGSTNSTGNHTGHEGTANSRGAHSHDVTVTNWGTSEIPVAGSMTPGGCIRIESPVEKRQITFQARRSGAVSSFYIDVYHMEDDGSFTLLHSSANIAADILTVMTWQQVEIPPTLVELGDVIMIQFRANANCFVAGIQLPAPANALGFRPLQIGMLRNSSDAPAVLSQTAADSAYSGYTPYIQLGSDVGQLNAARNFYDNFNRTILGSNWAANWRSNSGGEYLTVSGNRLVNPTSGMLLYQRSLALYTLPLSSDDVSVEFDLTSVNGVASGVIICADNNAQNYVGAFVTTSGGGIWTNVGGVNGTMTERSTVAASNNNARWKITYTSADNTYRLYKNGALHTSWTDSTNIIGHGKGRRFCGAQIDNQSFTTGSPIDNWNAYDNEAGT
Physico‐chemical
properties
protein length:1058 AA
molecular weight: 112550,56820 Da
isoelectric point:4,64513
aromaticity:0,08507
hydropathy:-0,15633

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009807150.1 [NCBI]
Genbank nucleotide accession
NC_048021 [NCBI]
CDS location
range 31430 -> 34606
strand +
CDS
TTGAACGACAACAGCAAGAAGGCCGCCGAGGCTCTCGTCCAGCACTTCCAGGGCATGGTCGACGGGCAGGCCGGCAACATCCAGGACCTGTTCGACTCCCTGCTCCCGGTCCAGGACTTCGTCAACGCGATCCTGGAAACACTCGGCGGCAACCCCACCGCGATGGCGACCTTCTTCGCCACGTGGGCCGAAAACCTGCCCTGGCTCAAGGACTTCGAGAACTGGGTGCCCAACATCGGTGCCGACCTCGCAGGCCTGCGCGACGCGGTCGAGGGAACCTACGTCGGCAATGACGTGGTGCTCAACGCCATCCAGCGCGCAGTCGGCGCGATCCGCTCGCTGGCCGGCGGCCTCATCGACCCGTCGCGCATCCCGCAGATCTTCCTCGGGCAGCTGTCCAACCAGCCAAGCCCCAACCTACTCAGCGGCTTTGGCGACTTCTCGGCGGCCGGCACCATCGACGGCGGCGACGTCTGGGTCTGGGACGAATCCGAAGGCCACACCACCCCCGGCTCCGTTCGTGGCACCGCCGACGGTGAACGTCACGTCCTGACCTCCGAGCTGGTCTCGGTCAGCGAGGGGCAGAAGCTCGACCTCTCGGGCTGGGCGAAGTGGGCCCAGCCGAAGTGGCCGAACATGCTCACCTATTCGCAGGCGACGCTGGAAACCGATGAGTCCGTACTCGTTGCGACCCCCATCGCCCGGCGCCTGAACTCGAACAACGCCGTGCTCACCCGCGACAACTCGTGGTCCGACGGCGGCAACTACTCGGTCAAGCTCACCGCAGACAACAAGGCCGACACCAACTTCAACTGGGGCGGCGATGGCGTCTTCGCGCCGCCCTACAACGCCCCCGGGTCATTCCGCATGGGCACCCAGCCGGGCCGGACATACCGCATGTGCGCGACGTTCCGGCTCACCGAGGCCATGACGTCGGCAACGACAGGGAACCGAAGCCTCGGCCTGACCGCCTGGTACACCCGCGGCCAGGGCTCCCACACCAAGGTCAACATCGGCGAGGCGGCGCCCAACGCAGCAGGCGAGTACCGCCTGGAGGGCGACTTCACTATCCCCGCCGACGCCACGGGCGCATTCTTCCGCATCTACTTCGGCTACACCACCGGCACCATCTGGATCGACCGGATGGGCCTCTTCGACATCACCGATTCGGTCCCGCCGGCTGGCTACTATGTCCAGCCGCACAACGGCATCGGTGACACCTACACCCTGTCGGTCATTCCGCAGTCGGGCGACATCGCCGGCGCAGAGTCCGTCATCAAGGCCATCGCCAACCCCTCAGCTTCGGGCGGATGGTCGGAGCTGAATGGCACCTACACTGTGCCCGCCGGTGTCGACGGCGTTCGCGTGCGTCTCGGGATCGAGGCGCCGGCATCGGCCGGCGTTGCATGGTTCGACGACGTCTCCCTCCGCAAGACCGCCACATCACTCCCGCAGCAGTGGGTGTCAGGTCTCGCCGAGACCCTCGGCGACCTCTGGGATGGGCTCGGCAACCTCATCGACAACCTGCTTGCCTCCCTGGGCATTCCGCCCACCGGCACCATCGTCGATCGCATCCTCGATCTCTCCGACGAGTTCGGGGATTGGCTCGACGACACCCAGACCCAGGCCGCCAAGTTTGCCGATCTCGTCGGCGATCTCCTCGCCGACCCTGGCAAGGTGCTCGGAACACTGCCTCAGACTCTCGTCTCGGGGCTGTCGACCTCGCTGAACAGCCTGCAGTCGTTCATCCAGAACCTCCTCAACGCGATCCTCCAGGGCATCCGTGGCGTCCCCGTTGTCGGCGGCTCCATCGCCAACGTCATCGAGGACCTGACCGGGATGAACAAGGATGTCGCGGCCGCGGCAGAGTCTGCGGACGTCGCCCAGGCGCAGATCGTCACCATCCAGCAGGTGTTCGCCGTGCGCTCGAACCGCCCACTCTGGGAGGGCCTCGATCCGACCGGGGAATCGACCTTTCCCTATACCCAGCTCGCCCAGCCTGCCGCGCATGGACACACGGGGTCCACGAACTCAACCGGCAACCACACTGGCCACGAGGGCACCGCGAACAGCAGGGGCGCACACTCCCACGACGTCACTGTAACCAACTGGGGCACATCGGAGATTCCGGTCGCGGGATCGATGACGCCGGGCGGCTGTATCCGCATCGAATCCCCGGTCGAGAAGCGCCAGATCACATTCCAGGCCCGGCGCAGCGGTGCTGTGTCGTCGTTCTACATCGACGTCTACCACATGGAGGACGACGGCTCCTTCACGCTACTGCACTCCTCGGCGAACATCGCCGCCGACATCCTCACCGTCATGACCTGGCAGCAGGTCGAGATCCCGCCCACCCTCGTCGAGCTGGGCGACGTCATCATGATCCAGTTCCGCGCCAACGCAAACTGCTTCGTCGCCGGCATCCAGCTACCAGCCCCGGCGAACGCGCTCGGATTCCGGCCGTTGCAGATCGGCATGCTGCGCAACTCATCTGACGCACCCGCTGTTCTGTCACAGACCGCCGCCGACTCGGCCTACTCGGGCTACACCCCCTACATCCAGCTCGGGTCCGACGTCGGCCAGCTCAACGCAGCGCGCAACTTCTACGACAACTTCAACCGCACCATCCTGGGCTCCAACTGGGCGGCGAACTGGAGGTCGAACAGCGGGGGCGAGTACCTCACCGTCAGCGGGAACCGGCTGGTCAACCCGACCTCTGGCATGCTGCTGTACCAGCGTTCACTCGCTCTCTACACGCTGCCACTGTCCTCCGACGACGTGAGTGTCGAGTTCGACCTGACGTCCGTGAACGGCGTGGCTTCCGGTGTGATCATCTGCGCCGACAACAACGCGCAGAACTACGTCGGCGCATTCGTTACCACCAGCGGCGGCGGCATCTGGACCAACGTCGGCGGCGTCAACGGAACCATGACCGAACGATCGACCGTCGCGGCATCCAACAACAACGCCCGCTGGAAGATCACCTACACCTCAGCCGACAACACCTACCGGCTGTACAAGAACGGGGCCCTGCACACCTCCTGGACCGACTCGACCAACATCATCGGCCACGGCAAGGGGCGCCGATTCTGCGGCGCGCAGATCGACAATCAGAGCTTTACAACCGGGTCGCCGATCGACAACTGGAACGCCTACGACAACGAGGCGGGGACATGA

Genome Context

Tertiary structure

YP_009807150.1
ESMFold2 structure
Source ESMFold2
pLDDT 66.3
Oligomeric state monomer