Genbank accession
AUM58868.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,77
Seq2Symm
C1 confidence 0,454
C1 0,454
C3 0,335
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MASGSFNVTTSNRYVLGTVNWRSTPNTGGNYSEVYVEMRFSRTNTGYTTYGTGTFGLYVDGQQAVNTTGFSFTYNSNTLVVSGWFRIDHNSDGSKNLRIGASGYTDVFSINDAVAYVDLDRIPRASTVSSNISWTAAIEPLPISINRASTAFDHIVTVEVQKPDNSMAAVAWRSGVGDNVTFYFTKDETTILYQSIGGYENRPVKIRVQTWYNGSVIGETEKWGTVYGATPATPILSDFDIGTKSVPVTLDYYYAEFAYSLVFTFGSFSKTFSSGVGKTFTMTFDDADIAKMYQQTPNDNVKQANVWASTKYNGVELNDGVPKDQNKKVNLRVVNSNPTYAGGFTYLDSNSTTSTLTGNNQYIVQNKSTLQVKIPATAKATAQNSATMARYEVSVNGSTQSINYATTDLTLNFGTVDAATNATLTVTAIDSRGNRTSASSVILMLPYSPPNISASAERLNNFEASTTIKLSGTISPLTIGGVNKNSLPTVKFQRRQVGGTYDSPGTNFTITGNPNFTATNVVVSLDNTLAWEVLITVTDKVGSTVTALRTVAVGTPIFFIDTVKKTVGVNKFPTSAANGLEVAGDLDVDGILKLKKNQWIAQGKYSLHANGGDFMAVNSIYFSSPVQSVGQGLNFLRPGKTAGSTTPADYSTFGILDYSMRMNDQTVLYQFPNSSNIRLAGEFHSPQSNGTYLDPYGNVRGQPGAQGSETWGVTDVLSRNKILIPIGKNGGNTNYRAYGGNHRFERDDKFIVEFYTDGINNVANFGGGIFKWQSNMNRFELRNWNDTGWASMALDTLDATTVKTVNYVNTSSREYKTDIKPLEEDALQIILDSEICSYIMKDNPELGTRVGLIAEDAHELVQELGGKGVNGYTMNSLTWRAIQQLNAKLNAVIERQYKL
Physico‐chemical
properties
protein length:899 AA
molecular weight: 98026,94690 Da
isoelectric point:6,19104
aromaticity:0,10567
hydropathy:-0,30000

Taxonomy

Phage
Bacillus phage BCP01 [NCBI] · taxon 2059878

Coding sequence (CDS)

Genbank protein accession
AUM58868.1 [NCBI]
Genbank nucleotide accession
MG602477 [NCBI]
CDS location
range 55258 -> 57957
strand +
CDS
ATGGCAAGTGGTTCATTTAATGTCACTACCAGTAATAGATATGTTTTGGGTACTGTGAATTGGCGCAGTACCCCGAACACTGGTGGTAACTACAGTGAAGTATACGTAGAGATGCGTTTCTCTCGTACAAATACAGGATACACAACATACGGTACAGGTACATTCGGTCTGTATGTAGACGGACAGCAAGCAGTAAATACAACAGGGTTCTCATTCACATACAACTCTAACACACTGGTAGTTAGTGGTTGGTTTAGAATAGACCATAACTCAGACGGTTCTAAAAACTTACGTATCGGTGCAAGTGGTTACACAGACGTATTCTCAATCAATGATGCAGTAGCGTATGTAGACTTGGATCGTATCCCACGAGCAAGTACGGTGTCGTCTAACATTAGTTGGACCGCTGCTATCGAACCTCTACCTATCTCGATTAACCGTGCGTCTACTGCGTTCGACCACATTGTAACAGTAGAAGTACAGAAGCCTGATAACAGTATGGCCGCAGTTGCTTGGCGAAGCGGAGTAGGGGATAACGTAACATTCTACTTTACTAAGGACGAAACAACGATCCTGTATCAATCTATCGGTGGGTACGAGAACCGACCTGTAAAGATTAGGGTACAGACATGGTACAATGGTAGTGTGATTGGGGAGACAGAAAAGTGGGGGACTGTATACGGTGCTACACCTGCTACACCTATTCTATCCGACTTTGATATCGGTACGAAAAGCGTACCCGTAACACTAGATTACTATTACGCTGAGTTTGCGTATTCATTAGTGTTCACGTTCGGTAGTTTCTCAAAAACATTCTCTTCAGGTGTAGGAAAAACATTTACAATGACATTTGACGATGCTGATATTGCTAAGATGTACCAACAAACACCAAATGACAATGTGAAGCAAGCTAACGTTTGGGCAAGTACGAAGTACAACGGGGTAGAGCTTAACGATGGTGTACCGAAGGATCAGAATAAGAAAGTAAATCTACGGGTTGTAAACAGTAACCCTACGTATGCAGGAGGTTTCACTTATTTAGACTCGAATAGTACAACATCTACTCTTACAGGGAATAACCAGTATATCGTACAGAACAAGTCCACACTACAGGTTAAGATTCCTGCAACGGCTAAGGCTACCGCACAGAACAGTGCTACAATGGCTAGATACGAAGTATCGGTGAACGGTTCAACACAATCTATCAACTATGCTACAACTGACCTTACACTTAACTTCGGTACAGTAGATGCGGCTACTAATGCTACCTTGACAGTTACTGCAATTGATAGTAGGGGTAATAGGACATCTGCATCTTCTGTTATATTAATGTTGCCTTATTCACCACCTAATATTTCTGCTAGTGCAGAACGATTAAACAACTTTGAAGCTTCGACTACGATCAAGTTGAGTGGGACAATCTCACCTTTAACTATTGGTGGCGTGAATAAGAACTCTCTTCCAACTGTTAAATTCCAAAGAAGACAGGTAGGTGGTACGTACGATAGTCCAGGTACTAACTTCACAATAACAGGGAACCCGAACTTCACTGCAACGAACGTTGTAGTAAGCTTAGACAATACACTAGCTTGGGAGGTTCTGATTACAGTAACCGACAAAGTAGGTTCTACTGTAACGGCTCTACGAACTGTAGCGGTCGGTACTCCAATCTTCTTCATTGACACAGTGAAGAAAACAGTCGGAGTAAACAAGTTCCCTACTAGTGCGGCCAATGGTCTCGAAGTAGCAGGTGACTTGGACGTTGATGGTATACTTAAATTAAAGAAAAACCAGTGGATCGCACAAGGTAAATATAGCTTACATGCCAATGGGGGAGACTTTATGGCAGTTAACTCTATTTACTTCAGTAGTCCAGTACAGTCCGTTGGTCAAGGATTAAACTTCCTACGACCAGGTAAGACAGCAGGTTCGACAACTCCTGCCGACTATAGTACCTTTGGTATCTTGGATTACTCGATGAGAATGAACGACCAAACCGTTCTATATCAGTTCCCGAACTCATCTAACATTAGACTAGCAGGGGAGTTTCATTCACCACAAAGTAACGGTACTTACTTAGACCCTTACGGGAACGTTCGAGGTCAACCAGGGGCGCAAGGATCAGAGACTTGGGGTGTTACAGACGTTCTAAGTCGGAATAAAATACTTATCCCTATTGGTAAGAACGGAGGTAACACTAACTACCGTGCATACGGAGGAAACCACAGATTCGAAAGAGACGATAAATTTATCGTTGAGTTCTATACTGATGGTATTAACAACGTTGCGAACTTTGGGGGAGGTATCTTTAAATGGCAGTCTAATATGAACCGATTCGAACTACGTAACTGGAACGATACAGGTTGGGCTAGTATGGCACTAGACACATTAGATGCTACTACAGTAAAGACAGTTAACTATGTAAATACGTCTTCTAGAGAATATAAAACAGACATCAAACCTCTAGAGGAAGATGCACTACAAATCATCCTTGACTCAGAAATCTGCTCGTACATCATGAAAGACAATCCTGAACTTGGTACAAGAGTTGGTCTGATAGCTGAGGACGCTCATGAATTAGTTCAAGAACTTGGAGGTAAAGGTGTCAACGGTTACACAATGAACTCATTAACTTGGAGAGCAATTCAACAATTGAACGCAAAGCTCAATGCAGTTATCGAGAGACAATATAAACTATAA

Genome Context

Tertiary structure

AUM58868.1
ESMFold2 structure
Source ESMFold2
pLDDT 70.2
Oligomeric state monomer