Protein
- Genbank accession
- AUM58868.1 [GenBank]
- Protein name
- tail protein
- RBP type
-
TF
- Seq2Symm
-
C1 confidence 0,454
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C1 0,454 C3 0,335 C2 0,002 - Protein sequence
-
MASGSFNVTTSNRYVLGTVNWRSTPNTGGNYSEVYVEMRFSRTNTGYTTYGTGTFGLYVDGQQAVNTTGFSFTYNSNTLVVSGWFRIDHNSDGSKNLRIGASGYTDVFSINDAVAYVDLDRIPRASTVSSNISWTAAIEPLPISINRASTAFDHIVTVEVQKPDNSMAAVAWRSGVGDNVTFYFTKDETTILYQSIGGYENRPVKIRVQTWYNGSVIGETEKWGTVYGATPATPILSDFDIGTKSVPVTLDYYYAEFAYSLVFTFGSFSKTFSSGVGKTFTMTFDDADIAKMYQQTPNDNVKQANVWASTKYNGVELNDGVPKDQNKKVNLRVVNSNPTYAGGFTYLDSNSTTSTLTGNNQYIVQNKSTLQVKIPATAKATAQNSATMARYEVSVNGSTQSINYATTDLTLNFGTVDAATNATLTVTAIDSRGNRTSASSVILMLPYSPPNISASAERLNNFEASTTIKLSGTISPLTIGGVNKNSLPTVKFQRRQVGGTYDSPGTNFTITGNPNFTATNVVVSLDNTLAWEVLITVTDKVGSTVTALRTVAVGTPIFFIDTVKKTVGVNKFPTSAANGLEVAGDLDVDGILKLKKNQWIAQGKYSLHANGGDFMAVNSIYFSSPVQSVGQGLNFLRPGKTAGSTTPADYSTFGILDYSMRMNDQTVLYQFPNSSNIRLAGEFHSPQSNGTYLDPYGNVRGQPGAQGSETWGVTDVLSRNKILIPIGKNGGNTNYRAYGGNHRFERDDKFIVEFYTDGINNVANFGGGIFKWQSNMNRFELRNWNDTGWASMALDTLDATTVKTVNYVNTSSREYKTDIKPLEEDALQIILDSEICSYIMKDNPELGTRVGLIAEDAHELVQELGGKGVNGYTMNSLTWRAIQQLNAKLNAVIERQYKL
- Physico‐chemical
properties -
protein length: 899 AA molecular weight: 98026,94690 Da isoelectric point: 6,19104 aromaticity: 0,10567 hydropathy: -0,30000
Taxonomy
Coding sequence (CDS)
Genbank protein accession
AUM58868.1
[NCBI]
Genbank nucleotide accession
MG602477
[NCBI]
CDS location
range 55258 -> 57957
strand +
strand +
CDS
ATGGCAAGTGGTTCATTTAATGTCACTACCAGTAATAGATATGTTTTGGGTACTGTGAATTGGCGCAGTACCCCGAACACTGGTGGTAACTACAGTGAAGTATACGTAGAGATGCGTTTCTCTCGTACAAATACAGGATACACAACATACGGTACAGGTACATTCGGTCTGTATGTAGACGGACAGCAAGCAGTAAATACAACAGGGTTCTCATTCACATACAACTCTAACACACTGGTAGTTAGTGGTTGGTTTAGAATAGACCATAACTCAGACGGTTCTAAAAACTTACGTATCGGTGCAAGTGGTTACACAGACGTATTCTCAATCAATGATGCAGTAGCGTATGTAGACTTGGATCGTATCCCACGAGCAAGTACGGTGTCGTCTAACATTAGTTGGACCGCTGCTATCGAACCTCTACCTATCTCGATTAACCGTGCGTCTACTGCGTTCGACCACATTGTAACAGTAGAAGTACAGAAGCCTGATAACAGTATGGCCGCAGTTGCTTGGCGAAGCGGAGTAGGGGATAACGTAACATTCTACTTTACTAAGGACGAAACAACGATCCTGTATCAATCTATCGGTGGGTACGAGAACCGACCTGTAAAGATTAGGGTACAGACATGGTACAATGGTAGTGTGATTGGGGAGACAGAAAAGTGGGGGACTGTATACGGTGCTACACCTGCTACACCTATTCTATCCGACTTTGATATCGGTACGAAAAGCGTACCCGTAACACTAGATTACTATTACGCTGAGTTTGCGTATTCATTAGTGTTCACGTTCGGTAGTTTCTCAAAAACATTCTCTTCAGGTGTAGGAAAAACATTTACAATGACATTTGACGATGCTGATATTGCTAAGATGTACCAACAAACACCAAATGACAATGTGAAGCAAGCTAACGTTTGGGCAAGTACGAAGTACAACGGGGTAGAGCTTAACGATGGTGTACCGAAGGATCAGAATAAGAAAGTAAATCTACGGGTTGTAAACAGTAACCCTACGTATGCAGGAGGTTTCACTTATTTAGACTCGAATAGTACAACATCTACTCTTACAGGGAATAACCAGTATATCGTACAGAACAAGTCCACACTACAGGTTAAGATTCCTGCAACGGCTAAGGCTACCGCACAGAACAGTGCTACAATGGCTAGATACGAAGTATCGGTGAACGGTTCAACACAATCTATCAACTATGCTACAACTGACCTTACACTTAACTTCGGTACAGTAGATGCGGCTACTAATGCTACCTTGACAGTTACTGCAATTGATAGTAGGGGTAATAGGACATCTGCATCTTCTGTTATATTAATGTTGCCTTATTCACCACCTAATATTTCTGCTAGTGCAGAACGATTAAACAACTTTGAAGCTTCGACTACGATCAAGTTGAGTGGGACAATCTCACCTTTAACTATTGGTGGCGTGAATAAGAACTCTCTTCCAACTGTTAAATTCCAAAGAAGACAGGTAGGTGGTACGTACGATAGTCCAGGTACTAACTTCACAATAACAGGGAACCCGAACTTCACTGCAACGAACGTTGTAGTAAGCTTAGACAATACACTAGCTTGGGAGGTTCTGATTACAGTAACCGACAAAGTAGGTTCTACTGTAACGGCTCTACGAACTGTAGCGGTCGGTACTCCAATCTTCTTCATTGACACAGTGAAGAAAACAGTCGGAGTAAACAAGTTCCCTACTAGTGCGGCCAATGGTCTCGAAGTAGCAGGTGACTTGGACGTTGATGGTATACTTAAATTAAAGAAAAACCAGTGGATCGCACAAGGTAAATATAGCTTACATGCCAATGGGGGAGACTTTATGGCAGTTAACTCTATTTACTTCAGTAGTCCAGTACAGTCCGTTGGTCAAGGATTAAACTTCCTACGACCAGGTAAGACAGCAGGTTCGACAACTCCTGCCGACTATAGTACCTTTGGTATCTTGGATTACTCGATGAGAATGAACGACCAAACCGTTCTATATCAGTTCCCGAACTCATCTAACATTAGACTAGCAGGGGAGTTTCATTCACCACAAAGTAACGGTACTTACTTAGACCCTTACGGGAACGTTCGAGGTCAACCAGGGGCGCAAGGATCAGAGACTTGGGGTGTTACAGACGTTCTAAGTCGGAATAAAATACTTATCCCTATTGGTAAGAACGGAGGTAACACTAACTACCGTGCATACGGAGGAAACCACAGATTCGAAAGAGACGATAAATTTATCGTTGAGTTCTATACTGATGGTATTAACAACGTTGCGAACTTTGGGGGAGGTATCTTTAAATGGCAGTCTAATATGAACCGATTCGAACTACGTAACTGGAACGATACAGGTTGGGCTAGTATGGCACTAGACACATTAGATGCTACTACAGTAAAGACAGTTAACTATGTAAATACGTCTTCTAGAGAATATAAAACAGACATCAAACCTCTAGAGGAAGATGCACTACAAATCATCCTTGACTCAGAAATCTGCTCGTACATCATGAAAGACAATCCTGAACTTGGTACAAGAGTTGGTCTGATAGCTGAGGACGCTCATGAATTAGTTCAAGAACTTGGAGGTAAAGGTGTCAACGGTTACACAATGAACTCATTAACTTGGAGAGCAATTCAACAATTGAACGCAAAGCTCAATGCAGTTATCGAGAGACAATATAAACTATAA
Genome Context
Tertiary structure
AUM58868.1
ESMFold2 structure
Source
ESMFold2
pLDDT
70.2
Oligomeric state
monomer