Protein
- Genbank accession
- QIG59047.1 [GenBank]
- Protein name
- minor tail protein
- RBP type
-
TF
- Seq2Symm
-
I confidence 0,780
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).I 0,780 C2 0,127 C1 0,021 - Protein sequence
-
MYHGFLRLGGVDVVNTERARGYLLTSDCPSSLIQERPCETLNDALLDDPYTFDNMALAPWFDQSLPDVSSRFFGVVGLGVDQMRDSTRQASVTEGIAPGGTIGRTRKAVKQTRVRATLLARGDDALEYGNAWLNSVFDGACGMHGDGCGTMDMEFLADCPPARRLIPAFTDWAAIATNLFTNPGMELAQGTVPVRRNLILFTDTSSATGWTPTAGTVASEGGRLKYVSNGNAASRLGGVTLLSGMKAAGPYAVSFRAQTADPTLTGVRLYLYNSVTTAIVGTGIADVVAGGGENRYEWNITATGTFDRVYMEYTGTAIATGAIGFISEPLLEAGSVQRPFFNGAVRPRYRRNLSPNPRGLNTVGWTSNNGALNAVVREVAPPVPHPLGIPTAIMQSSTGTNNVLVSLYNVDGLANTGTPRRSLGVWVLVTEPGYTAYGVELVPNEWTFVRATDSFGPGAYTLFYVTKISGNASTTARAYLTGAIVEEGTAPVGEYFDGGIVASDGFVNQWVGTAERSASIMYDTDMTAVWSGTAGASEAVLSGAAVAGGVIGGNVSPFQSTRWKASGEKSLRLRPTGASTDSYVILRTLTAADAGKTLNLSLKVHLERPSSSSVSYARSFFVTTNATPANYQGPQVPNEAGVHELHWTFVVPETLTAGTIRFYHGGLAGDSDIWVDEFAAIEGAYDGFFDGSTPDGELQRFEWTGAENASTSVRETRSIIERLQTDEEYAEDVRPLRRFMHNVAVTSGPIVVDDRVALDGEMHVVTVEWTITAERPWIFSATRPVQLPTVETGLVQDVPYNLIPHPSAEISSGTVVLATNFSTNPSVETNATGWVAAKSGGPGTMVGARVVNELRAQGTASFRGVFTPGAAGTDVDIWVEQVVDISSRPANTRISINMWSAIASIAGSNSWAPPSVIAYWLDGPTGNVLRTDNLGTVDEIADSGAISAKSIAPPAGATHVRVRATSKINSFDAATVMRIYADALAVTAP
- Physico‐chemical
properties -
protein length: 989 AA molecular weight: 104936,19630 Da isoelectric point: 5,03778 aromaticity: 0,08595 hydropathy: -0,05207
Taxonomy
Coding sequence (CDS)
Genbank protein accession
QIG59047.1
[NCBI]
Genbank nucleotide accession
MN908694
[NCBI]
CDS location
range 25839 -> 28808
strand +
strand +
CDS
ATGTACCACGGGTTCCTTCGCCTGGGAGGCGTGGACGTCGTCAACACGGAGCGAGCTCGCGGCTACCTGCTCACCTCCGACTGCCCCTCGTCGCTGATCCAGGAGCGGCCCTGCGAGACGCTGAACGACGCGCTCCTCGACGACCCGTACACCTTCGACAACATGGCCCTGGCGCCGTGGTTCGACCAGTCCCTCCCGGACGTGTCGAGCCGGTTCTTCGGCGTTGTCGGCCTCGGTGTCGATCAGATGCGCGACTCGACCCGGCAGGCGTCGGTCACGGAGGGGATCGCCCCCGGTGGCACCATCGGCCGCACCCGTAAGGCCGTGAAGCAGACTCGGGTCCGCGCGACGCTGCTCGCCCGCGGCGACGACGCGCTCGAGTACGGCAACGCCTGGCTCAACTCGGTCTTCGACGGCGCGTGCGGCATGCACGGCGACGGCTGCGGCACGATGGACATGGAGTTCCTGGCCGACTGCCCTCCGGCGCGCAGGCTCATCCCCGCCTTCACCGACTGGGCCGCGATCGCCACGAACCTCTTCACGAACCCGGGTATGGAGCTCGCACAGGGCACCGTCCCCGTCCGTCGCAACCTCATCCTATTCACCGACACGAGCTCGGCGACCGGGTGGACCCCCACCGCCGGCACCGTGGCGTCCGAGGGCGGCCGGCTGAAGTACGTCTCGAACGGCAACGCCGCCTCGCGCCTGGGTGGCGTCACGCTCCTGTCCGGCATGAAGGCGGCGGGGCCGTACGCGGTCTCGTTCCGCGCACAGACGGCCGACCCGACCCTCACCGGCGTCCGGCTCTACCTCTACAACTCGGTCACCACCGCGATTGTCGGCACCGGCATCGCCGACGTCGTCGCGGGTGGCGGTGAAAACCGCTACGAGTGGAACATCACGGCGACCGGCACCTTCGACCGGGTCTACATGGAGTACACCGGCACGGCGATCGCGACCGGCGCCATCGGCTTCATCTCGGAGCCGCTGCTCGAGGCGGGCTCCGTGCAGCGCCCGTTCTTCAACGGCGCGGTGCGCCCTCGCTATCGCCGGAACCTCTCGCCGAACCCCCGTGGGCTGAACACGGTCGGCTGGACGTCGAACAACGGCGCCCTCAACGCCGTGGTGCGCGAGGTGGCGCCGCCGGTGCCGCACCCGCTCGGCATCCCCACCGCGATCATGCAGTCCTCGACCGGCACCAACAACGTGCTCGTCTCGCTCTACAACGTCGACGGCCTGGCGAACACGGGCACCCCTCGTCGCAGCCTGGGCGTGTGGGTGCTCGTCACGGAGCCTGGCTACACCGCCTACGGCGTCGAGCTCGTGCCGAACGAGTGGACCTTCGTGCGCGCCACCGACAGCTTCGGCCCCGGGGCGTACACGCTGTTCTACGTCACGAAGATCTCCGGCAACGCCTCCACCACGGCGCGCGCCTACCTCACCGGCGCGATCGTCGAGGAGGGCACCGCGCCCGTGGGCGAATACTTCGACGGCGGGATCGTCGCCAGCGACGGCTTCGTGAACCAGTGGGTCGGCACCGCTGAGCGCTCGGCGTCGATCATGTACGACACCGACATGACCGCCGTGTGGTCGGGCACTGCGGGCGCGAGCGAGGCCGTGCTGTCCGGCGCCGCGGTTGCCGGCGGGGTCATCGGCGGCAACGTCTCCCCGTTCCAGTCGACCCGCTGGAAGGCGTCCGGCGAGAAGTCGCTGCGCCTGCGCCCGACCGGGGCGAGCACGGACTCGTATGTGATCCTGCGCACGCTCACCGCGGCGGACGCCGGCAAGACGCTGAACCTCAGCCTCAAGGTGCACCTCGAGCGGCCGTCCTCCTCGAGCGTCTCGTACGCGCGGTCGTTCTTCGTCACCACGAACGCCACCCCGGCGAACTACCAGGGGCCGCAGGTGCCGAACGAGGCTGGCGTGCACGAGCTCCACTGGACCTTCGTGGTGCCGGAAACCCTCACCGCGGGCACGATCCGCTTCTACCACGGCGGTCTCGCGGGCGATAGCGACATCTGGGTCGACGAGTTCGCCGCCATCGAGGGCGCCTACGACGGGTTCTTCGACGGCTCCACCCCCGACGGCGAGCTTCAGCGATTCGAGTGGACCGGCGCGGAGAACGCCAGCACGTCTGTGCGCGAGACGCGGTCCATCATCGAGCGCCTGCAGACGGACGAGGAGTACGCCGAGGACGTGCGGCCGCTGCGCCGCTTCATGCACAACGTCGCCGTGACCAGCGGCCCCATCGTCGTCGACGACCGGGTGGCCCTCGACGGCGAGATGCATGTCGTCACCGTGGAGTGGACGATCACCGCGGAGCGCCCGTGGATCTTCTCGGCCACGCGCCCTGTGCAGCTGCCGACTGTCGAGACCGGCCTGGTGCAGGACGTCCCGTACAACCTGATCCCACACCCGTCGGCGGAGATCTCGAGCGGCACCGTGGTGCTCGCGACGAACTTCTCCACGAACCCGTCCGTCGAGACGAACGCGACCGGCTGGGTGGCGGCGAAGTCCGGCGGCCCGGGGACGATGGTCGGCGCCCGCGTCGTGAACGAGCTTCGCGCGCAGGGCACCGCCTCCTTCCGCGGCGTCTTCACGCCCGGGGCTGCAGGCACCGACGTCGACATCTGGGTGGAGCAGGTCGTCGACATCAGCAGTCGGCCCGCGAACACGCGCATCTCGATCAACATGTGGTCGGCGATCGCGAGCATCGCAGGCTCGAACTCGTGGGCGCCGCCGAGCGTGATCGCGTACTGGCTGGACGGCCCCACCGGGAACGTCCTGCGCACGGACAACCTCGGGACCGTCGATGAGATCGCAGACTCCGGCGCCATCTCCGCCAAGAGCATCGCCCCGCCCGCTGGCGCCACGCATGTGCGCGTCCGCGCGACCAGCAAGATCAACAGCTTCGACGCTGCTACCGTGATGCGCATCTACGCTGACGCGCTCGCCGTCACCGCACCCTAG
Genome Context
Tertiary structure
QIG59047.1
ESMFold2 structure
Source
ESMFold2
pLDDT
77.3
Oligomeric state
monomer