Genbank accession
AOO11347.1 [GenBank]
Protein name
structural protein
RBP type
TF
Evidence RBPdetect2
Probability 0,86
Seq2Symm
C3 confidence 0,997 truncated
C3 0,997
C1 0,095
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MANRIQLRRGSATQWSNANPTLAQGELGIELDTGRIKIGDGVTAWNSLRYERPIESVSATANTLVQRDADGNFSAGTITASLIGNASTASRLSSTRQIQLSQDVTGSGVFDGSANLNINAVLGLVPSLPHYDGTDTSSGTYTKVVVDAKGRITNASNPTTIQDYGLDGTVVGQSAQPYDLDLISLTNLPDGAAGFGIVTRTSTGNITVRYIVTASTQRIIVDNGDGIGGNPAIDLANTTVVPDPTTYSDGNYNTESLTSVTSVGAKGEPVGTQTVNTVKFTVDKYGRLQSATNVPIATATEGSKYPTYSAGASYSRYDIIEEGGNVYQAIQDILAGSGAPAHTDSSDTGGWRFLASAATEQKGLASFAQEDFDVDNNGHVTIAAAGVDNTQLQNNRIIFTDQNTVQEFELDNELTTATAHTGFDYLNYIKVNDTSGNLLFGANNTGDGGAGEIDINVRSYFSDPDITLDGIVAQTLDKTGDGDLTLQLTQNTASNRNFNILTTNAGSGTSNIIVTAEDTVQISASQAAGKVWVEDARFQDNYIATTNATLNLDPGDDRAVTGTVRVWGDLQVDGTTTTVNSTTLQVDDPIVTLGGDTAPVANDNLDRGVEFRYYDSAAKLGFYGYDASYSDLAGHTGGYRFLYDATNTSEVFSGTDAGIIAGNLKLTTNTNSTSNTTGDLVLAGGAGIGQDVNIGGLLDVDSTLRVHSTSRFDDSMVIQGASKTLQLNNGTGTTRIELQSTTGNADFYGIVNITNDLNINTNKFNVASATGNTLIAGTLGVTGQTTLTGALDLNNTLNVSGFTYLESTDEPQIALNSGTGLYEIQNSDYGAFRFNGGGYIEGDFMFNSDVYVNGTVVQKEDETAVFNRQNYLNVRYILYAGSSSARTPSYATDTTTNLRVFGGAGIATDLHIGDDLYIGKLNSSDTIEFQVVGESGNTTIGRSGAGTNSVGTLTVHGDVTFNRDLFANGNITLGNATSDTLTVQANSEFNGTVDVDADFAVRNGTTDKFFVDNVTGNTDIQGTLYVLGNTNIDGTLDVDSNFAVRSGTTDKFTVASASGNVATDGTLVVQGQTTINDSLIVDAANEVFSIRNGSAIEKFSVDADNGNTNIIGTLTVGDATQINDTFGVSGIVTSTNNTQQSINGNSIALDGAARFSGGVGVAKNLAVGEDLMVYGDFNIVGNQVINGTTTYNARIDITNTAEADSLSDNNVAFQVDGGGIIRKKLWAGGDFTVYDTANARNAFFVDVSTGDATLHNTLTVGGDLIVNGTTTTVNSTVTTLDDPIITLGGDTAPTTNDGKDRGVEFRYYDGSAKVGFFGFDRSSSQFTFLTDSTNVSEVHTGTDAALRAGSLNLTGTGTILDVDANANIDGTLTVDGQIISQVTSGPALVIPNTTKINNLNADLLDGYTTATANTASTVVVRDASGDFAAGTITASLAGNATTASRLQTARTITIDGVVDGSVSFNGSSNVTISTTYNDADITALAAMAGTGLVTRTAANTYAQRSVTATAASGITITNADGVSGDITINVASASTNASNNLVLRDASGNFAAGTITASLVGNVTGNVTGNVTGDLTGQADGADRVVTQEVTTNFDYPIVFASARFTTPTNTQIYTEASGGAAATYNPSTKTLEVETIKCDTISPRDPGAIQFNINANSVTATIGFTGDLTGDVTGDVTGNADTATVADTATQVATQTVQTNFNQEHFLPFVVSNSASVINQSVLTDGGATYNPFQNRITAQTFAGDLTGDVTGNVDGNVAGEVTLEGTVPATATDPGTAGDVRYDADYVYVCVATNTWKRSALATW
Physico‐chemical
properties
protein length:1806 AA
molecular weight: 187513,49990 Da
isoelectric point:4,14359
aromaticity:0,06921
hydropathy:-0,16196

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AOO11347.1 [NCBI]
Genbank nucleotide accession
KX349290 [NCBI]
CDS location
range 82805 -> 88225
strand +
CDS
ATGGCAAATAGAATTCAGTTAAGACGTGGCTCGGCTACGCAGTGGAGTAATGCAAACCCCACTCTAGCTCAAGGCGAGTTGGGAATCGAACTTGATACGGGTCGTATCAAAATCGGTGATGGTGTTACCGCATGGAACTCATTGAGGTATGAGAGACCGATTGAATCTGTGTCAGCAACTGCCAATACTTTGGTGCAACGTGATGCCGATGGAAATTTCTCGGCAGGAACAATCACAGCATCCTTAATTGGTAATGCTTCTACTGCATCTAGACTGTCATCTACACGCCAGATTCAGTTGTCTCAAGACGTTACTGGTTCTGGTGTTTTTGATGGTTCTGCTAACTTAAATATTAATGCTGTTCTTGGATTAGTGCCATCGTTACCACATTACGATGGTACAGATACTTCTAGTGGCACTTACACAAAAGTTGTAGTTGATGCCAAGGGTAGAATAACCAATGCTTCCAATCCAACCACTATTCAAGACTACGGACTAGATGGCACTGTTGTTGGTCAATCTGCTCAACCATATGACCTCGATTTAATATCGCTCACAAATCTTCCTGATGGTGCCGCAGGTTTTGGTATTGTTACCCGAACATCTACAGGTAACATTACCGTTAGATATATTGTAACTGCTTCGACACAACGCATCATTGTTGATAATGGTGATGGTATTGGCGGCAATCCCGCAATCGATTTAGCAAACACTACTGTTGTTCCAGACCCAACAACATATAGTGATGGTAACTATAATACAGAATCGTTAACTTCAGTAACTAGTGTTGGTGCCAAAGGAGAACCAGTAGGAACTCAAACAGTAAATACTGTCAAATTTACTGTTGATAAGTACGGTCGTCTTCAATCTGCTACAAATGTACCAATTGCTACTGCTACCGAAGGTAGCAAGTATCCTACATATAGTGCTGGGGCATCTTATTCCCGATATGACATCATCGAAGAAGGTGGCAACGTTTATCAAGCCATTCAAGATATTCTTGCGGGTTCTGGTGCCCCAGCTCATACTGATAGCAGCGATACTGGAGGATGGAGGTTCCTCGCGTCTGCGGCAACAGAGCAGAAGGGACTGGCTAGCTTTGCACAGGAAGATTTCGACGTTGACAACAACGGGCATGTCACCATTGCCGCCGCTGGTGTAGATAACACCCAATTACAGAATAATAGAATTATCTTTACTGACCAGAACACTGTTCAAGAGTTTGAGTTAGATAACGAACTCACTACTGCTACAGCACATACTGGTTTTGATTATCTTAACTATATTAAAGTTAATGACACGAGTGGTAATTTACTGTTCGGCGCTAATAATACAGGTGACGGTGGTGCTGGTGAGATTGATATCAATGTACGCTCGTACTTCAGCGATCCTGATATCACTCTTGATGGTATTGTTGCTCAAACCCTGGACAAGACTGGAGATGGTGACCTCACTCTTCAATTAACACAGAATACTGCTTCCAACAGAAACTTCAACATCCTGACAACAAATGCTGGTTCTGGAACTAGCAACATTATTGTCACTGCTGAAGATACTGTTCAAATTAGTGCATCTCAAGCAGCAGGTAAAGTTTGGGTAGAGGATGCACGTTTCCAAGATAATTATATTGCTACAACCAATGCAACTCTCAACCTTGATCCTGGTGATGATAGGGCGGTTACTGGAACCGTCAGAGTTTGGGGTGATTTACAGGTTGACGGCACCACGACGACGGTCAATTCGACGACCCTTCAGGTTGATGACCCCATTGTTACTCTTGGTGGTGATACTGCTCCTGTTGCTAACGATAATCTCGATAGAGGCGTTGAGTTCAGATATTATGATAGTGCAGCAAAGCTTGGATTCTACGGTTACGATGCTTCGTATTCTGATCTCGCAGGTCATACAGGAGGATACCGATTCCTCTACGATGCTACAAACACTTCTGAAGTCTTCTCTGGAACAGATGCAGGCATCATCGCTGGTAACCTTAAACTAACTACCAACACTAACTCCACCTCCAATACAACTGGCGACCTTGTACTTGCTGGTGGTGCTGGTATCGGTCAGGATGTTAATATTGGTGGTCTTCTGGATGTTGACAGCACTCTGCGCGTCCACAGCACCTCTCGCTTTGATGACAGCATGGTCATCCAAGGTGCTTCTAAGACACTGCAACTGAATAATGGTACTGGTACAACTCGTATTGAGTTGCAATCTACAACTGGTAATGCTGATTTCTATGGTATCGTCAATATTACCAATGACCTTAACATCAACACTAATAAATTTAATGTTGCTTCTGCAACTGGTAACACTCTCATTGCTGGTACACTTGGAGTAACTGGTCAGACTACTTTAACTGGTGCTCTTGACCTTAACAACACTCTGAATGTTTCTGGATTTACATATCTGGAAAGTACAGACGAACCTCAGATTGCTCTGAATTCTGGCACTGGTCTGTATGAGATTCAGAACAGTGACTATGGTGCATTCCGATTTAATGGTGGTGGATACATTGAAGGCGACTTCATGTTTAACTCCGATGTTTATGTCAACGGTACTGTAGTTCAGAAAGAAGACGAAACCGCAGTATTCAACAGACAAAACTACCTGAACGTTCGTTATATTCTATATGCAGGTTCTTCTTCTGCACGCACACCTTCTTATGCAACAGACACTACAACTAACTTAAGAGTTTTTGGTGGTGCTGGTATTGCAACTGACCTTCACATCGGTGATGACCTGTATATCGGTAAACTCAACAGTAGCGATACTATTGAATTCCAAGTCGTCGGTGAAAGCGGCAACACTACAATCGGTCGCTCTGGTGCAGGCACTAACTCTGTAGGTACACTGACTGTCCATGGTGATGTAACATTCAACAGAGACCTGTTTGCTAATGGCAACATCACTCTTGGTAACGCAACTAGCGATACTCTGACTGTCCAAGCAAACTCCGAGTTTAATGGCACGGTTGATGTTGATGCAGACTTTGCTGTTAGAAACGGCACAACCGACAAGTTCTTTGTTGACAACGTAACAGGTAACACTGATATTCAAGGAACTTTATACGTATTGGGTAATACCAATATCGATGGTACTTTAGATGTTGACTCCAACTTTGCTGTTAGAAGTGGCACTACAGACAAATTTACTGTTGCTTCTGCTTCTGGTAACGTTGCAACTGATGGTACTCTGGTCGTCCAAGGTCAAACAACTATTAACGATTCTTTGATTGTTGATGCTGCTAATGAAGTTTTCTCTATCAGAAATGGTTCTGCTATTGAAAAGTTTAGTGTTGATGCAGATAACGGTAATACCAACATCATTGGTACTCTGACCGTTGGTGATGCAACTCAGATTAATGATACCTTCGGCGTATCTGGTATTGTAACCTCAACCAATAATACTCAACAATCTATTAATGGCAATTCTATTGCTCTTGACGGTGCTGCAAGATTCTCGGGTGGTGTTGGTGTTGCTAAGAACTTAGCAGTTGGTGAAGACCTTATGGTCTACGGGGACTTCAACATTGTTGGTAATCAGGTCATCAATGGTACTACCACTTATAATGCACGAATTGATATTACAAATACTGCTGAAGCAGACTCTCTTAGTGATAATAACGTTGCATTCCAAGTTGATGGTGGCGGTATTATTAGAAAGAAACTTTGGGCGGGTGGAGACTTCACTGTATATGATACTGCAAACGCTAGAAATGCATTCTTTGTTGATGTAAGCACTGGCGATGCCACCCTACACAATACACTTACTGTTGGTGGAGACTTAATTGTAAATGGCACAACCACTACTGTTAATTCTACGGTCACAACTCTCGATGACCCTATTATTACTTTGGGTGGTGACACAGCACCAACAACTAACGACGGTAAGGACCGTGGTGTTGAGTTCCGTTATTACGACGGCTCTGCGAAAGTGGGTTTCTTCGGATTCGACAGGTCGTCCTCCCAATTCACATTCCTAACAGATTCTACCAATGTATCTGAAGTTCACACTGGCACAGATGCTGCTCTTCGTGCTGGTAGCCTGAATCTGACTGGCACTGGCACCATTCTTGACGTTGATGCTAATGCCAACATCGATGGCACTCTGACTGTTGATGGTCAGATTATCTCTCAGGTTACATCTGGTCCTGCTCTGGTTATTCCTAACACTACTAAGATTAATAACCTGAATGCTGACTTGCTGGATGGTTATACAACTGCAACTGCTAATACTGCAAGTACGGTTGTTGTCAGAGATGCTTCGGGAGATTTTGCTGCAGGAACTATCACTGCTTCCCTGGCGGGCAATGCTACTACTGCATCTAGATTGCAGACAGCACGCACAATCACAATCGACGGAGTTGTTGATGGCAGCGTTTCCTTTAATGGTTCTTCCAACGTAACAATCAGCACCACCTACAACGACGCAGACATCACTGCACTCGCCGCTATGGCAGGTACAGGTCTGGTTACCAGAACTGCTGCTAATACCTACGCACAACGCTCTGTGACCGCCACAGCAGCGTCTGGAATCACGATTACTAATGCAGACGGTGTATCAGGCGACATCACCATTAACGTCGCTTCTGCGAGCACCAACGCATCAAATAACCTCGTTCTTCGTGATGCCTCTGGTAACTTTGCTGCTGGCACAATTACGGCAAGTTTGGTTGGTAACGTAACTGGTAATGTCACTGGTAACGTAACTGGAGACTTGACTGGTCAGGCAGATGGTGCAGATAGAGTAGTTACTCAAGAGGTTACAACTAATTTTGATTACCCAATTGTTTTTGCATCGGCAAGATTTACAACTCCAACTAATACTCAGATTTATACAGAGGCTTCGGGTGGTGCAGCTGCAACATATAATCCATCTACTAAAACTTTAGAAGTAGAAACAATTAAGTGTGATACAATTTCACCTAGGGATCCTGGAGCCATCCAATTCAATATTAATGCAAATAGTGTTACTGCTACTATTGGATTTACTGGAGACCTTACTGGCGATGTCACGGGTGATGTAACAGGCAATGCTGATACCGCAACTGTTGCTGATACTGCAACTCAAGTTGCTACGCAAACAGTTCAAACAAACTTCAACCAGGAACACTTCCTTCCATTCGTTGTTTCTAACAGTGCTTCGGTAATTAATCAAAGCGTTCTCACTGACGGGGGTGCAACCTATAATCCATTCCAGAATAGAATCACCGCACAAACTTTTGCGGGTGATTTAACTGGTGATGTAACTGGTAACGTTGATGGTAATGTTGCAGGTGAAGTTACTCTTGAAGGTACTGTACCTGCTACTGCTACCGATCCTGGCACTGCAGGTGATGTTCGTTATGATGCAGATTATGTCTATGTTTGTGTTGCCACAAATACTTGGAAAAGATCCGCCCTCGCTACTTGGTAA

Genome Context

Tertiary structure

AOO11347.1
ESMFold2 structure
Source ESMFold2
pLDDT 54.8
Oligomeric state monomer