Genbank accession
AZU99944.1 [GenBank]
Protein name
putative glycerophosphoryl diester phosphodiesterase
RBP type
TF
Evidence RBPdetect2
Probability 0,76
Seq2Symm
C3 confidence 0,983 truncated
C3 0,983
C1 0,172
C2 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MVKRRFQAGLGSEIKRVYKEGQQINTLLLAQVIQVNYKYNTVDLLALQHKEVFQNSYANEGRFSARLPMEFGGRNIVGQPYGQVNPIAVGTVVLVGFINSDKDMPIVISVYNNNDVSKQLSRTQFSNSDPKDLELIGDMHQKFSLYPSLTYDSVDGEGGRVVTFSGKSFIAFDTKEVANSSTTDAGYGTKYEDLETSYYNNGDLIEPMKGRAPNVLFKHQGVLDDDGKPDLHDLLIHINPDGTYRTSMMNKEEDWRTLFEMTPDGRVKLRKQDSINIDGGIEISELGINNEGFVYLRNGDMDLEVRKDGIYSQGKLFTADVDLSDVYDKLNGLSIQIKETNGQLEIIANGVEEQNGKISELSTEITIVAGKVESKVTKTEVQDMIDSSFVDMSDAIKKAQEDADKANKVIADMSSDNRLTPSEKIDLLKEWDIIKNEYPSYLEQAETYEVDSKDYTAKYNSLELFVTPILADMESTSSVDGATLRKTFNSYYTARIALLNSISKKLKDGITEAMKKASQASLDATQAMADASQAKIDADNANKLISDIASDNKLTPSEKYQLKKEWDVIVKEYPTTIAQAEKYAVDTAEYTAKYKALELFVEPLFKDMDETSIVDGERLRATFSDYYASKIALLKEVTDSAKTELDAYGNKISVMETNITQTSEAITLLATRVQTVENGVQSNKAQIEIQAEQISQKVTASEVKGIVDDSINNLTLGGTNLFVIKTQTAGLLNENDGTVGTAVDNSVVSDYIKVNQKTPYIATLYGNTGTNMIITDWYDKNRTFISGEAVADSGDFSKKYVSPENAVYARVSYKKANSVNIKFEAGTKATDYSPSWEDIKGDQTALEEYIKKVEEQAKKAQQDAENAKNDAENANNAIADMSNDNMLAPNEKKQILLQWEQIKTEYPINLDQATKFGVSSQQYTTAYNALDEYLKPILADMTTTSVVVGSTLRNTFNNYYDKRTTLLNRISDVAKNVADKAQETADTINDNLQNIGGYNYVGFSSGDNMLPRLMIKNVGYYTLGSSTTEFIDSMVAVKGDATTQPFDYTVGTSDKEIAGGGLADYRMKEVKEGQWLTASANVQVIGGGSARLAIYTLEGDNWVGSNSTPIQVSDGLKRVVAQRKVTGLTKGVLIRIESADTNVKEFRFGNVQLEVGIIPTPWKKSDIDIQEDINNVVQNIKTYTAWANDLQGLDFTREKVEGKTYMYVGTSMKDSDNYSDYTWRLTDEHIEGQINGKEGAWIYSPTAPTNPSQGLIWVDLSKVPNQPKRWVDSETGWVALTPEEVKDLPWGEDGTNLADWVAQAEQRISSDSIINTVLGSEDFTSVFDTKANTTDLDNLAAYEDLDSIKEDYNRLIKEGINGIDFTPYVTNSELQQLKDSFNFSVQQAGGVNMLKNSLGFSGLDFWDGTVGKNLLPNSTWNLGFGRWGGASIASFEILPPEDDKPTSHILGSIGSRSSTKEIGNRPHPLKVNSGETYTISFDYKEEALAYDKDRPILVVRNYPDKDTDQWMEYSIEGWAVMANGSTTDLTVWRRFTKTFTIGTSGYLDILPKTIVESWTHRSFWRELKIEEGSQATTWVPNKEDGAFTGGIVETTQTEELANLGFGSGFVSSKRPSSSLTQSVELPEIGANLEYSLSFYMKVTTDNPVADFKCGIRVYEGDTLTYTLGIEDATQPIPLGFQQYKLVFTPTSTSTKIEMFVENGQEASVIISGIMYNIGNIPLKWQPYPSEIYNTNVKIDINGVTVKNNQTDGYTMITPQEFSGYSRIDGNIERIFTLNGQVTEVKMLKAEKRITMEPVSVFAMNTVTDTKRIRGWAFVPSFE
Physico‐chemical
properties
protein length:1822 AA
molecular weight: 202546,79320 Da
isoelectric point:4,71556
aromaticity:0,09001
hydropathy:-0,46240

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AZU99944.1 [NCBI]
Genbank nucleotide accession
MK268686 [NCBI]
CDS location
range 65850 -> 71318
strand +
CDS
TTGGTAAAACGTAGATTTCAAGCAGGTCTAGGCTCAGAAATTAAAAGAGTATATAAAGAAGGACAACAAATTAACACGCTACTATTAGCACAAGTAATTCAAGTAAACTATAAATATAATACAGTAGACCTACTAGCTTTACAGCATAAAGAAGTATTTCAAAATTCCTATGCAAATGAGGGACGTTTTTCTGCAAGACTTCCTATGGAATTTGGCGGTAGAAATATCGTTGGACAGCCTTATGGACAGGTTAACCCGATAGCAGTAGGAACAGTAGTATTAGTTGGTTTTATTAATTCCGATAAAGACATGCCTATTGTAATTAGTGTTTATAATAATAACGATGTAAGCAAGCAACTTTCAAGAACACAATTTTCAAATTCAGACCCTAAAGATTTAGAGTTAATTGGGGATATGCACCAAAAATTTAGTTTATACCCTTCATTGACATATGATAGCGTTGATGGAGAAGGAGGGCGTGTCGTTACTTTTTCTGGTAAATCATTTATTGCTTTTGATACAAAAGAAGTAGCTAACTCCTCTACAACTGATGCAGGTTACGGTACTAAATACGAGGACTTAGAGACATCATACTATAATAATGGTGACCTAATAGAGCCTATGAAAGGTAGAGCACCAAATGTACTGTTTAAGCATCAAGGGGTACTTGACGATGATGGCAAACCAGATTTGCACGATTTGCTAATTCATATTAACCCAGATGGTACTTATAGAACTTCTATGATGAACAAAGAAGAGGATTGGCGCACACTATTTGAAATGACACCAGATGGCAGAGTTAAATTAAGAAAACAAGACTCTATTAATATTGATGGTGGCATAGAAATAAGTGAGCTAGGAATCAACAATGAGGGGTTCGTTTATTTACGCAATGGGGACATGGATTTAGAAGTACGAAAAGATGGTATCTATTCACAAGGGAAACTGTTTACAGCCGATGTAGACCTATCCGATGTATATGACAAACTAAATGGGTTGTCTATACAGATTAAGGAAACAAATGGTCAATTAGAGATTATAGCTAATGGTGTAGAAGAACAAAATGGAAAAATATCAGAACTTTCTACAGAAATAACAATTGTAGCAGGTAAAGTTGAATCAAAAGTAACAAAGACAGAAGTTCAGGATATGATTGACAGTTCTTTTGTAGATATGTCTGATGCGATTAAAAAAGCACAAGAAGATGCTGACAAAGCAAATAAAGTGATTGCAGATATGTCTAGTGATAACAGGTTGACTCCAAGTGAAAAAATAGATTTATTAAAAGAATGGGATATTATAAAAAATGAATATCCAAGCTATCTTGAACAAGCAGAGACCTACGAGGTTGACAGTAAAGACTACACTGCTAAGTACAATTCATTAGAGCTATTTGTTACCCCTATATTGGCTGACATGGAATCAACTAGCTCAGTAGACGGAGCAACACTTCGCAAAACGTTTAATTCTTACTATACAGCAAGAATAGCTTTACTAAATTCTATTAGTAAAAAACTAAAAGACGGTATCACAGAGGCTATGAAAAAAGCATCCCAAGCATCACTAGATGCAACACAAGCAATGGCAGATGCCTCACAAGCTAAGATTGATGCAGATAATGCTAACAAACTTATATCTGATATAGCAAGTGATAATAAGCTGACACCTTCTGAAAAGTACCAACTTAAAAAGGAATGGGATGTAATTGTTAAGGAATACCCTACAACAATTGCACAAGCAGAGAAGTACGCAGTAGACACAGCAGAGTATACAGCTAAATACAAAGCCCTAGAGCTGTTTGTAGAGCCTTTGTTTAAAGACATGGATGAAACTAGTATAGTAGATGGAGAACGCCTTAGAGCGACATTCTCAGACTATTACGCAAGTAAGATTGCTTTACTAAAAGAAGTAACGGACTCAGCTAAAACAGAGCTAGATGCCTACGGTAATAAAATATCTGTAATGGAAACAAACATTACTCAAACGTCAGAAGCTATTACTTTACTAGCTACTAGAGTACAAACTGTAGAAAACGGTGTACAATCAAATAAGGCACAAATCGAAATACAAGCTGAACAAATTAGTCAAAAAGTAACTGCTAGTGAGGTTAAAGGAATTGTAGACGATTCTATTAACAATCTAACATTAGGTGGAACTAACTTATTTGTTATAAAGACACAGACAGCAGGTTTACTAAACGAGAATGATGGAACTGTAGGTACTGCAGTAGACAACTCAGTAGTGTCAGACTACATTAAAGTTAATCAAAAAACACCATATATTGCTACACTTTATGGTAACACTGGCACAAACATGATTATAACAGACTGGTACGATAAAAATAGAACATTTATTTCTGGGGAAGCTGTGGCAGACTCTGGGGATTTTAGTAAAAAGTATGTGTCACCTGAGAACGCAGTTTATGCTAGAGTAAGTTATAAGAAAGCAAACTCTGTGAATATCAAATTCGAGGCAGGCACAAAGGCTACTGATTACAGCCCTTCATGGGAAGACATAAAAGGTGACCAAACTGCTTTAGAGGAATACATTAAAAAAGTAGAAGAACAAGCCAAGAAAGCTCAACAAGATGCTGAAAATGCTAAAAATGATGCTGAAAATGCAAATAACGCAATAGCTGACATGTCGAATGACAATATGTTAGCACCGAATGAGAAAAAACAAATACTCTTACAATGGGAACAGATTAAAACAGAGTATCCAATAAACTTAGACCAAGCAACTAAATTTGGGGTGTCTTCTCAACAGTATACAACAGCGTATAACGCACTAGACGAGTACTTAAAACCAATACTAGCTGATATGACAACAACTTCTGTAGTAGTTGGTTCTACTTTAAGAAATACGTTTAACAATTACTATGACAAAAGAACTACTTTGCTAAACAGAATATCTGACGTAGCAAAAAATGTAGCAGACAAGGCACAAGAAACTGCAGATACTATCAATGATAATTTACAAAATATTGGTGGGTACAACTATGTAGGGTTCTCTTCCGGAGACAATATGTTGCCTAGACTGATGATTAAAAACGTTGGTTACTACACATTAGGTTCGTCAACCACAGAGTTCATTGACAGCATGGTAGCTGTAAAAGGTGATGCAACGACCCAACCTTTCGATTATACTGTAGGCACTTCTGATAAAGAAATTGCCGGTGGCGGTTTAGCTGATTATCGTATGAAAGAAGTAAAAGAAGGTCAGTGGCTAACAGCTTCTGCGAATGTGCAGGTAATAGGTGGTGGTTCCGCTAGATTAGCTATCTACACTTTAGAAGGAGATAACTGGGTAGGCTCTAACAGTACACCTATACAAGTAAGTGATGGTTTGAAACGTGTTGTGGCTCAAAGAAAAGTAACAGGCTTAACAAAAGGTGTGTTAATACGTATTGAGTCAGCCGACACTAATGTTAAAGAGTTTCGATTTGGTAATGTTCAACTAGAAGTAGGTATTATCCCAACTCCTTGGAAAAAGTCTGATATAGATATTCAAGAGGACATAAACAATGTTGTTCAGAATATCAAAACATACACTGCTTGGGCTAACGATTTACAGGGTCTTGATTTTACAAGAGAAAAGGTTGAAGGAAAAACTTACATGTATGTAGGTACCTCTATGAAAGATAGTGATAACTATTCAGATTATACATGGAGGTTAACTGATGAGCATATAGAAGGTCAGATTAATGGTAAGGAAGGCGCATGGATTTATTCTCCAACAGCCCCTACTAACCCATCGCAAGGGCTTATATGGGTAGACTTGTCAAAAGTACCTAATCAACCTAAGCGTTGGGTAGACTCAGAAACTGGGTGGGTTGCGTTAACACCAGAAGAGGTTAAAGATTTACCTTGGGGTGAAGATGGCACAAACCTAGCTGACTGGGTAGCACAGGCAGAGCAGAGAATATCTTCTGATAGCATTATAAATACTGTACTAGGTTCTGAGGATTTTACTAGTGTGTTCGATACAAAAGCTAACACTACTGACCTAGACAACTTAGCTGCCTATGAAGATTTAGACTCAATAAAAGAGGACTATAACCGACTAATCAAAGAAGGTATAAACGGTATTGATTTTACCCCTTATGTAACTAACTCCGAACTACAACAGCTTAAAGACAGCTTTAACTTCTCTGTTCAACAAGCCGGAGGAGTTAACATGCTTAAAAACTCTTTAGGATTCTCTGGGTTAGACTTCTGGGATGGTACAGTAGGGAAGAACTTATTACCTAACTCTACTTGGAATTTAGGTTTCGGTAGATGGGGTGGCGCTTCAATCGCTAGTTTTGAAATATTACCACCAGAAGACGACAAGCCTACAAGTCATATACTGGGTTCAATAGGTTCTCGTTCTTCTACTAAAGAAATAGGTAATAGACCCCACCCATTAAAAGTTAACTCTGGTGAAACGTATACAATAAGTTTTGACTATAAAGAAGAGGCATTAGCTTACGATAAGGACAGACCTATCCTTGTTGTTAGAAACTACCCTGATAAGGACACAGACCAATGGATGGAGTACTCAATAGAAGGTTGGGCAGTAATGGCTAACGGAAGCACTACTGACTTAACTGTTTGGAGACGTTTTACAAAAACATTTACAATAGGTACTAGTGGCTACTTAGATATTTTACCTAAAACTATAGTAGAGTCATGGACACACAGGTCTTTTTGGAGAGAGCTAAAAATAGAGGAAGGGTCACAAGCTACTACTTGGGTACCTAACAAGGAAGACGGGGCGTTTACCGGTGGTATTGTTGAAACTACCCAAACAGAAGAACTAGCTAACCTCGGGTTCGGTTCGGGATTTGTTAGTTCTAAAAGACCCAGCTCTTCATTAACACAATCTGTAGAACTACCTGAAATAGGTGCCAACCTTGAGTATTCACTATCTTTTTATATGAAGGTAACCACAGACAATCCTGTAGCCGACTTTAAATGTGGTATTCGGGTTTATGAGGGGGATACTCTAACTTATACATTAGGCATAGAAGATGCAACACAGCCAATACCACTAGGGTTCCAACAATACAAACTTGTGTTCACTCCCACAAGTACCTCTACTAAAATAGAAATGTTTGTAGAGAATGGACAAGAGGCATCTGTTATTATATCAGGTATTATGTATAATATCGGGAATATACCTCTTAAATGGCAACCATATCCAAGTGAGATATACAATACGAATGTTAAGATTGATATTAATGGGGTAACTGTTAAAAACAATCAAACAGATGGGTACACAATGATTACCCCCCAAGAGTTCTCAGGATATTCTCGTATTGATGGTAACATAGAACGTATTTTCACTTTAAATGGGCAGGTAACAGAAGTTAAAATGCTAAAGGCTGAAAAACGTATAACTATGGAACCAGTATCTGTGTTTGCTATGAATACAGTAACAGATACAAAAAGAATTAGAGGTTGGGCATTTGTACCATCATTTGAATAA

Genome Context

Tertiary structure

AZU99944.1
ESMFold2 structure
Source ESMFold2
pLDDT 61.9
Oligomeric state monomer