Genbank accession
AEZ66114.1 [GenBank]
Protein name
hypothetical protein
RBP type
TF
Evidence RBPdetect2
Probability 0,46
Seq2Symm
C3 confidence 0,652 truncated
C3 0,652
C1 0,080
C2 0,024
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MGSKAKKITVGYKYYMGLFMGLFRGPVNEIVEIRVGDRTAWTGSITGNTTIQINREDLFGGTKAEGGIDGPLELYMGAPTQTVSQKLKNMLGGRQPEFRGVVTAYFDGLICAMNPYPKQWKFKARRSTAGWTGGVWYPEKCLVKMQGYDGQGNQHEIHAMNPAHILYECQSNFEWGRGLSRSLIDDTTFRLVADTLFNENFGLCIRWNRQDTLESFMQLILDHIGGAMYVSKVTGKLSLRLIRKDYDFDTLPIFDTDSGLLSIQEATNASPANLVNEVVVTYHNPIMDEDQQVRSHNLAQIQNQGCLNSNTIEYLGIPTGKLAMQVAQRDLRAASTNVRRFTVICDRRAWNVQPGDVLKVRDPKQRGLTEVVIRVGTVEDGTLPDGKIKIVALQDQFAFQLNTFNQVEPPSGYEPDLTPAIARRIVYEMPYVDLVQQLPDGELNAVGPNDAFINSQAEKPTDMSAAYDMGIMAEGESGFDIRGNGDFGAFGSLAADIDYLSTQIILSEMTDMWDDVQPGFVARIAKPVLDGQRTQMEIAEEFVRIDAINGNVITVARGVLDTIPFRHQKSEMLWVTTYDGGTDWQKYAGNESIDIKILPWTLGGGRFPIEDAPIDHLDMDFRQIRPYPPGNVQHYLASTSTLQRWYVPSALTYTANAGETPDTYTLTWAHRDRILQGDKPVPHIDGDIGPEPGTSYTIRVFNQEGTLVRTESGINGTSWNWPYATAAADMNVEASLFDPVLATLRLTSVRSGRESWEYYEMKVSVYKKPPQFVYDASLMQFAAQPYNAASDPNPPTPPMDGPYVSSLMQFAAQPDGSGDFGEADSMSGPNVALLPHQVTQTSSIITPLDTLLYETPYIQLSRDGRDLNTSKVSAYVARSSDRTVDSYTLFTKHETDADYASAGTQPWTPWGMTTVGLGFFTDEVTIDPTSDKDGVPIAGAQVGDLLLIDQELMSITAINGRTYKIGRGVADTIPAQHYSRRPVWLISVGFGYSDMAFGDNEKAMVIVRPDTYGTDIPLNKLYPLQLQMQYRPKRPYPPGLMMIGGQPFFNTASGLADDFNPYNNLKAKDVACTYAHRNRVTQANTARDHFAVGINPEPGVKYRVRIGYAYWSQSGSGFSLLSQFDTEDAGFIMRAADLERWGRQAGYAQDAGGYSTLNVTVNAIRDGMLNWQGYTMTVRVPSFPLPPGQKPGGGDGPWNPPGGGNTGGTTPPTEPPDRPDPSEPGTTDPSEPTKPDEPEDPQPPVDPEDPDTDPPTPPDPPIDPTNVPGWSLSWDHGWAMTLPDFRYVPPAEEEPE
Physico‐chemical
properties
protein length:1296 AA
molecular weight: 143221,91980 Da
isoelectric point:4,76620
aromaticity:0,09722
hydropathy:-0,43673

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AEZ66114.1 [NCBI]
Genbank nucleotide accession
JN871591 [NCBI]
CDS location
range 26478 -> 30368
strand -
CDS
ATGGGAAGTAAAGCCAAGAAGATTACGGTTGGGTACAAATACTACATGGGCCTGTTTATGGGCCTTTTCCGTGGCCCGGTGAATGAGATTGTCGAGATCCGCGTGGGCGACCGTACCGCGTGGACAGGCTCAATCACTGGCAACACAACCATCCAGATTAACCGCGAAGACTTGTTCGGCGGCACGAAGGCGGAAGGCGGCATTGATGGCCCGCTAGAACTGTACATGGGCGCGCCGACGCAGACCGTCAGCCAGAAGTTAAAGAACATGCTCGGTGGCCGCCAGCCGGAATTCCGTGGTGTCGTTACCGCGTATTTCGACGGCCTGATCTGCGCCATGAACCCATACCCGAAGCAGTGGAAATTCAAGGCCCGCCGCTCTACGGCCGGGTGGACTGGCGGCGTCTGGTATCCGGAAAAATGTCTGGTCAAGATGCAGGGGTACGACGGTCAGGGCAATCAGCACGAAATCCATGCCATGAACCCTGCGCACATCCTGTATGAGTGCCAGTCGAACTTCGAATGGGGCCGTGGCCTGTCACGCTCGCTTATCGACGATACGACGTTCCGCCTTGTGGCCGACACCCTGTTTAACGAGAACTTCGGCCTTTGCATCCGATGGAACCGTCAGGACACGCTCGAATCGTTCATGCAGCTTATCCTCGACCACATTGGCGGTGCGATGTACGTCAGCAAAGTGACGGGCAAACTGTCCCTGCGGTTGATCCGGAAGGACTACGACTTCGACACGCTGCCGATCTTCGACACGGATTCCGGGCTGCTGTCCATTCAGGAAGCGACCAACGCGTCTCCGGCCAATCTGGTTAACGAAGTGGTCGTGACCTACCACAACCCGATCATGGACGAAGACCAGCAGGTGCGTAGCCACAACCTCGCGCAGATCCAGAATCAGGGCTGTCTGAACAGCAACACGATTGAATACCTCGGCATCCCTACCGGGAAACTGGCGATGCAGGTGGCACAGCGTGACTTGCGCGCCGCGTCTACCAACGTCCGCCGTTTCACCGTGATCTGTGACCGCCGGGCATGGAACGTGCAGCCGGGCGACGTGCTGAAAGTGCGTGACCCGAAACAGCGCGGCCTGACCGAAGTTGTTATCCGCGTCGGTACCGTTGAAGATGGCACGCTGCCGGACGGCAAGATCAAGATTGTCGCGCTGCAAGACCAGTTCGCCTTCCAGTTAAACACGTTCAACCAAGTCGAGCCGCCATCCGGATACGAGCCTGACCTGACTCCCGCGATTGCCCGCCGTATCGTGTACGAAATGCCGTACGTGGATCTGGTGCAGCAGCTACCGGACGGCGAACTGAACGCCGTTGGCCCGAACGATGCGTTCATCAACTCGCAGGCCGAGAAGCCGACTGACATGTCCGCCGCGTATGACATGGGTATCATGGCCGAAGGTGAATCGGGCTTCGACATCCGTGGCAACGGTGACTTCGGTGCGTTCGGATCGCTGGCCGCCGACATCGACTACCTGTCAACGCAAATCATCCTGTCCGAAATGACCGACATGTGGGACGACGTTCAGCCGGGCTTCGTGGCGCGCATCGCCAAGCCTGTTCTTGACGGCCAACGCACGCAGATGGAAATCGCCGAAGAGTTTGTCCGCATCGACGCCATCAATGGCAACGTGATTACCGTGGCGCGCGGCGTACTCGATACCATCCCATTCCGCCACCAGAAAAGCGAAATGCTTTGGGTGACGACGTACGACGGCGGTACCGACTGGCAGAAATACGCGGGCAACGAGTCCATCGACATCAAGATCCTGCCGTGGACATTGGGCGGCGGCCGCTTCCCGATTGAAGATGCACCGATTGATCATCTGGACATGGACTTCCGCCAAATCCGCCCATACCCGCCGGGCAACGTGCAGCACTATCTCGCTTCGACGTCAACCCTGCAACGCTGGTATGTACCGTCCGCACTGACCTACACGGCCAACGCCGGGGAAACGCCTGACACGTACACCCTGACTTGGGCGCACCGCGACCGCATCCTGCAAGGCGATAAGCCCGTCCCGCACATCGACGGCGACATCGGGCCTGAACCGGGAACCTCGTATACCATTCGCGTCTTCAATCAGGAAGGAACGTTGGTTCGCACCGAGTCCGGTATCAACGGCACGTCGTGGAATTGGCCGTACGCAACCGCAGCGGCCGACATGAATGTCGAAGCCAGCCTGTTCGACCCGGTGCTCGCGACGCTCCGCCTGACGTCTGTCCGCAGTGGCCGCGAAAGTTGGGAATACTACGAAATGAAGGTCAGCGTTTATAAGAAGCCGCCGCAGTTCGTATATGACGCAAGCCTGATGCAATTTGCTGCGCAGCCGTACAACGCCGCCAGTGATCCTAACCCGCCAACGCCACCGATGGACGGCCCGTATGTTTCGTCCCTGATGCAGTTCGCCGCGCAGCCGGATGGTAGCGGTGATTTCGGCGAAGCGGATAGCATGAGTGGCCCGAACGTGGCGCTGCTGCCGCACCAAGTTACGCAGACGTCGTCCATCATTACGCCGCTCGATACGCTGCTGTACGAAACCCCGTACATCCAGTTATCCCGCGACGGCCGTGACCTGAACACGTCGAAAGTCAGCGCATACGTGGCGCGTTCGTCCGACCGCACCGTCGATTCGTATACCCTGTTCACCAAGCATGAAACCGATGCGGATTACGCTTCCGCCGGGACTCAGCCGTGGACACCGTGGGGCATGACTACCGTCGGCCTCGGCTTCTTCACGGACGAAGTGACGATTGACCCGACGTCGGATAAAGACGGCGTTCCTATCGCGGGCGCGCAGGTGGGCGATCTTCTGCTTATCGATCAGGAATTGATGTCCATCACCGCCATCAACGGCCGCACGTACAAGATTGGACGTGGCGTGGCTGACACCATTCCGGCGCAGCACTACAGCCGCCGTCCGGTCTGGCTGATCTCCGTGGGCTTCGGCTACTCCGACATGGCATTCGGCGATAACGAAAAGGCGATGGTCATCGTCCGCCCGGATACCTACGGCACCGACATCCCGCTGAACAAGCTGTACCCGCTCCAGTTACAGATGCAGTACCGTCCGAAACGTCCGTACCCGCCGGGCCTGATGATGATTGGCGGCCAACCGTTCTTCAACACCGCGAGCGGACTGGCAGACGATTTCAACCCGTACAACAACCTGAAAGCGAAAGACGTGGCCTGCACGTACGCCCACCGCAACCGCGTAACTCAGGCAAACACGGCGCGCGACCATTTCGCCGTCGGTATCAACCCGGAACCGGGCGTGAAGTACCGCGTGCGTATCGGCTATGCGTACTGGTCGCAGTCCGGCAGTGGCTTCTCGCTGCTGTCTCAGTTCGACACGGAAGACGCGGGCTTCATCATGCGTGCGGCCGACCTTGAACGTTGGGGCCGTCAGGCGGGCTATGCGCAAGACGCTGGCGGTTACTCCACGTTAAACGTGACCGTCAACGCGATTCGTGATGGAATGCTGAACTGGCAGGGATACACGATGACCGTGCGCGTGCCGTCCTTCCCACTTCCTCCGGGTCAGAAACCGGGCGGTGGAGACGGGCCGTGGAACCCGCCGGGCGGAGGCAATACAGGCGGCACCACGCCACCTACGGAGCCGCCGGATCGTCCAGACCCGAGCGAACCGGGTACGACCGACCCATCCGAGCCGACCAAGCCGGACGAACCGGAAGATCCGCAACCGCCTGTAGACCCGGAAGACCCGGATACTGATCCGCCGACTCCGCCAGACCCGCCGATCGACCCGACCAACGTACCGGGCTGGTCATTGAGTTGGGATCACGGTTGGGCGATGACACTGCCAGATTTCCGATACGTTCCACCAGCAGAAGAGGAACCTGAATAA

Genome Context

Tertiary structure

AEZ66114.1
ESMFold2 structure
Source ESMFold2
pLDDT 71.3
Oligomeric state monomer