Genbank accession
AIX33251.1 [GenBank]
Protein name
baseplate wedge initiator
RBP type
TF
Evidence RBPdetect2
Probability 0,65
Seq2Symm
C1 confidence 0,947 truncated
C1 0,947
C3 0,359
C6 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAYLLSNGGVIINDSREIVNAGVVTATAFFGDGSGLSGIATISDGGISIGDANITGNLNVSGISTVEFLNASDINVGGALTVTGDLSVGGDLSFDEVSGRNLNITGISTLGTVKISNGIVTATSGVVTYYGDGSNLTGIDITDSDVRLRNLSVTGVSTFTGDVSFGANASLVGDLTSGRNANLSGIATVNDIYIDNLLYDSNNNVGAAGSILVTAGGKLQWLPPDQAGIATVFQPGNTFFVSKNGDDSSDGLSMEKSFATISYALSQISSGTNNVLLITAGDYEEVFPLSVPDGLTVKGVGQRAVLVRPTSATETNDGFQLGNASTVEDLTIGQMFKPQGASNNNYAFTYRSGATISSRGPYVSRVTVLNKGSVTSTSDPFGYGSADAYPTTAPGGAGVLADGSVLNSASLEASFLLNEVTTFTAGNIGIDMVNGARVEWLNGFSYFASEGVKGRADQSTGLYGAGKTRLRVENASGGLVNGNTIELYDIDGTTSLASGTIDGTSGAYTTLTTGGTGTFAIAGSRKAKAASFVDTASLSTTQAKFGNASLDVTGQSTDCINVDPSSDFGFGTGDFTAEFWLYRTSATAGATILDMRDAADTDSALSIRENTSDVIEVLVGNSVVLTSSTSAIGNAAWYHIAVARLGSTMELFINGAQEASASNSSDLGLSQSLTFGADYANANGTIAFLDELRIEKGAAKYTNPFTPSTVPLEGDRGTAILLHFDGSNGATEAPDDIQIFQDIRISGGNTADRLSLADYSQFGAELRSSGCAVEYGNKGVVGDGAGVALRLIGINFSFVGALGDLTNDPNLAVQANEVTETNNAEVSFTSIDQGGDFRVGESFYVNQETGDVSFNNTTTDLTSLSSLTITDGTNNSLITPTSGRFGNVQISGQQVASVSGDLDLVTAGGGEVNIYGNTNVVGILTAQVVEINAIQKGDTSIALDDTGTDGTIRFNTDGSEAGRFTKDNDLAVTHNFRVGGIGTIPNLVSTTATITTLNVENLVSSGSTSGGGGTGIGSTAINSPNLNISGQANFNNVNVSGVATVPDLTVTNSFTNTGYSTITGDAEVGGNLWLKGDLNVIGSQNVSEFFATNMEISGIATFGTVKVNSNVHCDDTVFVGGAVTITGPITAVDILATGIGTIPVADVGHADVDSINVTGISTISQVDIGKITVGDFTVTGFATVTDGLEVIGPVSFGGSITQLPLPTGQGGVWFDNSVVGVGTLLANDASINGLLGVGNSLGVGGDAYIDGNIIGSGGTISNYNEIITPLLTATDIDAATLDVSGNVTIDGNVDLGDTSADFVRINGRVSTSFIPSTDSATDLGSNGLRWKELFVDKLTLTDDAAIGGDLSVGGSVSADYVDTTELNVSGVATFAQISIGGGGGGISTNGVIINNVTVTDQSTLNNLIVSGVSTFVGVSTFKGDVYIDGNLIIDGDNSQDLISGTNLLVSGIATIGTLGVTTNLTVGGDVLVSGAMTAGSYNGDGSQLDNLPAASITTSITPTTRVNGDTLQTGDLWYDSSELRQYTYYDDGGSVQWVPSAPEPTIPDFTYAGNTGIGTLSLGDDTFSVVGDGTNVVTTASGVTTTVTISLSDSVAIAGSMTAGSFLGENLNVSGVSTFVGVTTFRGDVFIEGNLIIDGDESQDLVSGTNLIITGIATIGTLGVTTTTTNTLTVLDTFTLDNPVNSIGISSDLGGAGAAHTALASQLAIKQYIDANNSDQNLNFTGDTGSGSIGLGTEFLEVRGTAQQVTTIGVGNSVVIGLPNTVRVPQRLYVGGGAFTQVMDANSASGVVFANKIVTINKGLTLSSSDLTGVRNLVQTGIATLGTVNFSGVTTTVGNAFVGNDLSVLGTVNANDFNSTSDATRKEDVVEIEDALAKVLDLRGVTFNWKNGEGSSAGVLAQEVQMVLPEIVKGDVGNMSVQYNGIIALLVQAVKELSSEVEELKRTKSDKRRKKS
Physico‐chemical
properties
protein length:1956 AA
molecular weight: 199327,96200 Da
isoelectric point:4,05139
aromaticity:0,06237
hydropathy:0,10373

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AIX33251.1 [NCBI]
Genbank nucleotide accession
KJ019106 [NCBI]
CDS location
range 205680 -> 211550
strand +
CDS
ATGGCATATTTACTTTCTAATGGGGGCGTTATTATTAACGACTCCAGAGAAATCGTAAATGCTGGGGTTGTAACTGCTACTGCGTTCTTTGGGGACGGTTCTGGTTTATCTGGAATCGCAACCATTTCTGATGGGGGAATCTCCATCGGCGACGCAAACATCACTGGAAACTTAAATGTTTCTGGTATTTCTACCGTAGAATTCTTAAACGCTTCTGACATTAATGTCGGCGGTGCTTTAACAGTCACAGGTGATCTATCTGTCGGTGGTGATTTATCTTTTGATGAGGTTTCTGGTAGAAACCTAAACATCACTGGTATTTCCACACTCGGAACAGTTAAGATTTCAAATGGCATTGTAACCGCCACTAGTGGCGTTGTTACATATTACGGTGATGGTAGCAATCTAACCGGCATTGACATCACAGATAGTGATGTAAGACTCAGAAACCTTTCTGTTACTGGTGTCTCTACATTCACAGGTGATGTATCTTTTGGAGCAAACGCTTCTCTAGTAGGCGACCTAACTTCTGGTCGTAACGCAAACCTTTCAGGTATTGCGACAGTAAATGATATCTATATTGATAACTTACTTTATGATTCCAACAATAATGTTGGAGCAGCTGGTTCAATTCTTGTAACCGCAGGTGGAAAGTTACAGTGGCTACCGCCCGATCAAGCGGGTATTGCTACAGTATTCCAACCAGGAAATACATTCTTTGTTTCTAAGAATGGTGATGATAGTAGTGATGGTCTCTCCATGGAGAAATCATTTGCTACCATTTCCTACGCTCTGTCTCAGATTTCATCAGGGACAAACAACGTTCTCTTAATCACCGCTGGTGATTATGAAGAAGTATTCCCACTATCAGTTCCCGATGGACTGACTGTTAAGGGTGTTGGACAACGTGCGGTTCTAGTTAGACCCACTTCAGCTACAGAAACCAACGATGGTTTCCAACTTGGTAACGCATCCACAGTTGAAGATTTGACCATTGGTCAGATGTTTAAACCTCAAGGTGCTTCCAATAATAACTACGCTTTCACATATAGAAGTGGTGCTACCATTTCATCTCGTGGACCTTATGTTTCTAGAGTTACGGTTCTAAACAAAGGTAGCGTAACTTCTACCTCTGACCCATTTGGATATGGTTCAGCTGATGCTTATCCAACGACTGCCCCTGGTGGTGCTGGTGTATTGGCTGATGGTAGTGTTCTTAACTCCGCCTCACTAGAAGCCTCATTCCTACTTAACGAAGTCACCACCTTCACTGCCGGTAACATCGGTATTGATATGGTCAACGGTGCTCGTGTTGAGTGGTTGAATGGTTTCTCCTACTTCGCATCCGAGGGTGTTAAAGGTAGAGCTGACCAGTCAACTGGTTTGTATGGTGCAGGTAAGACGAGACTAAGAGTTGAGAACGCCTCTGGTGGTCTAGTCAATGGTAATACCATTGAACTCTATGATATTGATGGCACGACTAGCCTTGCTAGTGGTACTATTGACGGCACCAGTGGTGCATACACGACCCTGACTACTGGTGGTACTGGTACCTTCGCTATTGCAGGAAGTCGTAAGGCGAAAGCTGCCTCATTCGTTGATACAGCCTCTCTATCTACAACACAAGCCAAATTCGGGAATGCTTCACTAGATGTAACTGGTCAGTCTACTGATTGTATCAATGTTGATCCAAGCAGTGACTTCGGTTTCGGTACTGGTGACTTTACAGCTGAATTCTGGTTGTATAGAACATCAGCTACTGCTGGTGCTACTATTCTCGATATGAGAGATGCAGCTGATACTGATTCAGCTCTATCTATTAGAGAGAACACTAGTGATGTTATTGAAGTTCTTGTCGGCAACTCTGTTGTTCTAACTTCATCCACAAGTGCTATTGGTAATGCCGCTTGGTATCACATTGCTGTTGCCCGTTTGGGTAGCACAATGGAACTATTCATTAATGGTGCCCAGGAAGCTTCAGCATCCAATTCATCTGACTTAGGTCTAAGCCAGTCACTCACCTTTGGTGCTGACTATGCTAACGCCAATGGTACTATTGCGTTCTTAGATGAACTCCGTATCGAGAAGGGTGCTGCTAAGTACACGAATCCGTTTACTCCTTCCACTGTACCCCTTGAGGGTGACCGTGGTACAGCTATCCTACTCCACTTTGATGGATCAAATGGAGCAACTGAAGCTCCTGATGATATTCAGATATTCCAGGATATCCGTATCAGTGGTGGTAACACAGCTGATAGACTATCACTTGCTGACTACAGTCAGTTTGGTGCTGAGTTGCGTTCCTCTGGTTGTGCTGTTGAGTATGGTAACAAAGGTGTCGTCGGAGACGGTGCTGGTGTTGCTCTAAGACTCATCGGTATTAACTTCAGTTTCGTAGGTGCCCTAGGTGATCTAACTAACGATCCAAACCTAGCCGTTCAGGCTAATGAAGTTACAGAAACCAACAATGCTGAGGTATCTTTCACCAGTATTGATCAAGGTGGTGACTTCCGTGTTGGTGAATCCTTCTATGTTAACCAGGAAACTGGTGATGTATCATTCAACAACACAACAACTGATCTAACCTCACTATCTAGTCTAACCATCACTGATGGTACTAACAACTCACTTATCACTCCTACCTCTGGTAGATTTGGTAATGTTCAGATCTCTGGACAGCAAGTTGCTTCTGTATCTGGTGACCTAGACCTAGTAACCGCTGGTGGTGGTGAAGTTAACATCTACGGTAATACTAACGTTGTTGGTATTCTAACCGCACAGGTTGTTGAGATCAACGCTATCCAGAAGGGTGATACTTCTATCGCTCTAGATGATACCGGTACTGATGGTACTATCCGGTTTAACACCGATGGTTCTGAGGCAGGTAGATTCACTAAGGATAACGACCTTGCAGTAACACACAACTTCCGCGTTGGTGGAATTGGTACTATTCCAAACTTGGTAAGTACTACTGCAACCATCACAACTCTAAATGTTGAGAACCTTGTCAGTAGTGGTAGCACTAGTGGCGGTGGCGGAACTGGTATCGGTTCTACCGCTATCAATTCACCTAACCTTAATATTTCTGGTCAGGCAAACTTCAACAACGTCAACGTTTCTGGTGTTGCCACGGTTCCTGATCTAACTGTAACCAACTCCTTTACTAATACTGGTTATTCAACCATCACTGGTGACGCCGAAGTTGGTGGAAATCTATGGTTGAAGGGTGACCTCAATGTTATCGGTTCCCAGAATGTTAGCGAGTTCTTCGCTACCAATATGGAGATCTCTGGTATCGCTACCTTCGGTACCGTAAAGGTCAACAGTAATGTCCATTGTGACGATACTGTATTTGTTGGCGGTGCTGTAACAATCACTGGTCCAATCACAGCAGTGGATATCCTTGCCACTGGTATTGGAACCATTCCTGTAGCAGATGTTGGACATGCTGATGTTGATTCTATCAATGTCACTGGTATCTCTACTATCTCTCAGGTTGATATCGGTAAGATTACCGTAGGTGACTTCACTGTAACTGGATTTGCAACTGTCACTGACGGACTTGAAGTTATCGGTCCTGTCTCATTTGGTGGTTCTATCACACAACTACCTCTACCAACTGGTCAAGGTGGTGTTTGGTTTGACAACTCTGTTGTGGGTGTCGGCACACTACTCGCCAATGATGCATCAATTAACGGACTCCTCGGAGTTGGTAATTCATTGGGTGTTGGTGGTGATGCCTACATCGATGGAAACATCATTGGTTCTGGTGGTACTATCTCTAATTACAACGAGATTATTACACCTCTCCTAACCGCAACTGATATCGATGCAGCTACACTCGATGTTAGTGGTAACGTAACCATTGATGGAAACGTAGACCTTGGTGACACATCTGCCGACTTCGTTAGAATCAACGGTAGAGTAAGTACTTCCTTTATTCCTTCTACTGATAGTGCAACTGACTTAGGTAGCAATGGTCTCAGGTGGAAAGAACTCTTCGTTGATAAACTCACCCTCACAGATGATGCTGCTATTGGTGGTGATCTATCTGTTGGTGGTAGTGTATCTGCCGATTATGTAGATACTACTGAACTCAATGTCAGTGGTGTTGCAACCTTCGCTCAGATTTCAATTGGTGGTGGCGGCGGTGGTATTAGTACCAACGGCGTTATTATTAACAATGTTACTGTTACTGACCAGAGTACTCTTAACAACCTCATTGTTTCTGGTGTATCAACCTTCGTTGGTGTTTCTACCTTCAAGGGTGATGTCTATATCGATGGTAACCTAATCATTGATGGTGATAACAGTCAGGATCTAATCAGTGGTACTAACCTACTCGTCAGTGGTATTGCTACCATCGGCACACTAGGTGTAACTACAAACTTAACTGTTGGTGGTGATGTACTTGTCAGTGGTGCTATGACCGCTGGTTCATACAATGGTGATGGTTCTCAGTTAGATAATCTACCTGCAGCATCAATCACAACCTCCATAACACCTACAACTAGGGTGAATGGTGATACACTACAGACTGGTGATCTATGGTATGACTCTTCTGAGTTACGCCAGTATACTTACTATGATGATGGTGGATCCGTTCAGTGGGTACCTTCAGCCCCAGAACCTACTATTCCTGATTTTACCTACGCAGGTAACACAGGTATTGGTACTCTATCCTTAGGGGATGATACTTTCTCTGTTGTTGGTGATGGTACAAACGTAGTCACTACTGCAAGTGGTGTAACTACTACCGTAACCATTTCACTATCCGATAGTGTGGCAATCGCCGGTTCTATGACCGCTGGTAGCTTCCTTGGTGAGAACCTCAATGTTTCTGGTGTATCAACCTTCGTTGGCGTTACAACCTTCAGAGGTGATGTCTTCATCGAAGGTAACCTAATCATTGATGGTGATGAGAGTCAGGATCTAGTCAGTGGTACTAACCTAATTATTACTGGTATTGCTACCATTGGTACATTAGGAGTAACTACTACTACTACCAATACTCTCACCGTACTCGATACCTTCACTCTAGATAACCCAGTCAATTCTATCGGAATTAGTTCTGATCTAGGTGGTGCCGGTGCTGCTCACACAGCTCTTGCTTCCCAGTTAGCAATCAAACAATACATTGATGCTAATAACTCAGATCAAAACCTAAACTTCACTGGTGATACTGGTTCTGGCTCGATTGGTCTTGGTACTGAATTCCTAGAGGTTCGTGGTACAGCACAACAGGTTACAACCATTGGTGTTGGTAACAGTGTTGTTATTGGACTACCTAACACAGTAAGAGTACCACAGAGACTATATGTTGGTGGTGGTGCCTTTACTCAGGTTATGGATGCCAACTCCGCTTCTGGTGTGGTATTTGCCAATAAGATTGTTACGATCAACAAAGGTCTAACCCTCAGTAGTAGTGACCTAACCGGAGTTCGTAACCTAGTTCAGACTGGTATTGCAACTCTTGGTACAGTTAACTTCTCTGGTGTAACAACCACTGTAGGTAACGCATTCGTTGGTAATGACTTAAGTGTCTTAGGCACAGTCAACGCTAATGACTTTAACTCTACTTCTGACGCTACTAGAAAAGAAGACGTAGTTGAGATTGAAGATGCACTCGCTAAGGTCCTAGACCTACGTGGTGTAACATTCAACTGGAAGAATGGTGAAGGATCATCTGCTGGTGTTCTTGCACAAGAAGTTCAGATGGTTCTACCTGAGATTGTTAAGGGTGATGTAGGCAATATGTCCGTTCAGTATAACGGTATTATAGCACTTCTCGTCCAAGCAGTCAAGGAACTCTCTTCTGAAGTTGAAGAACTCAAGAGAACCAAGAGTGACAAGAGAAGGAAGAAATCCTGA

Genome Context

Tertiary structure

AIX33251.1
ESMFold2 structure
Source ESMFold2
pLDDT 55.3
Oligomeric state monomer