Genbank accession
AIX44189.1 [GenBank]
Protein name
hypothetical protein
RBP type
TF
Evidence RBPdetect2
Probability 0,57
Seq2Symm
C3 confidence 0,999 truncated
C3 0,999
C1 0,121
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MPLNYLTGRVSRLQVGFPGFSTAKDLTVDVAGAIGIDTQNPRAAADFPDVSIRGDIVDSVGFTGGIGYFLAQDVQGVRWVEAPPINSNAILVLDNGVIVGAGSFIGLNFDSGKDEDFLSVVPDPLNPQIAKIAYDVRWVRYNYGNNKGISTGFGDNGDYSSIPGYGTTEAVGVTSVGIGTNQPLDDFQVGIGSTGVTINGPLGLVDAEIIKAKSISVEGNLEVESLIVRPGVATLTTLDVLNEAFIPVEYVGFSSIQDANIDALFANQLLAGITTLGFGGEDVFILNDLYVQGGLGTFDGDVFVGGDLTVKGETFFNQINAVNLSVSGIATIVQAEIAVGLVTDLKVSGFSTLSDFSFNIGVGTYLELEDLDVSGVGSFGVVNSGDINVSGGLTASEIDADKGYIGILTADSIVSGAGTIGSIESDGNLTTLNDIIVGGASTFVGLGTFQDDLFVGGDLFVRGDVTFKNINGEQLLISGIGTIKELVFDSGIGTSLEVRDQITTGISTINEADIQDAAVERLTVGDAEIIGIATITEIDVDRGRVGILTGTDLSYAGIGTITEIDVDQGRVGLVTGDTLLYYEQSRINRVTFFDNYLSVNQSLRVSGLSTFVGTGTFFNDLYVGGDLYVAGELNFKQLNGENLYLTGVGTIYDLRNTVGFITNLYVEESVTGLATISSLVGSSATITDFTGQSLLIQNPFNPMPLDPTGIPGQGVIDSLLVRNLTSSNNILANDIDANFVDTDDLKAGVGTITDLEWTTAVGDDTTTNTLQVTDTATINIIDANQIDAEDANIGVATLSSLLVTGVTTFKGQVDIEDIEFVDQSVTGISSINILKFNVGYGTYLEVTDSVTGVGTIGLASITTAQVSFLDVRDEVVGASTIGVLSVTEGFAVSGFSTFVGFTTYKGDVFVDGNLTVTGFVSFTQLNADQSQIGILTVFDALDARTGVGTFKHLETVDSAVLSGVSTIGLTTFKNGDVNINRNLTVGGITTFIGNVFIEDTEFVELSVTNQANINKLFVNSGVATQFSIGVATITQSLTGIATIGDLNVTGLSTFVGLATFQGDVYVDSYLEVSKDVVVGSALTVPNLTFTDGDGQFLNIQEEVVGVSTIGFASITDEIVGTSTIFRSNIRDLAVSGLSTFIGDVLMGSNLDVVGDISGTNISIAQSVTSDTLFTRFADIEGSNTGVATIGFATITELFTEDLTVVGTSTFVGFTTMTGDLNIEGNLNVTGVVTFQQLDATQSQIGILTVFNYLDNQGDLRVVGFSTLGDFSANSGILTSIESGEIDVTGDVSIGGTLGVAGEVGFSSNFYTVGITTLASGTGIVTTGGDLYVGGNLFVYNDIVYDEIIGRNLDISGIGTIADLRVGLGSIADLRGTTLRYQTGIITSLRAEDSEVGRHIGTSVVVENITATGPSTFVGVVTTTNELFVGTNLFVGNNADIQGDIFGRNLTLELNASGTTLDFDSGQIDDLISQYILSDDLFVTGITTSVAAQINFLNVSGVTTSPIINSTLLTNSGLVTTGSLYVQGLAQVETTLLVDGNSIFNGPALFNDTVTVNDDINVTGDITFNDISGINGNFAGIVTATKLKSNFLEVNGQTAITGLATFFSGLNVRGGPLVVDNQIFANSGFVTTIQGTDLTYTDGIFLGDLQVNKDTTINQNLRVVGITTSTNLDVSAQTETSLLSVTGVGTIPILYSTNGEFKTSLKTDQLFFNTGLGTYLSVTDLNVVGVATIPTLDIEFLEADRAEIGILTVTNRTDISDTSSIFSYRLTTSGSATNVTLYDSSVYRSFEANIQVSTGSSFQSSKMHGLSDDNSTPNVLFNETSYLSNGGELAEFDVSGSAGNNVILTVTPYTVGITTYILSVTAVRV
Physico‐chemical
properties
protein length:1868 AA
molecular weight: 195185,85970 Da
isoelectric point:4,05003
aromaticity:0,07976
hydropathy:0,29775

Taxonomy

Phage
Synechococcus phage ACG-2014f [NCBI] · taxon 1493511
Host

Coding sequence (CDS)

Genbank protein accession
AIX44189.1 [NCBI]
Genbank nucleotide accession
KJ019152 [NCBI]
CDS location
range 195489 -> 201095
strand +
CDS
ATGCCTCTAAATTATCTTACCGGAAGAGTAAGTAGATTACAAGTTGGATTTCCAGGGTTTTCAACAGCAAAGGACCTTACAGTTGATGTAGCAGGTGCCATTGGTATTGATACCCAAAACCCAAGAGCAGCTGCCGACTTCCCAGATGTCAGTATCCGTGGTGATATTGTTGACTCTGTTGGATTTACCGGTGGTATTGGGTATTTTCTAGCGCAAGATGTTCAGGGTGTTCGGTGGGTAGAGGCTCCACCAATCAACTCTAACGCCATCTTAGTGTTAGACAATGGAGTTATCGTTGGTGCTGGATCATTCATTGGTTTAAACTTTGACTCTGGTAAGGATGAGGACTTCCTCTCGGTTGTTCCTGACCCACTAAACCCACAGATTGCAAAGATTGCATATGATGTTCGTTGGGTAAGATATAATTACGGTAATAATAAAGGTATCTCCACAGGTTTTGGAGATAATGGTGACTACTCCTCTATCCCTGGTTATGGAACCACAGAGGCAGTTGGTGTTACCTCAGTTGGTATTGGTACTAACCAACCACTAGATGACTTCCAAGTTGGTATTGGATCTACTGGTGTTACTATCAACGGACCTCTAGGTCTAGTTGATGCAGAAATTATTAAAGCAAAATCAATCTCGGTTGAAGGAAACCTAGAGGTTGAATCACTTATTGTTAGACCTGGTGTTGCCACTCTAACCACTCTAGATGTATTGAACGAGGCGTTCATACCAGTAGAGTATGTTGGTTTCTCCAGCATTCAAGATGCAAATATTGATGCTCTCTTTGCTAATCAGTTACTAGCAGGTATTACTACCCTAGGTTTCGGTGGTGAAGATGTATTCATCCTCAACGACTTATATGTTCAGGGTGGTTTAGGTACCTTCGATGGCGACGTATTCGTTGGTGGAGACCTAACTGTTAAGGGTGAGACGTTCTTCAACCAGATTAACGCAGTCAACTTATCAGTATCTGGTATTGCCACTATCGTCCAAGCGGAGATAGCTGTTGGTTTAGTTACCGATCTAAAAGTATCTGGTTTCTCTACACTATCAGATTTCTCATTCAACATTGGTGTTGGTACATACCTAGAACTAGAAGATCTAGATGTATCTGGTGTTGGTAGTTTTGGTGTTGTCAACTCTGGTGATATTAATGTTAGTGGTGGTTTAACCGCTAGTGAGATTGATGCAGATAAGGGATACATTGGTATTCTCACAGCAGACTCTATTGTATCTGGTGCAGGTACTATTGGTTCTATCGAGTCTGATGGGAACCTAACAACACTTAATGATATTATTGTTGGTGGTGCTTCAACCTTCGTTGGTTTGGGTACTTTCCAAGACGATCTCTTTGTTGGTGGTGACCTCTTTGTTAGAGGTGATGTTACCTTTAAGAATATTAATGGTGAACAACTACTAATCAGTGGTATTGGTACCATCAAGGAACTAGTCTTTGATAGTGGTATTGGAACCTCACTAGAAGTGAGAGATCAGATTACGACTGGTATATCTACGATCAATGAAGCAGATATTCAAGATGCCGCTGTTGAGAGACTCACTGTTGGTGATGCAGAGATCATCGGTATCGCAACTATTACCGAGATTGATGTAGATAGGGGTAGAGTTGGTATCCTAACTGGTACAGACCTCTCCTATGCTGGTATCGGTACTATCACGGAGATTGATGTTGACCAGGGTAGAGTTGGTCTAGTCACTGGTGACACACTACTATACTACGAACAGTCTAGGATCAATAGAGTTACCTTCTTTGATAACTACCTATCAGTTAATCAGAGTCTAAGAGTTTCTGGTCTCTCCACCTTTGTTGGAACAGGTACATTCTTTAATGACTTGTATGTTGGTGGTGACCTATATGTTGCTGGTGAACTAAACTTCAAACAACTCAATGGTGAGAACCTATACCTAACTGGTGTTGGTACCATCTATGATTTACGTAACACTGTTGGTTTCATTACTAACCTCTACGTAGAAGAGTCTGTAACTGGTTTAGCAACCATCAGTAGTCTAGTTGGTTCTTCCGCTACCATCACAGACTTCACTGGACAGTCACTACTCATCCAGAATCCATTCAACCCAATGCCTTTGGATCCAACTGGGATCCCAGGACAGGGTGTTATTGATAGTCTCCTAGTTAGAAACCTAACTTCTTCTAACAACATTCTAGCCAATGACATTGATGCCAACTTCGTTGACACCGATGATCTAAAGGCTGGTGTTGGTACTATCACTGACCTAGAGTGGACTACCGCTGTTGGTGATGACACTACTACCAATACTCTACAGGTTACTGATACAGCAACCATTAACATCATCGATGCCAATCAGATCGATGCCGAAGATGCTAATATTGGAGTTGCCACCCTCTCTAGTCTCCTAGTAACTGGTGTCACTACCTTCAAGGGTCAGGTTGATATTGAGGATATTGAGTTCGTTGACCAGAGTGTCACCGGTATTTCCTCTATCAACATCCTCAAGTTCAATGTTGGTTATGGAACTTACCTAGAGGTCACTGACTCAGTAACTGGTGTTGGAACTATTGGTCTTGCCAGTATCACAACCGCTCAGGTATCCTTCCTAGATGTAAGAGATGAGGTAGTTGGAGCATCCACTATTGGTGTTCTATCAGTAACTGAAGGATTTGCAGTATCTGGTTTCTCCACCTTTGTTGGTTTCACTACCTATAAAGGAGATGTATTTGTTGATGGTAACTTAACTGTTACTGGTTTCGTTAGTTTCACACAACTAAACGCTGATCAATCACAGATTGGTATCCTAACTGTATTCGATGCGTTAGACGCTAGAACGGGTGTTGGTACATTCAAACACCTAGAGACAGTAGATAGTGCAGTTCTATCAGGTGTATCTACCATTGGACTCACAACCTTCAAGAATGGTGATGTTAATATCAACCGCAACTTAACAGTTGGTGGTATCACTACCTTCATTGGTAATGTTTTCATTGAGGATACTGAGTTTGTAGAACTAAGTGTTACCAATCAGGCTAACATTAACAAACTATTTGTAAACTCTGGTGTTGCAACTCAGTTTAGTATTGGTGTTGCTACTATCACCCAGTCACTAACAGGTATCGCCACTATTGGTGACCTCAATGTAACTGGTCTTTCTACCTTCGTTGGTCTCGCTACCTTCCAGGGTGATGTTTATGTTGATAGTTACCTAGAAGTATCTAAGGATGTTGTAGTTGGTTCAGCACTAACAGTTCCTAACCTTACATTCACTGATGGTGATGGACAGTTCCTCAATATTCAGGAAGAGGTTGTTGGTGTATCCACTATTGGTTTTGCTAGTATTACAGATGAGATAGTAGGAACTTCCACTATCTTTAGATCCAATATTCGTGACCTAGCAGTATCCGGTCTCTCCACCTTTATTGGTGATGTGTTGATGGGTTCCAACCTAGATGTGGTTGGTGATATATCTGGAACTAATATATCAATTGCACAATCAGTAACCTCCGACACCCTATTCACTAGGTTTGCTGATATTGAGGGATCCAATACTGGTGTTGCTACTATTGGTTTCGCCACTATAACCGAACTCTTCACTGAGGATCTAACGGTTGTAGGAACCTCCACCTTCGTTGGTTTCACAACGATGACGGGAGACCTAAACATTGAGGGTAACCTTAATGTAACTGGTGTTGTTACCTTCCAACAGTTAGACGCAACTCAGTCACAGATTGGTATCCTAACGGTATTCAACTACCTAGACAACCAAGGAGACCTAAGAGTAGTTGGTTTCTCCACACTCGGTGACTTCTCAGCCAACTCCGGTATCCTTACCAGTATTGAATCTGGTGAGATTGATGTAACCGGTGATGTTTCTATCGGTGGAACACTAGGTGTTGCCGGTGAAGTTGGTTTCTCCAGTAACTTCTATACCGTTGGTATTACTACCCTCGCTTCTGGAACTGGTATTGTTACTACTGGTGGTGACCTCTATGTTGGTGGTAACCTATTCGTATATAACGATATTGTATATGATGAAATCATTGGTCGTAACCTAGACATCAGTGGTATTGGTACTATCGCAGACCTCAGAGTGGGTCTTGGTAGTATCGCAGACCTTAGAGGTACAACACTCAGGTATCAGACTGGTATTATTACTTCACTCAGAGCAGAAGATTCTGAAGTTGGAAGACACATTGGTACTTCAGTTGTTGTAGAGAACATAACTGCAACAGGTCCTTCTACTTTCGTTGGTGTTGTTACTACTACTAACGAACTCTTTGTTGGAACTAACCTATTCGTAGGTAACAACGCAGATATCCAAGGTGATATCTTCGGTAGAAACCTAACACTCGAACTAAACGCCTCTGGTACTACACTAGACTTTGATTCAGGTCAGATCGATGACCTTATCTCACAGTATATACTCTCTGATGACTTGTTTGTCACTGGTATTACTACTTCAGTTGCGGCACAAATCAACTTCCTGAATGTATCTGGTGTAACTACTTCACCTATCATTAACTCCACACTACTAACCAACTCTGGTTTAGTTACAACTGGTAGTCTATATGTTCAGGGTCTAGCACAGGTAGAAACAACTCTACTTGTAGATGGTAACTCCATCTTCAATGGTCCAGCACTCTTCAATGATACAGTTACAGTCAATGACGACATTAATGTAACAGGTGATATCACCTTCAACGATATCAGTGGTATTAATGGTAACTTCGCTGGTATTGTTACCGCAACGAAACTCAAGTCCAACTTCCTAGAGGTTAATGGTCAAACAGCCATTACTGGTTTGGCTACCTTCTTCAGTGGATTGAATGTAAGAGGTGGTCCTCTAGTAGTAGATAATCAGATCTTCGCTAACTCTGGTTTCGTTACTACCATTCAGGGTACTGACTTAACATATACTGATGGTATTTTCTTAGGTGATCTACAGGTCAATAAGGATACAACCATCAACCAGAACCTAAGAGTTGTTGGTATCACTACCTCAACCAACTTAGATGTATCAGCACAAACTGAAACCTCACTACTAAGTGTAACGGGTGTAGGTACCATTCCAATCTTATACTCCACCAATGGTGAGTTTAAGACTTCACTCAAGACGGATCAACTCTTCTTTAATACTGGTTTAGGTACATACCTCAGTGTTACTGATCTAAATGTTGTTGGTGTTGCTACTATCCCAACACTAGACATTGAATTCCTAGAAGCTGACAGAGCTGAAATTGGTATTCTAACCGTCACAAATAGAACTGATATCAGTGATACTTCCAGTATCTTTAGTTACAGACTAACTACATCTGGATCAGCCACCAACGTAACTCTCTACGACTCCTCAGTTTATAGAAGTTTCGAGGCAAATATCCAAGTATCCACTGGTAGTAGTTTCCAATCTAGTAAGATGCATGGTTTGAGTGATGATAACTCTACACCAAATGTACTCTTCAATGAAACTTCTTACCTCTCTAATGGTGGTGAGTTGGCTGAGTTTGATGTATCAGGTTCCGCTGGTAACAATGTTATCCTAACAGTTACTCCATATACAGTTGGAATTACAACCTATATACTTTCAGTAACCGCGGTAAGGGTCTAA

Genome Context

Tertiary structure

AIX44189.1
ESMFold2 structure
Source ESMFold2
pLDDT 40.6
Oligomeric state monomer