Genbank accession
CAB4221247.1 [GenBank]
Protein name
Concanavalin A-like lectin/glucanases superfamily
RBP type
TF
Evidence RBPdetect2
Probability 0,89
Seq2Symm
C1 confidence 0,919 truncated
C1 0,919
C3 0,070
I 0,008
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MANKNFIAKNGLTVGNLTVNAATGNLITSGNIVTASVYTDSYFYANGIPYFNTGYTGSAGPAFVIAKTYSSVADLIADTSPVDILPGQFAIINTNSAEIAENGKLYRWDGSSYTFIVDMSGAQGVDGPIGPIGFTGNIGYSGSIGYTGSVGYIGSVGYVGSKGNPGFQGATGLVGATGLGDTGPIGASGGLGYVGSAGYIGSRGATGAGAVGPTGATGPIGAQGVSVTLQGTKATIADLPAAPITWSDYAGHGWIVTTGDGGVHLDGALWFWNLATGQWNDVGKIVGPAGSSGATGVMGASGSTGALGYTGSIGIGYSGSVGYVGSVGYVGSIGYSGSKGIDGTSITVLGSVANLTYLNGPASTIIGNFGDGYILSDSGHLAVWTGSLFEDVGNVTGPQGNQGATGPIGYTGSFGATGATGPVGASGITPESLTYTAQSISLTDGVYVSGSLADIQSFNDGTYYTITDGTHAGPAWIVTVGFTGVVKFNRVALNINYTQNSGHTIYTQIYNNLTSVWDNIGSYTGLGGFYQFTLEVIDSVNYVNSGAVTVRLWHSNTGNAAHQTQIDYVAIQDAIQGGQGPKGASGALGYAGSNGYTGSAGYNGSVGYVGSKGEAGSFGGEAFAYTFSTDITSTDPPSGNIEFDSSTLSSATVLYINFLDATGASTYVFLNTIDDSTSSIKGHFTVVEAGNNANYAMFAIIGNHTEEGTPTNNHFHVPISYLSGPGSFTNGKSVIVTFARTGDRGDIGYFGSTGYVGSAGTFTGTTTLAIVTSNTTPSTSTTSGALQIAGGAGIAGNVYIGGIYSVPVGAPPTVEYLVVAGGGGGGAWTGGGGGAGGLLTSSASVLSGTSYTVTVGAGGAGGLYNGGAGPTTGTSGSNSVLSGTGFSTITAVGGGGGGGEGPKSGLNGGSGGGTSINGGSAGVGIYPGSTYISAPRQGYDGGSGDAGGGGGAGGAGFGANYGSGPPYGYGGPGLSSSISGSSTYYAGGGGGWGRNGLESGGTGGGGNGGYGGGVAATSGTVNTGGGGGGGNADFQSNPNGAAGGSGIIIIRYPDTYAAATFTGTATVTVSGGYRTYIFTDSGTITFNTSGAADFVSTSTSTTTGALIVAGGAGIAGNVYIGESVVTTNGIFWANGTSFTSSGPIGYSGSAGTGGSAGAPGSTGPTGYTGSFGATGPTGDTGPIGATGPTGDTGPIGASGPTGYTGSIGPVAGSNTQVIFNNAGAAGASANLTFNNTTNALTLTNGNLVTPINNTGLIGGTTMAGQGYVGNFNGTTQKLTISSSTLFNMGTGSFTVEGWVYLRSYTTGVAAGLFGTVGGGTDGYCLNIGESIDRLRITSNASGGWTDDVTVTAGNGVPLNTWTHVAMVRNGDSLVLYKNGVSVASRTGVSSWNFSSPSNYGEIAFFGAGENVYLNAYISNIRVVKGVAVYTGAFTPPTGPLSSTQSANPFGGANTAAITGTATSLLTLQNSTIIDNSSYASSITNTGTVTTGLQTVPFGSGVYAGTFLYDGTTWQATPIAVTGNLSATNLITTSGVFWANGVSFSSAGAAGASGPTGYTGSIGASGPTGYTGSIGASGPTGYTGSIGDTGTFSGTTTQAIITSNTDPSTNTATGALQVSGGAGISGNLYIGGNLVVTGNITTLNYETVTNTEIANAIVASGNITTTGRFVTTDGIFWANGTAFSSGGTGGSFDGTNEIIISNVSPSISTTSGALQVSGGIGLSGNLYAGGRLVTTGGVFWANGTAYSSGGTGGGGAGTGGTFYYTDVLPSSPEVGDRWFDTSVGILFTYTDEGNSVQWIEAAASGFLGQTGYTGSMSNAQGYTGSIGYAGSASTVAGYTGSTGAGYTGSVGQLSYTGILDGFTGDGATVAFALSVIPRNINNTTINLNGVIQLKSSYTLLNNVITFSEAPPVAAAIEITTQVYGPAYTPFLTWLYTSSGGNTFTVSNGVTNDSVLVMANGVVQRPVTDYAISGSMLTMVGTVSPGVVIHIRELPGAIQGDTGYVGSTGSLGYTGSTGIGYTGSSSTVIGYTGSQGITGAVTYTVTSPTTSAFVINGASNPTITLARGYTYYFDVGSEGFIIKTIGTTGASDYYNSGVTNNGGSNSRVTFTVPYDAPATLYYVSYTYSSMAGVFQIFDLGQTGYSGSAGYAGSSGAGYTGSSGGISAGKSIAMTIVFGG
Physico‐chemical
properties
protein length:2177 AA
molecular weight: 213641,18060 Da
isoelectric point:4,36384
aromaticity:0,10060
hydropathy:0,09463

Taxonomy

Phage
uncultured Caudovirales phage [NCBI] · taxon 2100421
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAB4221247.1 [NCBI]
Genbank nucleotide accession
LR797503 [NCBI]
CDS location
range 208238 -> 214771
strand +
CDS
GTGGCCAATAAGAATTTCATAGCAAAAAATGGCCTCACGGTAGGCAATCTAACAGTAAACGCTGCCACTGGCAACCTAATCACCAGCGGAAATATTGTAACTGCGTCGGTATATACAGACAGTTATTTTTATGCCAATGGTATTCCATACTTTAACACTGGATATACCGGGTCTGCCGGACCGGCATTTGTTATTGCCAAAACTTATTCAAGCGTAGCAGATCTAATAGCCGACACTAGTCCAGTTGATATATTGCCTGGGCAGTTTGCTATAATTAATACAAATAGTGCAGAAATTGCCGAAAATGGCAAATTGTACAGATGGGACGGATCCAGCTATACATTTATTGTAGATATGTCCGGAGCACAAGGTGTTGATGGCCCAATTGGACCTATAGGATTCACAGGTAATATTGGTTATTCTGGCTCCATTGGGTATACTGGTTCAGTGGGATATATTGGATCAGTTGGTTATGTTGGTAGTAAAGGTAACCCCGGGTTTCAGGGAGCAACCGGATTAGTTGGAGCAACTGGCCTCGGCGACACGGGCCCAATAGGAGCCAGCGGCGGACTTGGATACGTCGGTAGTGCTGGATATATTGGTAGTCGTGGTGCAACAGGTGCAGGTGCAGTAGGTCCAACAGGAGCAACAGGCCCTATAGGCGCACAGGGTGTTAGTGTAACATTACAAGGTACCAAGGCAACTATAGCAGATTTACCGGCTGCGCCAATAACCTGGAGCGATTATGCTGGCCATGGATGGATTGTAACAACCGGCGACGGTGGTGTCCACTTAGATGGCGCACTTTGGTTTTGGAATTTAGCAACTGGTCAATGGAACGATGTTGGTAAAATTGTTGGACCTGCTGGTTCATCGGGTGCAACTGGGGTCATGGGTGCCAGTGGGTCAACAGGAGCATTAGGATATACCGGATCAATTGGCATTGGATATTCGGGCAGTGTTGGTTACGTTGGCAGTGTTGGTTATGTCGGCTCAATTGGATATTCAGGCAGCAAAGGTATAGACGGAACCAGTATCACAGTGCTTGGCTCTGTTGCTAACTTAACATATTTAAATGGCCCTGCTAGTACAATTATAGGCAATTTTGGTGACGGTTATATTTTATCGGACTCTGGGCATCTTGCAGTTTGGACAGGATCATTATTTGAAGATGTGGGAAATGTTACCGGACCACAAGGTAATCAAGGTGCAACAGGTCCAATTGGCTATACTGGATCGTTTGGTGCTACTGGTGCAACGGGACCTGTTGGTGCTAGCGGTATTACACCAGAATCACTAACATACACAGCACAATCAATTTCACTAACTGATGGTGTTTATGTGTCCGGCAGCCTAGCCGACATACAAAGTTTTAATGATGGAACCTACTATACTATCACAGATGGTACTCATGCAGGCCCGGCGTGGATAGTAACAGTCGGATTCACTGGGGTAGTTAAGTTTAATCGTGTTGCATTGAATATTAATTACACTCAAAATTCTGGTCATACAATCTACACTCAGATATATAACAATTTAACTTCAGTATGGGACAATATTGGATCTTATACAGGATTGGGTGGCTTTTATCAATTTACATTAGAAGTAATAGATTCAGTTAATTATGTTAATAGCGGCGCAGTAACAGTCAGATTATGGCATAGCAACACAGGCAATGCAGCACATCAAACGCAAATTGATTATGTTGCAATACAAGATGCTATACAAGGTGGGCAAGGACCCAAAGGTGCAAGCGGTGCATTGGGTTATGCTGGAAGTAACGGGTATACAGGATCGGCAGGCTATAATGGTTCAGTTGGGTACGTTGGGTCCAAAGGTGAAGCAGGCTCATTTGGCGGCGAAGCATTTGCATACACATTTAGCACTGATATTACGTCAACTGACCCCCCATCTGGAAATATTGAATTTGATAGTTCTACACTATCATCTGCTACAGTATTATATATAAACTTTCTTGATGCAACAGGTGCATCAACTTATGTTTTTCTGAACACTATAGATGATTCAACTTCGAGTATTAAAGGACATTTTACTGTAGTAGAAGCTGGAAATAATGCAAACTATGCAATGTTTGCAATTATTGGTAATCATACAGAAGAAGGTACACCTACAAATAATCATTTCCATGTGCCAATATCTTATCTGTCGGGCCCTGGGTCGTTTACCAATGGTAAATCTGTAATTGTTACCTTTGCTAGAACTGGTGATCGGGGCGACATAGGATATTTTGGTAGCACTGGTTATGTTGGATCAGCTGGCACATTTACAGGAACAACTACACTAGCAATAGTTACCAGCAACACTACACCATCTACTAGTACTACGTCGGGTGCTTTGCAAATTGCAGGCGGCGCGGGTATTGCCGGTAATGTATATATTGGCGGCATTTATTCTGTACCGGTCGGAGCTCCGCCCACAGTTGAATACTTAGTGGTAGCTGGTGGCGGCGGGGGTGGCGCATGGACCGGGGGCGGTGGTGGCGCAGGCGGATTATTAACTTCGTCTGCTTCTGTTTTGTCTGGTACAAGTTATACAGTTACAGTTGGTGCTGGTGGCGCAGGCGGTTTATATAATGGAGGCGCCGGCCCAACTACTGGTACCAGTGGTAGTAATTCAGTTTTATCGGGAACTGGATTCAGCACCATAACAGCAGTAGGTGGTGGTGGTGGAGGTGGAGAGGGGCCAAAATCTGGATTAAACGGTGGTTCTGGTGGAGGTACAAGTATCAACGGCGGTAGTGCTGGTGTGGGTATCTACCCTGGTTCAACTTATATAAGTGCTCCGAGACAAGGATATGATGGCGGCAGCGGCGATGCAGGAGGCGGTGGTGGTGCAGGCGGAGCAGGATTTGGTGCTAACTATGGCAGCGGGCCGCCTTATGGATACGGTGGACCGGGTTTATCATCTTCTATAAGTGGATCAAGCACATACTATGCAGGTGGCGGCGGCGGTTGGGGAAGAAATGGATTAGAATCAGGTGGTACAGGTGGTGGCGGAAACGGCGGTTACGGTGGCGGCGTAGCAGCTACATCAGGTACCGTCAACACAGGTGGTGGCGGAGGTGGTGGAAACGCCGATTTTCAATCTAATCCTAATGGTGCTGCCGGTGGCAGTGGTATTATAATTATAAGATATCCTGACACATACGCAGCAGCAACATTTACAGGAACTGCAACTGTAACTGTATCTGGTGGATATCGAACATATATTTTTACTGATTCTGGAACTATTACTTTTAATACGTCAGGTGCTGCAGATTTTGTTAGTACTAGTACTAGTACCACAACAGGTGCATTGATTGTAGCTGGCGGCGCGGGTATTGCTGGTAATGTATATATTGGCGAAAGCGTAGTAACAACTAACGGAATATTCTGGGCCAATGGCACAAGTTTTACTAGTTCGGGGCCCATTGGCTATAGCGGTTCAGCTGGTACCGGCGGGTCAGCCGGCGCCCCCGGATCAACAGGTCCCACTGGCTATACAGGATCATTTGGCGCTACAGGCCCAACAGGTGATACAGGTCCAATCGGCGCTACAGGCCCAACAGGTGATACAGGTCCAATCGGCGCAAGTGGACCTACTGGTTATACTGGATCAATTGGACCAGTTGCCGGATCTAATACACAAGTTATTTTCAATAATGCAGGTGCGGCCGGTGCTAGTGCTAACTTAACATTCAACAATACAACTAACGCACTAACATTAACCAATGGCAATTTAGTTACCCCAATAAATAACACCGGTCTTATTGGTGGGACAACTATGGCAGGTCAGGGATATGTAGGTAATTTTAATGGCACTACACAAAAGTTAACCATTTCAAGTTCTACATTGTTCAATATGGGAACAGGATCTTTTACTGTAGAAGGATGGGTTTATTTACGCTCTTACACCACTGGTGTTGCCGCTGGATTATTTGGAACAGTAGGAGGCGGTACGGATGGATATTGTCTTAATATTGGTGAAAGTATTGACCGACTTAGAATTACAAGTAATGCAAGTGGTGGCTGGACAGATGATGTAACAGTTACTGCAGGAAACGGTGTTCCTTTAAATACTTGGACCCACGTCGCTATGGTTAGAAATGGTGATTCATTAGTACTATATAAAAACGGTGTTAGTGTAGCCAGCAGAACTGGTGTTAGTAGTTGGAACTTTTCTTCTCCTAGTAATTATGGAGAAATTGCATTTTTTGGGGCAGGGGAGAATGTTTACTTAAATGCTTATATATCTAACATAAGAGTAGTCAAGGGAGTAGCAGTTTATACCGGAGCCTTTACTCCTCCAACTGGACCACTTAGTTCTACTCAATCAGCAAACCCATTTGGCGGTGCTAATACTGCCGCTATAACTGGTACTGCTACTAGTTTATTAACATTGCAAAATAGTACAATAATTGATAATTCATCATATGCTTCATCAATTACAAATACTGGTACAGTAACTACCGGATTACAAACAGTACCATTCGGTAGTGGAGTTTATGCCGGTACTTTCTTATATGACGGTACTACTTGGCAAGCAACGCCAATTGCTGTAACAGGAAATCTAAGTGCTACTAATTTAATAACCACCAGCGGAGTATTTTGGGCTAATGGTGTAAGTTTTAGTAGTGCTGGAGCCGCTGGCGCAAGTGGCCCTACTGGTTACACCGGATCGATTGGCGCAAGTGGCCCTACTGGTTACACCGGATCAATTGGCGCAAGTGGCCCTACTGGTTACACCGGATCAATTGGCGATACTGGCACCTTCTCTGGTACAACTACACAGGCTATAATAACATCAAATACCGATCCTTCTACTAATACTGCAACTGGTGCATTACAAGTATCGGGGGGTGCCGGAATCTCGGGTAACTTATATATTGGTGGTAATTTAGTAGTAACTGGTAACATCACTACATTAAACTACGAAACAGTAACTAATACAGAAATTGCTAATGCCATTGTAGCCAGTGGAAATATTACCACCACTGGCAGATTTGTTACCACCGACGGCATATTTTGGGCAAACGGAACAGCGTTTAGTAGCGGCGGCACAGGTGGTAGCTTTGATGGCACTAATGAAATTATTATATCAAATGTTAGCCCATCTATTAGTACTACATCCGGTGCATTGCAAGTATCCGGCGGCATAGGATTATCCGGCAATTTATATGCAGGCGGTCGTTTAGTAACCACCGGTGGAGTGTTTTGGGCAAACGGAACAGCATATAGTAGTGGTGGTACAGGAGGCGGTGGCGCAGGCACTGGCGGAACTTTCTATTATACAGATGTATTACCATCGAGCCCAGAAGTAGGTGATAGATGGTTTGATACATCTGTTGGCATATTGTTTACATATACCGATGAAGGCAATAGTGTTCAATGGATAGAAGCTGCTGCTAGTGGCTTCTTGGGGCAAACTGGTTATACCGGCTCAATGAGTAATGCACAAGGCTACACTGGTAGTATAGGCTATGCTGGATCAGCTAGTACAGTGGCTGGTTATACTGGTAGCACTGGCGCAGGTTACACTGGTAGTGTTGGTCAACTCAGTTATACTGGTATACTTGATGGCTTCACTGGTGACGGTGCTACTGTGGCATTTGCATTAAGTGTTATACCAAGAAACATAAACAATACTACTATTAACTTAAACGGTGTGATACAATTAAAGAGTTCGTACACATTATTAAATAACGTAATTACATTTAGCGAAGCACCGCCTGTTGCAGCAGCAATTGAAATTACCACACAGGTATATGGCCCAGCATATACACCGTTCTTGACATGGTTGTATACCAGTAGCGGCGGTAATACATTTACAGTCAGCAATGGCGTAACTAACGACAGTGTGTTGGTTATGGCTAATGGTGTAGTACAGCGTCCAGTAACTGATTACGCAATCTCGGGCTCAATGCTAACCATGGTAGGAACCGTTAGCCCCGGAGTAGTTATACACATAAGAGAATTGCCTGGTGCAATTCAAGGTGACACTGGTTACGTTGGTAGCACAGGAAGTTTGGGCTATACTGGTAGTACAGGCATTGGCTATACTGGATCGTCTAGCACAGTAATTGGCTACACTGGTAGTCAAGGTATCACTGGTGCAGTTACCTATACAGTAACATCGCCTACTACATCAGCTTTTGTAATTAATGGAGCGAGTAATCCTACAATTACATTGGCCCGCGGCTATACCTACTATTTTGATGTTGGATCGGAGGGATTCATTATTAAAACTATTGGTACCACCGGAGCCAGCGATTATTACAATTCAGGTGTAACTAATAATGGTGGATCAAATTCTAGAGTAACATTTACAGTTCCGTATGATGCACCTGCTACACTGTATTATGTGTCATACACATACAGTAGTATGGCGGGGGTATTTCAAATATTTGATTTAGGACAGACTGGATATTCTGGTAGCGCAGGATATGCGGGTAGCAGCGGCGCAGGATACACTGGCAGCTCGGGCGGAATTTCAGCAGGAAAATCTATTGCAATGACAATAGTATTCGGAGGATAA

Genome Context

Tertiary structure

CAB4221247.1
ESMFold2 structure
Source ESMFold2
pLDDT 63.0
Oligomeric state monomer