Phage RBP Database

Genbank accession

CAL9954962.1 [GenBank]

Protein name

tail fiber protein

RBP type

TF

Evidence Phold

Probability 1,00

Protein sequence

MPRKQSTNRNVGNVQKFVGTSYDEMKALYDNLDALLALETGVQYTLRYLGPSAGDAPSTREDGSPIQDGDYFFDTDADALVYYDAVDDIWFAVDPSEVIQARDEAIAASIVAGQAKDNAELAANNARLSENTAKVYETNAEASKDAAGLSEMSAGLSATDAATYAAQSAIDASNTAADVMTTNADVVTTTDNAATTSTHAINAKNSETAAALSAQQAEQAFDSFDDRYLGTFSTPPTTDNDGDPLVKGATYYNSVELAVYYWNGAVWEAPDKSASDSADAAAASAATATTKAGEASNAATTALNAQTAAKSSENAAQSSQNAAEAAEVGAELAESNAATSEANAAESETVARASENNAANSAASAKENADRSEQHAAGGKGLTLAIRDALRAQRKREYTGSGFTEWGNQYDYNDGDPVQHGLWTYYGSTGSANELGLGADPSVDPNNLQGESRTDYPIANVDGVEMSLIGSTTSTPAYKNANKILFPTAPDGSKTLNESTGEVRKYHDLAGVGTPYEAHTVDFDGSTYIDLVASPYVMPVGSKVEFKFKLNDVSGYQYLFDTQNLTRVYIYKTTGTNNLLWGGFGSTIKVNGVDISTNTFAVEAGVEYHIEATTNATSNIDRIGAKSAGGVLSDFARGQIWDITLASSEDGVEPITYNTVTTQPKDDAAPVVSEIDAGDNPDMPTGYMPFYQDAGYVTIPEFPLADSMNISMVMRPDNDTELMVFGQNPEGQTMRLYWYNDTSSGLFRIAAGSGTSLTFDPLVAGRVYVTEVQIRKNVGASDYTVTAQVNGVIKTQSNVTFGHNTFDSFTLGSEEGVKNNNRWDGAIFGFGIEYPDAPDLNRTYGSVEVDDPAGRLTVEDDLGFGTEDWTPEFDGFNNVIVPPVMNFTGIARELEMTVVPDNVGSSWRIGQTFSKDGEVNRFYLRYDASGTITAGIGNATIQSVLNMTVGETYNFKFICDNSLNIELFVNGVSTITGTTSFRADFVLDNFYLGAAGTADSGPSEHLNGKLTNVRITDPNSVANSRHYPLVINQPTQPDTLIAEDAGYDKDTAPFYTPSYSNTDGWVEIPEITLGSGDAIKLKFQWEDEGKAYDGILDNASVPSLHLRIHNDGRLRWTNHGTLRVNGTVYTDGSFYPVSGEVYEVEIALDRNLTLARIGRLYNGNPWSGKIWDIEFTDNTDPTNSRYYPSVDYRVDGDTSGTVLDETHGLLSDSFSDGRWVESAAGTINGESLTITSSFGSGRVGTFPSPAINGVDVTVSFDVVSYSGTTNGGRVIVYRNGSQDGNLGTFDSSDVGTRVTLTANPTGNYGSDGNDVVFYVDASGISFEVANVEVSANNNGTLVNFPSGSEWTLAQVDGASDGTLENFTAGLEWNNDLPITDGTMVGFAQPWHHETGRYIGSIIGETTQAVWDVQDSQKAFHDVKYNADFHVITSRKDLVFLETWLEKVEGFVRPYGNVQFGGSSHDGVTLVPVTNFKAQGYSAFGEWDENTVGKVADWDAMTPTQKSVWASNPKNNLVFNPEDNEYYQDSYRIRTVEGLGDEWACVRPTIASTGTPTWLGYAQSGTNSRYIVQRGQREDTRDWYKDNTVSGTIFGGTNRSGFNDDEPTIFQNTEGTNTSSANGKCFAMPIALVQRLNQGAYHPTYNPQGCDAFIRNDGAAKVGWYVSNKFREPNNTGDCFPVRKGYPAWDGFRYGHGYIGQSGGRADQYKYYDAIYAGQVEDLRLNANKQDKQELLTDAVRRGVRGETRGKGKVPFTTVQTADQAATGSPTSAFDGIDTSHITVGDMCWAEDAAGDYQRRTITYAGSNGTISFNETIQGRKSDSKLIHERELSAEYDSLPWVDLIGDPERIAATFPDGVVGQWIPDLTTGNSDRDLNRKGIVLTGTLFTENDGASWTVESKAINSTTNTVNTFLDSSLLRLYLLTYEALSDFTESDDNLAVVGDLGDVYNAKFYTIERGNRIAPSLLGVILKDNRDPTHHQLRVNSYSIHPANGDLDGGSGYLPIHEPIRLPAPANDSDAVKALPHLVEKDGLLYVQWHGTQLFYDAAGTVGNEWGDTFAGTTFTNAYGKISIVDGEDTKPDENGNTVKVVTHTETIPIGIANHNQDI

Physico‐chemical properties

protein length:	2107 AA
molecular weight:	227549,30300 Da
isoelectric point:	4,42363
aromaticity:	0,09824
hydropathy:	-0,44542

Domains [InterPro]

InterPro ID	Start	End	Source	Name
IPR013320	880	1017	InterPro	Concanavalin A-like lectin/glucanase domain superfamily

	Name	Taxonomy ID	Lineage
Phage	Vibrio phage D472 [NCBI]	3105238	Viruses > unclassified bacterial viruses >
Host	No host information

Coding sequence (CDS)

Genbank protein accession

CAL9954962.1 [NCBI]

Genbank nucleotide accession

OZ195751.1 [NCBI]

CDS location

range 2364 -> 8687
strand +

CDS

ATGCCACGTAAACAGTCAACCAACAGAAATGTTGGTAATGTACAAAAATTCGTAGGGACATCCTACGATGAAATGAAAGCCCTTTACGATAATCTTGATGCGTTGTTGGCATTGGAAACAGGTGTCCAGTACACATTACGTTACTTAGGCCCATCTGCCGGAGATGCTCCGTCAACTCGTGAAGATGGTTCACCAATCCAAGATGGTGATTATTTCTTTGATACAGATGCGGATGCCTTGGTGTACTACGATGCAGTTGATGACATTTGGTTTGCAGTTGACCCAAGTGAAGTTATTCAAGCTCGTGATGAAGCTATTGCTGCATCTATCGTTGCAGGCCAAGCAAAAGACAATGCAGAATTAGCGGCAAACAATGCACGCTTATCTGAAAATACTGCAAAAGTGTACGAGACCAATGCTGAAGCATCAAAGGATGCAGCAGGGTTGTCTGAAATGTCTGCAGGCTTGAGCGCAACAGATGCCGCTACATATGCAGCACAATCAGCAATTGACGCGTCAAATACTGCCGCAGATGTCATGACAACAAATGCAGATGTGGTGACTACAACAGATAACGCTGCGACAACTTCTACCCATGCAATCAATGCAAAAAATTCTGAGACGGCTGCAGCTCTTTCAGCTCAACAAGCAGAACAGGCATTTGATAGTTTCGATGACCGTTACCTGGGTACGTTTTCTACCCCGCCTACAACAGACAATGATGGTGACCCTCTAGTAAAAGGCGCTACTTACTACAACTCTGTGGAATTAGCGGTGTACTACTGGAATGGTGCTGTATGGGAGGCACCTGATAAGTCTGCATCTGATTCGGCTGATGCGGCAGCAGCGAGTGCAGCCACAGCTACAACTAAAGCCGGTGAAGCGTCAAACGCAGCAACTACAGCTTTAAATGCACAGACAGCGGCAAAGTCTTCTGAAAATGCAGCGCAGTCTTCACAGAATGCAGCGGAAGCGGCAGAAGTGGGCGCAGAACTTGCTGAGAGTAACGCAGCAACAAGTGAAGCCAATGCTGCTGAATCAGAAACTGTTGCTCGTGCAAGCGAAAACAACGCGGCTAATTCGGCTGCTTCTGCCAAGGAAAATGCTGACCGTTCTGAACAACATGCTGCGGGTGGTAAAGGTTTGACTTTAGCCATACGTGACGCACTTCGTGCCCAACGTAAGCGTGAATACACAGGTTCAGGTTTCACGGAGTGGGGTAATCAGTACGATTACAACGATGGAGACCCTGTACAACACGGGCTATGGACGTACTACGGTAGTACGGGTTCAGCAAATGAACTGGGTTTAGGTGCAGACCCTTCAGTTGACCCTAATAACTTACAAGGGGAGTCTAGAACTGATTACCCTATTGCAAACGTTGATGGTGTGGAAATGAGCCTCATCGGTTCAACTACATCTACACCTGCGTATAAAAATGCAAATAAAATCTTATTCCCAACAGCACCAGACGGTTCTAAGACACTAAACGAAAGCACAGGTGAAGTACGTAAGTACCATGACCTAGCAGGTGTGGGTACTCCATACGAAGCTCATACGGTTGACTTCGACGGCTCTACTTACATTGACCTAGTAGCCTCGCCTTACGTGATGCCTGTAGGTTCTAAGGTTGAGTTTAAGTTTAAGTTAAATGATGTGAGTGGCTATCAATATCTATTTGATACGCAAAATTTAACGCGAGTTTACATCTACAAAACAACAGGAACTAATAATCTTTTATGGGGTGGTTTTGGTTCTACCATAAAGGTTAACGGCGTAGATATTTCAACTAATACATTTGCTGTAGAGGCTGGTGTTGAATACCATATTGAAGCAACTACAAACGCTACATCAAACATAGACCGTATTGGCGCTAAATCAGCAGGTGGCGTATTAAGTGATTTTGCGCGTGGTCAAATCTGGGATATCACTCTAGCTTCTAGCGAAGATGGTGTTGAACCGATTACGTACAACACAGTAACTACTCAACCTAAAGATGATGCAGCTCCTGTAGTGTCTGAGATTGATGCAGGTGACAATCCTGACATGCCGACTGGTTACATGCCTTTCTATCAGGACGCTGGTTACGTAACTATTCCAGAGTTCCCACTGGCTGATAGCATGAATATTAGTATGGTTATGCGACCTGATAACGACACTGAACTGATGGTATTCGGTCAGAACCCTGAAGGACAAACAATGCGTTTGTATTGGTACAACGATACATCATCAGGGTTATTCAGAATTGCAGCAGGTTCAGGGACAAGTTTAACTTTTGACCCTCTGGTGGCAGGTCGTGTTTACGTTACAGAGGTACAGATTCGTAAGAATGTAGGTGCAAGTGACTACACGGTTACAGCACAAGTAAATGGGGTTATTAAAACTCAGTCCAATGTTACGTTTGGTCATAACACATTTGATTCGTTTACCCTAGGTTCAGAAGAAGGTGTCAAGAACAATAACCGTTGGGACGGTGCTATCTTCGGATTTGGTATTGAATACCCTGATGCTCCAGACCTTAACCGTACCTACGGTTCAGTTGAAGTTGATGACCCTGCGGGACGATTGACTGTAGAAGATGACTTAGGTTTTGGTACGGAAGATTGGACACCTGAATTTGATGGTTTTAATAACGTAATTGTACCACCAGTAATGAACTTTACTGGTATAGCACGGGAACTTGAAATGACAGTAGTTCCCGATAATGTCGGTTCATCATGGCGTATAGGTCAAACGTTTTCTAAGGATGGTGAAGTTAACCGTTTTTATCTCCGTTATGACGCATCTGGAACGATTACAGCGGGTATTGGTAACGCAACAATACAGTCAGTTCTTAATATGACTGTTGGTGAAACATATAACTTTAAGTTCATATGCGATAATTCACTTAATATTGAACTGTTTGTTAATGGAGTTAGTACCATAACAGGTACTACATCATTCCGTGCAGACTTTGTTCTTGATAATTTCTATCTGGGTGCTGCGGGTACAGCAGATAGTGGTCCGTCAGAACACTTAAATGGTAAACTTACGAATGTACGTATTACTGACCCCAATTCAGTTGCTAACAGTCGTCACTATCCACTAGTAATCAATCAGCCTACACAGCCTGATACATTGATTGCAGAGGATGCGGGTTACGATAAAGACACAGCACCTTTCTATACCCCTTCTTATTCTAACACTGATGGTTGGGTAGAAATTCCAGAGATTACACTGGGTTCAGGCGATGCTATTAAACTGAAATTCCAATGGGAAGATGAAGGTAAGGCATATGATGGCATTTTAGATAATGCAAGCGTACCTTCATTGCACTTAAGAATACACAATGATGGTAGATTACGATGGACTAATCACGGCACGTTACGTGTTAATGGCACTGTGTATACAGATGGTTCATTTTATCCAGTATCTGGTGAAGTGTATGAAGTAGAAATTGCACTTGATAGAAACCTTACACTTGCAAGAATAGGAAGACTTTACAATGGTAATCCTTGGTCTGGTAAAATCTGGGATATCGAGTTCACAGATAACACAGACCCTACGAACTCACGTTATTACCCATCAGTAGATTACCGTGTAGACGGTGATACTTCTGGTACTGTTTTGGATGAGACTCACGGTTTACTGTCTGATTCATTCTCAGACGGTCGTTGGGTAGAAAGTGCAGCAGGAACTATTAACGGTGAATCATTAACAATTACATCTTCTTTTGGTTCAGGTAGAGTGGGCACATTCCCATCCCCTGCGATAAATGGTGTTGATGTTACAGTCTCATTTGACGTAGTTAGTTACTCAGGCACTACGAACGGTGGACGTGTCATCGTGTACCGTAATGGTTCTCAAGATGGCAACCTAGGCACATTTGATAGTTCGGATGTAGGTACTCGCGTCACACTTACAGCGAACCCTACTGGTAACTATGGCTCTGATGGTAATGATGTTGTTTTCTATGTAGATGCTTCTGGTATTTCTTTTGAAGTAGCTAATGTAGAGGTATCAGCAAATAACAACGGTACTCTAGTTAACTTCCCAAGCGGTTCAGAATGGACACTTGCTCAAGTAGACGGTGCTTCAGATGGTACGTTAGAGAACTTCACAGCAGGTTTAGAGTGGAACAATGACCTACCTATTACTGACGGTACAATGGTTGGCTTTGCACAACCTTGGCATCACGAAACAGGTCGTTACATTGGCTCCATAATTGGTGAAACTACTCAAGCAGTATGGGACGTTCAAGACTCTCAGAAAGCTTTCCACGATGTGAAATACAATGCCGACTTCCACGTGATTACATCACGTAAGGACTTGGTGTTCTTGGAAACTTGGTTAGAGAAAGTAGAAGGGTTTGTTCGACCTTACGGTAACGTACAGTTCGGTGGCTCTAGTCATGATGGTGTTACCCTGGTTCCGGTTACTAACTTCAAAGCTCAAGGCTACTCAGCGTTTGGTGAGTGGGACGAGAACACAGTTGGTAAGGTTGCTGATTGGGATGCAATGACCCCAACACAGAAATCTGTATGGGCAAGCAACCCTAAGAACAACTTAGTGTTCAACCCAGAAGACAACGAGTACTATCAAGACTCATATCGTATTCGTACAGTAGAAGGTTTAGGTGATGAATGGGCTTGTGTTAGACCAACAATTGCATCAACAGGTACACCTACATGGCTTGGTTACGCCCAATCAGGTACAAATAGTCGATACATAGTTCAACGTGGACAACGTGAAGATACTCGTGATTGGTATAAGGACAATACAGTATCGGGTACTATTTTTGGGGGTACTAACCGTTCTGGATTTAATGATGATGAACCAACCATTTTCCAGAATACAGAGGGTACAAACACTTCTTCTGCTAACGGTAAGTGTTTTGCTATGCCCATCGCACTAGTGCAGCGTTTGAACCAAGGTGCTTACCATCCAACGTATAACCCACAAGGTTGTGATGCTTTCATACGTAATGACGGTGCTGCTAAGGTTGGTTGGTATGTATCTAATAAGTTTAGAGAACCGAATAACACGGGCGATTGTTTTCCAGTACGTAAAGGGTATCCTGCATGGGATGGTTTCCGTTATGGTCACGGTTACATCGGTCAAAGTGGTGGACGTGCAGACCAATACAAATACTACGATGCTATCTACGCAGGACAGGTTGAAGACTTACGTTTGAATGCTAACAAGCAGGATAAACAAGAGTTGTTAACTGATGCAGTACGTAGAGGTGTTAGAGGTGAAACTCGTGGTAAGGGTAAAGTTCCTTTTACTACTGTTCAGACAGCAGACCAAGCGGCAACGGGTAGCCCTACTTCGGCATTTGATGGTATAGACACCTCACATATAACTGTAGGTGATATGTGTTGGGCTGAAGATGCAGCAGGTGATTATCAAAGACGTACTATTACCTATGCAGGTTCTAACGGAACTATATCGTTTAACGAAACTATCCAAGGGCGCAAATCGGATTCTAAGTTAATCCATGAACGTGAACTATCAGCAGAATACGATTCGTTACCTTGGGTAGATTTGATTGGAGACCCTGAACGAATTGCTGCAACGTTCCCTGATGGTGTAGTTGGTCAGTGGATTCCTGATTTAACAACTGGTAACTCAGATAGAGACTTAAACAGAAAGGGTATTGTCCTTACTGGAACTCTATTCACTGAAAATGATGGTGCAAGTTGGACAGTAGAGAGTAAGGCTATAAATTCTACTACTAATACGGTAAATACTTTCTTAGATTCAAGTTTGTTAAGATTGTATCTTCTAACTTACGAAGCACTATCAGACTTCACAGAGTCAGATGATAACCTTGCAGTAGTCGGTGACTTGGGTGATGTTTACAATGCTAAGTTCTATACAATAGAACGTGGTAATCGTATTGCACCTTCTTTATTGGGTGTAATACTAAAAGATAACCGCGACCCAACGCATCATCAGTTGAGAGTTAACAGTTACTCTATACATCCTGCTAATGGTGATTTGGATGGCGGTTCTGGTTACTTACCAATACATGAGCCTATTAGATTACCAGCACCTGCCAATGACTCTGATGCAGTTAAAGCACTTCCTCACTTAGTTGAGAAAGATGGTTTACTGTACGTTCAGTGGCATGGTACTCAGTTGTTCTACGATGCAGCAGGTACAGTAGGTAATGAGTGGGGAGACACCTTCGCAGGTACAACCTTCACGAATGCTTACGGTAAAATCTCTATTGTAGATGGTGAAGACACCAAGCCTGATGAGAACGGGAACACTGTTAAAGTGGTAACACACACTGAGACAATTCCAATTGGTATCGCGAACCATAATCAAGATATCTAA

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence