Phage RBP Database

UniProt accession

A0A024B3U2 [UniProt]

Protein name

Tail fiber protein

RBP type

TF

Evidence UniProt/TrEMBL

Probability 1,00

TF

Evidence GenBank

Probability 1,00

TF

Evidence Phold

Probability 1,00

Protein sequence

MVEFEPLETMRFQSQLGKEMKRKYKEGNNLVTLSLADVVKVNYKYNTVDVITVRENNSTAKNPNDNGKYSAMLPTHMSGRTANGNIYGSTTLVTVGTRVLIGFIDGQVDTPIVINIYGKTDDQQQLTRTDFTAADDSIESIQQELWNTFNLYPSMTYENVDGRGNREVTFSGKTFLISTDRDQENMYVQDAHFDYMDLPHSRYANGELIEPESPDAPTVLYVHQSVYDNHRTTFFVKADGTFRLGSRHVNGGGITYQELKPDGSYSIVKKNDTENPEEESSDLSSIEILKDGNVVLQNPKTKMEITDEGVMVNGKPIGSGGGISPELENIIKQINNQFSLLKITMSEIEGGLETKVEKDTYFIDTAEIEAKIKDMKDGARTSKDNLQKSIEALVKYIANDVNTNPITDANKLQITKLLDDIDNKKASLDGAAQMILLDPFLTDEQKVAVKKWYDKLNSDHTALKTTVMVAIQDGNLTAQDKKDISTAAETYLNDLTSWLTEMDKAADASYEQRIVDAFENAVNYANKESLHQSAVITHLYNMVSIKVSSEQVTQQFIDLNTKIEKTQEETATALDDFQTQIDNTVKNLPYKVEVTSSNGLIFVNGGVNSTLAAKITKGTEDVTSTVAVADFIWTRVSNNTAADTTWNNAHKNVGRSFNINAADVIDRATFFCDYKNPPVATGSVTIANIQDITVGNVEPTNPREGALWYDRGTGIVWMWQQNKWVEINRFDVNIRNLLIGSRDYGAQNSNNPTDPNNSTPQGNISGAWVMSGDTSGTPPKTGVKPSPQNATNQDTWISYTQSQWGGVKYKSSKLASSGLLDVGDMVTYVCYVRTVGGTSPDKGIPIRLYVTDNRDGGTGTIGFEMKDKETDGKPVTGAPVQMRATQQWKMVWGTFPVTQLFLDTANDPNSTSKHVRVEPTSFTDIGAGGQLEIKSHMVVKGVIPSDWVPAPEDTKRDSDNTNWNMDALGSDNYLTRFERGLVKTKLADITGESLLGTQDMKTSAQLDADTWGKGKFYSLRKQARDIAVDPNQDAAYKSLTTSYDALRTYLRALKTGAGRNTVYPWDTTSDVIMDVKRTEWDKAWADYENAYASLTVVVQQKQKDYTDNRIEDVNTEIKNISKTGQHATTDLRVPTTSISAPITTIALPSFKGFTKNNLQVGGVNYAYGTANKVEVKGNGAASTNQTVKPFTIKQDGLDLINTGKFICGYYWSIAQDGNNPVQGTMYVQLGGAPWTQIATPVAFSPSNMSGVYLADRNIAQSNGSGITDLQLRLDNVVGTVTVTNFMLTTNTTLETVEYSTNPTELRADGEYLYFNRNRAIAGVTMPTFYTAKNGTPDTARSSMTIQEVFHGNGSVYDDFHWTEDGTPTKTNKFADMLLDTGFSLAIQNQNVQLPNENGVTERYIQVQLNNFASRPMANNGTVRLANGKGLELERLASGNFTKYNQFKVDFANANMSFLVSAKEMNVAAAYQVKSEEVLFFMRGWKMFQGEPVQKNTGGVVTYTFNTYSGSDNSAPNFTPIGYVQKDQAIMNKGVLASTGEYKRPVEVAAPIRTKQTGQQWQVVYQLALPYDSTCQFTGAIDLIGDPEKVSPTVVRYTYVDWTPPFNDKDGTFMYGINLATAQEDTRYLIPVLERRIANAEQKVETDSIKSVVFSSREYELGLQDKASVADVEAKADKSDLTDLATKDELKSSEEARKRELEEAMKNIDFTPYVQKSEIEQLDRQWTAAFYSSGGMNIVKNSIGFDKSMSAKLNRETFTFWDDMINTAYHQPVNIQTNALDALGFTSGFMFNESPNTNWTAIAQVLNVIPNQPYTISYFLQKMNAGDSNYRFNILIQQTEKENPTSSDDWVTIQGGQISDNSSIKHSGFMPSYFEFTPTKSKVRLVLIAAPKCVAQISGIMVNIGKKPIKWTMSTGENYNTNVRMNLNGIRVSQVDKDGTEIGYTVITPERFAGYYIRDGKPEEIFRLDGDETWTKKLRAENEINMGPIKILRVENPNNAGWAFISNY

Physico‐chemical properties

protein length:	2007 AA
molecular weight:	223001,54030 Da
isoelectric point:	5,09371
aromaticity:	0,09018
hydropathy:	-0,50399

Domains [InterPro]

InterPro ID	Start	End	Source	Name
Coil	549	569	Coils	None
Coil	1683	1706	Coils	None

	Name	Taxonomy ID	Lineage
Phage	Bacillus phage Megatron [NCBI]	1486661	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	Bacillus thuringiensis [NCBI]	1428	Bacteria > Firmicutes > Bacilli > Bacillales > Bacillaceae > Bacillus

Coding sequence (CDS)

Genbank protein accession

AHZ10683.1 [NCBI]

Genbank nucleotide accession

KJ489401 [NCBI]

CDS location

range 54851 -> 60874
strand +

CDS

ATGGTAGAATTTGAACCTTTAGAAACAATGAGATTCCAATCACAACTCGGTAAAGAAATGAAACGTAAATACAAGGAGGGTAACAATCTTGTTACTCTCTCTCTTGCTGATGTCGTAAAAGTTAACTATAAGTATAATACAGTTGACGTTATCACGGTAAGAGAAAACAACTCTACAGCTAAAAACCCTAACGATAACGGTAAGTACTCAGCTATGCTTCCAACTCATATGTCTGGACGTACAGCTAATGGTAATATCTATGGTTCTACTACATTAGTAACTGTAGGTACGCGTGTACTAATCGGTTTCATCGATGGTCAGGTTGACACACCAATCGTAATCAACATCTACGGTAAGACCGATGACCAACAACAATTAACACGTACAGACTTCACAGCAGCAGATGATTCAATTGAGTCTATCCAGCAAGAACTGTGGAACACTTTCAATCTATATCCATCAATGACTTATGAAAATGTCGATGGTAGAGGTAACCGTGAAGTGACATTCTCTGGTAAGACGTTCTTGATTTCGACAGACCGTGACCAAGAGAACATGTACGTACAAGATGCGCATTTCGATTATATGGACCTTCCACATTCTCGTTATGCGAATGGAGAGCTTATCGAACCAGAATCTCCTGATGCACCAACAGTACTTTACGTTCACCAAAGCGTATATGACAACCATCGTACAACTTTCTTCGTGAAAGCAGACGGTACGTTCCGATTAGGTTCTCGTCATGTTAATGGTGGAGGTATTACGTACCAAGAACTAAAACCAGATGGCTCTTACTCAATCGTTAAGAAGAATGATACGGAGAATCCAGAAGAAGAATCTAGCGACCTATCTTCTATCGAAATCTTAAAGGACGGTAACGTAGTGTTACAGAATCCTAAGACGAAAATGGAGATTACTGATGAGGGTGTAATGGTTAATGGTAAGCCAATCGGTTCTGGTGGAGGTATATCCCCTGAGTTAGAGAATATCATAAAACAGATTAATAATCAATTCTCTTTACTAAAAATTACAATGTCTGAGATTGAAGGCGGTCTTGAAACAAAAGTAGAGAAAGACACCTACTTCATCGACACTGCTGAGATTGAAGCTAAGATTAAAGACATGAAAGACGGTGCTCGTACAAGTAAAGATAATCTACAAAAATCTATTGAGGCACTAGTAAAGTATATTGCTAATGATGTTAACACAAATCCTATAACGGATGCTAACAAATTGCAAATTACGAAATTATTAGATGACATAGATAACAAGAAAGCATCTCTTGACGGTGCTGCACAGATGATACTGCTGGACCCATTCTTGACAGATGAGCAGAAAGTAGCTGTGAAGAAGTGGTACGATAAACTTAACTCTGACCACACTGCACTGAAGACGACTGTGATGGTAGCTATCCAAGATGGTAACTTAACAGCACAAGATAAAAAGGACATCTCAACTGCCGCAGAAACATACCTAAATGACCTAACTTCTTGGTTAACGGAGATGGATAAAGCAGCTGATGCTAGTTACGAACAGCGTATTGTTGATGCATTCGAGAACGCAGTGAACTACGCGAACAAAGAGTCATTACACCAAAGTGCAGTAATCACTCATCTATATAACATGGTATCTATCAAAGTTAGTTCTGAGCAAGTGACACAGCAGTTCATTGATTTGAACACGAAGATAGAAAAGACACAAGAAGAGACAGCTACAGCACTAGACGATTTCCAAACTCAGATTGATAACACAGTTAAGAACTTACCATACAAGGTAGAAGTGACATCATCTAACGGTTTGATATTCGTAAATGGTGGAGTTAACTCTACGCTAGCAGCTAAGATTACAAAAGGTACTGAAGACGTAACAAGTACAGTAGCTGTTGCTGATTTCATATGGACTCGTGTTTCTAATAACACAGCAGCGGATACAACTTGGAACAACGCTCACAAAAATGTAGGTCGCTCATTCAACATTAATGCTGCTGACGTAATTGATAGAGCAACATTCTTCTGTGACTACAAGAACCCTCCAGTAGCTACAGGTAGTGTTACAATCGCGAACATCCAAGATATCACAGTAGGTAACGTTGAGCCAACAAATCCACGTGAAGGTGCTTTATGGTACGACCGCGGAACAGGTATCGTGTGGATGTGGCAGCAAAACAAATGGGTAGAGATTAATAGATTCGATGTTAACATCCGTAACTTATTAATCGGTTCTCGTGACTATGGCGCACAGAACTCTAATAATCCAACAGACCCTAACAACTCGACACCTCAAGGTAATATATCAGGCGCATGGGTTATGTCAGGTGACACATCAGGGACGCCGCCTAAGACAGGAGTTAAACCTTCACCACAGAATGCTACGAATCAAGATACATGGATATCTTATACGCAAAGTCAATGGGGCGGAGTGAAATACAAATCTAGTAAGCTCGCTAGCAGCGGTCTATTAGATGTGGGGGATATGGTTACTTACGTGTGTTATGTACGAACAGTAGGCGGAACAAGCCCTGATAAAGGCATACCTATTAGATTATATGTAACAGATAATCGCGATGGTGGTACTGGTACAATCGGTTTCGAAATGAAAGATAAAGAGACAGACGGTAAACCAGTAACTGGAGCCCCTGTACAGATGCGCGCAACACAGCAATGGAAGATGGTATGGGGTACATTCCCTGTAACACAATTATTCCTAGATACTGCAAATGACCCAAACAGTACATCTAAGCACGTACGAGTAGAGCCGACGAGTTTCACAGACATCGGAGCCGGAGGACAACTAGAAATTAAGTCTCATATGGTTGTTAAAGGAGTTATTCCTTCTGACTGGGTTCCAGCTCCAGAAGATACAAAGCGTGACTCAGATAACACCAACTGGAACATGGATGCTCTTGGAAGCGATAACTACCTAACTCGTTTTGAGCGTGGATTAGTTAAAACTAAATTAGCAGACATTACAGGCGAGTCACTTCTTGGCACGCAGGACATGAAGACATCAGCTCAGTTAGATGCAGACACATGGGGCAAAGGTAAGTTCTACTCTTTACGTAAACAGGCTAGAGACATCGCTGTGGACCCGAACCAAGATGCAGCATACAAAAGCTTAACTACATCTTACGACGCACTTAGAACGTACCTGAGAGCTCTTAAAACAGGTGCTGGTCGAAACACAGTGTACCCATGGGATACTACCTCTGATGTAATCATGGATGTTAAGCGTACAGAATGGGACAAAGCGTGGGCAGATTACGAGAATGCTTATGCATCGTTAACAGTAGTTGTACAGCAAAAACAGAAAGACTACACAGATAATCGTATCGAAGATGTAAATACGGAAATCAAGAACATCAGTAAGACAGGTCAACACGCAACAACTGACCTACGAGTCCCTACTACATCTATTTCTGCACCGATAACAACAATCGCGTTACCTAGTTTCAAAGGTTTCACGAAAAATAACTTGCAAGTTGGTGGTGTGAACTACGCGTATGGAACAGCAAACAAGGTAGAGGTTAAAGGTAATGGCGCAGCTTCAACAAACCAGACAGTAAAACCATTTACGATTAAACAAGATGGACTAGACTTAATCAATACTGGTAAGTTCATTTGTGGGTATTACTGGTCAATCGCGCAGGATGGAAACAACCCTGTACAAGGTACAATGTATGTTCAATTAGGTGGAGCACCTTGGACACAGATAGCAACTCCTGTAGCATTCTCTCCAAGTAACATGTCAGGTGTCTACTTAGCGGATAGAAACATAGCCCAAAGTAACGGCTCAGGCATAACAGACTTGCAGTTGCGTTTAGACAATGTGGTAGGTACTGTAACAGTAACTAATTTCATGTTAACAACGAACACTACACTGGAGACTGTCGAGTACTCTACAAACCCTACAGAGTTAAGAGCTGATGGTGAGTATCTGTACTTTAACCGTAACAGAGCTATTGCAGGTGTAACAATGCCTACGTTCTACACAGCTAAGAACGGAACACCAGATACAGCTCGTTCATCCATGACAATCCAAGAAGTGTTCCACGGTAACGGTTCGGTTTATGATGACTTCCATTGGACAGAGGATGGTACACCAACTAAAACCAACAAGTTCGCAGACATGCTGTTAGATACTGGATTCTCTCTTGCTATCCAGAACCAAAACGTTCAACTTCCTAATGAGAACGGAGTTACAGAGCGATACATCCAAGTACAGCTTAATAACTTCGCTAGTAGACCGATGGCTAATAATGGTACGGTTCGATTAGCTAATGGTAAAGGTTTAGAGTTAGAAAGATTGGCATCTGGTAACTTTACTAAGTACAACCAGTTCAAAGTTGACTTTGCTAATGCGAACATGTCATTCCTCGTATCTGCTAAAGAAATGAACGTTGCAGCAGCATACCAAGTAAAGAGCGAAGAAGTGTTGTTCTTTATGCGAGGATGGAAAATGTTTCAAGGAGAGCCAGTGCAGAAAAATACAGGCGGTGTCGTAACGTACACGTTCAATACTTACTCTGGTTCCGATAACTCAGCTCCTAACTTCACTCCAATTGGTTACGTTCAAAAGGACCAAGCGATTATGAATAAAGGTGTACTCGCTTCTACAGGAGAGTACAAGCGCCCAGTTGAAGTCGCCGCACCTATAAGAACAAAACAAACAGGTCAACAGTGGCAAGTTGTGTATCAGTTAGCGTTACCGTATGATTCTACATGTCAGTTCACAGGAGCTATCGATTTAATAGGTGACCCAGAGAAAGTATCACCTACAGTAGTCCGTTATACGTACGTAGACTGGACACCACCATTCAATGACAAAGATGGTACATTTATGTACGGTATTAACTTAGCGACTGCACAAGAGGATACTAGATACCTTATACCTGTTCTTGAGAGACGTATTGCTAACGCAGAGCAGAAAGTAGAGACAGACTCTATCAAGAGTGTCGTATTTAGTTCTCGCGAGTATGAGTTAGGATTGCAAGATAAAGCAAGTGTAGCCGATGTAGAAGCTAAGGCTGATAAGTCGGACCTTACCGATTTAGCGACTAAGGACGAGTTAAAGAGTAGCGAGGAGGCGCGTAAGCGTGAATTAGAAGAGGCGATGAAAAATATCGACTTCACTCCTTATGTACAAAAGTCTGAGATTGAGCAGTTAGACAGACAATGGACAGCTGCATTCTACTCTTCTGGTGGTATGAATATCGTTAAGAATTCTATCGGGTTCGATAAATCGATGAGTGCTAAATTAAATAGAGAGACGTTCACTTTCTGGGACGATATGATTAACACGGCATACCATCAACCAGTTAATATCCAGACTAACGCATTAGACGCATTAGGATTCACTAGTGGGTTCATGTTTAACGAATCACCGAACACTAACTGGACAGCAATAGCTCAAGTGCTTAATGTTATCCCTAACCAACCATACACGATAAGTTATTTCTTACAGAAGATGAATGCAGGAGACAGCAACTACAGATTCAACATCCTAATCCAGCAGACAGAGAAAGAAAACCCAACATCAAGTGATGACTGGGTGACTATCCAAGGTGGTCAAATATCGGATAACAGTAGTATTAAGCACAGTGGTTTTATGCCTTCTTACTTCGAGTTTACTCCAACAAAGAGTAAGGTTCGATTGGTGTTAATTGCCGCTCCTAAATGCGTAGCACAGATTTCTGGTATAATGGTTAACATAGGGAAAAAACCCATCAAGTGGACAATGTCTACAGGGGAGAACTACAACACGAACGTTCGTATGAACTTAAACGGTATCCGAGTATCTCAGGTTGACAAGGATGGTACAGAAATTGGGTACACGGTCATCACACCGGAACGTTTCGCAGGTTATTACATCCGAGACGGTAAACCGGAAGAGATATTCCGACTCGACGGTGATGAAACTTGGACTAAAAAGTTAAGAGCCGAAAATGAGATAAACATGGGACCGATTAAGATTCTACGTGTTGAGAATCCTAACAACGCAGGATGGGCGTTTATTTCTAACTACTAG

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence