Protein

View in Explore

Genbank accession

CAM0065474.1 [GenBank]

Protein name

tail fiber protein

RBP type

Evidence Phold

Probability 1,00

Evidence RBPdetect

Probability 0,71

Protein sequence

MATKIEVTKLNALDDNLVEGQKVIEIILGPTIGADTADLALAVAQAEAAQAAAELAEDNAKASELAALASEGAAQTAQTLAEVAEGNAKASEIAAQSSEDDAQISEDAAAASEAAALASQNAAAVSAAAALASENAAQSSEDDAQVSEDNAAASEVAAAASAAAALASENAAQSSEDDAQISEDAAAASAAAALASENAAQSSEDDAKVSEDAAAASAAAALTQANRAETEADRSETEADRAQTIADSMTTALVPRGDWDASTGAFPTPTLSPERADFYQISVAGTMTTNKPTGQDDLSVEVGDQLYWNVVIDVWYSIDNTDQVTSVDGKKGVVVIDKYTQAEADARFVNAAGDTMTGALTIEESVMLVGNTAADNYMELAQVYGSSYGFTFQHNNASTMTNLQGSTNQALVLGDVSANVTDVLLGVSLKEGAGAWTKRLELDGAGELYLGSGAAYRTFHENYHPNADTWTTSRTVTLTGDVSGSFAIDGSADVSVSVVVEDDSHVHTDYLSNVATDLSNIMYGNIYASDEKPLIQLVGDDAYFGSHGRVGLQLASSSNPEWKTSTAAYKLFNESYHPNADTWTTARTITLTGDATGSFTMDGSSDESVEVTVVNDSHTHDTRYLKLAGGYMAGEITGPYSWVLNRTFVMIENETPQYLLLCLNAGGNNVNGEFILNRTSGNYQSANLNVVVSSGSSVSPYGTIVSVQSTQDDEEYRLVTVDYAGDSWVAIKYVGNSYPVTDPGLFSGRIQSSKAGSLTAVGAASITNEAPLRDATKFELNGQAIFHQGYHPNADTWTTARTLTFTGDATGSTTLDGSSDKSIAMTVVDDSHNHSYVNGTFEIRHANEQLKLVDTTDGNKWWMLDHQNGDLNFRYNGVSVTPALVIHETGNYVSAPSFSATTYLNLPIENVRTGNQADIRYNPVKGFEGHDGVEWGAIGGGGGVEWEATTGTSVVAETGAGYLVTEAGVTVVLPPTPDQGNTVGVGDYNGLNFEVTINPNGGKIMGLTEDFTFDTKNANIVFSYVDTTVGWILTQGFGESEAPQAIANKVIVTDAVGQSVISIPNNGSQTVDVWYNGLKLLRNDDYIVDEDLDTVTLTDPIDLSDDIVEVYAWNQALVLDTTDLLYHGTQMRKTIEGDGISLTEAIEARAPQPNLLINGDFVINQRQFAISSDVPIDGEFFVDRWFARNAIGGTNLCYSDFRNNTGMYTRMTHTGAAVSAYIGQRIEVMDWRPFVNTTASVEVSHSQDCVMSGVIHLRRVSDDTVLSSVFSNEVIVTPGLKTVVFTMEGLDISMVGSTECYAEFRIIYNNGGSIATPDGQYRFYTAKLESGLLATPFVPDSPQESLAKCQRYFYTTRGRTKSQIFGTATVSSTNDGTFQAGVPIPVPMRINKPALTQFGSFAIYGVSSTSGTKNETVTFTDGGSGAGVGFIDIIIQSNTVPTLLRGAVTLRGLNSSSWFNVDAEL

Physico‐chemical properties

protein length:	1465 AA
molecular weight:	155060,17720 Da
isoelectric point:	4,24476
aromaticity:	0,07782
hydropathy:	-0,16840

Domains

Domains [InterPro]

DC_1329
ATT
15–153

DC_1329 Coil DC_2177 DC_1152

Coil
Unmapped
39–66

Coil DC_1451

CAM0065474.1

1 1465

Architecture

ATT

STR

ATT

ATT 15-153 | STR 274-687 | ATT 688-1465

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_1329	ATT	DC_1329	15	153	Novel HMM	DC_1329	N-terminal	Low	Positional only	27 proteins / 27 hits
Coil	Unmapped	-	39	66	Coils	Coil	-	-	-	-
Coil	Unmapped	-	218	245	Coils	Coil	-	-	-	-
DC_2177	STR	DC_2177	274	546	Novel HMM	DC_2177	Central	Low	Positional only	30 proteins / 30 hits
DC_1451	STR	DC_1451	508	733	Novel HMM	DC_1451	Central	Low	Positional only	60 proteins / 60 hits
DC_1152	ATT	DC_1152	688	1465	Novel HMM	DC_1152	N-terminal	Low	Positional only	58 proteins / 58 hits

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Vibrio phage D145 [NCBI]	3104898	Viruses >
Host	No host information

Coding sequence (CDS)

Genbank protein accession

CAM0065474.1 [NCBI]

Genbank nucleotide accession

OZ196531.1 [NCBI]

CDS location

range 20301 -> 24698
strand +

CDS

ATGGCAACAAAAATAGAAGTAACCAAGCTTAATGCCTTAGATGACAATCTAGTAGAGGGTCAGAAGGTAATTGAGATCATACTTGGTCCGACTATCGGGGCAGACACAGCAGATCTAGCCCTTGCTGTTGCGCAAGCAGAAGCAGCACAGGCAGCTGCAGAGTTAGCGGAAGATAACGCTAAGGCCTCTGAACTTGCAGCGCTAGCATCAGAAGGTGCGGCACAAACAGCACAAACACTTGCAGAAGTGGCAGAAGGCAATGCTAAGGCATCCGAAATAGCTGCACAGAGCTCAGAAGATGATGCTCAAATATCAGAAGATGCGGCAGCAGCCTCTGAAGCGGCAGCGCTTGCGTCTCAAAACGCAGCAGCAGTATCAGCAGCAGCAGCCCTTGCTTCAGAAAACGCAGCACAAAGCTCAGAAGACGATGCTCAGGTGTCAGAAGACAACGCGGCAGCCTCAGAAGTAGCGGCAGCGGCATCAGCAGCTGCGGCACTTGCGTCAGAAAACGCAGCACAGAGCTCTGAGGATGATGCACAGATCTCCGAGGATGCAGCGGCAGCCTCAGCAGCAGCAGCACTTGCATCTGAGAATGCAGCGCAAAGCTCAGAAGACGATGCTAAAGTATCAGAAGATGCAGCAGCGGCATCCGCAGCGGCAGCACTAACTCAGGCAAACCGCGCAGAGACAGAAGCAGATCGCTCAGAAACAGAAGCGGATCGTGCTCAAACCATCGCAGATTCTATGACAACAGCTCTAGTTCCTCGCGGTGACTGGGATGCATCTACAGGAGCATTCCCTACACCTACACTATCTCCTGAACGAGCAGACTTCTATCAGATCTCCGTAGCAGGTACAATGACAACTAACAAGCCTACTGGACAGGATGATCTATCAGTTGAAGTAGGTGACCAATTATACTGGAACGTTGTAATCGACGTTTGGTACTCAATAGACAACACAGACCAAGTTACTAGCGTAGATGGTAAGAAAGGTGTTGTTGTAATTGATAAATACACACAGGCTGAAGCAGACGCTCGCTTTGTAAACGCTGCAGGCGATACGATGACTGGCGCTTTAACTATCGAAGAAAGCGTAATGTTAGTGGGAAATACCGCGGCGGATAACTACATGGAACTTGCCCAAGTTTATGGTAGCTCTTACGGGTTTACTTTCCAACATAATAACGCATCCACTATGACTAACTTGCAGGGTTCAACCAACCAAGCACTAGTTCTAGGTGATGTTAGTGCAAATGTTACAGACGTGCTATTGGGGGTGTCCCTAAAAGAAGGTGCGGGTGCATGGACTAAGCGTCTTGAACTCGACGGAGCAGGTGAATTATACCTTGGCTCTGGTGCAGCTTATAGGACTTTTCATGAAAACTACCACCCTAATGCAGATACATGGACTACCAGCCGTACAGTAACTCTTACTGGTGACGTTTCTGGTAGCTTTGCTATTGATGGATCGGCAGATGTCTCAGTCTCCGTTGTTGTTGAGGACGACAGTCACGTCCACACGGATTACTTGAGTAATGTAGCAACCGACCTAAGTAACATTATGTATGGTAACATATATGCCTCCGACGAGAAGCCCCTAATACAACTAGTCGGGGATGACGCATATTTTGGGTCTCACGGCCGAGTAGGATTGCAACTGGCATCCTCGTCAAACCCAGAGTGGAAGACTTCAACAGCCGCCTACAAACTATTTAATGAGTCCTACCACCCTAACGCAGATACTTGGACTACTGCTAGAACAATTACTCTTACTGGTGATGCTACAGGTTCATTTACTATGGACGGTTCCTCTGATGAATCGGTAGAAGTTACAGTCGTTAATGACTCCCATACCCATGATACGCGTTACTTAAAACTAGCTGGTGGGTACATGGCCGGTGAGATTACAGGGCCTTACAGCTGGGTACTAAATCGCACTTTCGTTATGATTGAGAACGAGACTCCTCAGTACCTATTGCTATGTCTCAACGCGGGAGGCAACAATGTGAACGGTGAGTTCATACTGAATAGGACGTCTGGTAATTACCAGTCTGCTAACCTTAATGTTGTAGTCTCTTCTGGTTCTTCTGTATCGCCGTACGGTACTATAGTGTCCGTGCAATCTACCCAAGATGATGAAGAGTACAGGCTAGTAACAGTGGACTATGCAGGCGATAGTTGGGTAGCTATTAAGTACGTAGGCAACTCGTATCCTGTAACAGACCCTGGTCTATTCTCAGGGCGTATACAGTCTTCTAAAGCTGGTTCACTTACTGCTGTAGGTGCCGCGAGCATAACCAATGAAGCACCCCTAAGAGACGCTACTAAGTTCGAGTTAAATGGGCAGGCTATATTCCATCAAGGATACCACCCTAACGCAGATACTTGGACTACTGCTAGAACTCTTACGTTTACAGGCGACGCTACGGGCTCTACTACTTTAGACGGCTCCTCAGACAAGTCTATTGCTATGACAGTGGTAGATGACTCACATAATCACAGCTATGTTAACGGTACATTTGAGATTCGCCACGCTAATGAGCAACTTAAGTTAGTGGATACTACAGATGGTAATAAATGGTGGATGCTAGATCACCAGAATGGTGACCTTAACTTCCGCTATAACGGAGTGTCAGTAACCCCTGCCCTAGTAATACATGAAACAGGTAATTACGTTAGTGCCCCTAGCTTTAGTGCTACAACCTACTTAAACCTACCTATAGAGAATGTCCGTACTGGTAATCAGGCAGATATTCGATACAACCCAGTCAAAGGCTTCGAAGGACACGACGGAGTAGAGTGGGGAGCTATTGGTGGTGGTGGTGGTGTTGAGTGGGAAGCAACCACAGGAACATCTGTAGTTGCAGAAACTGGCGCAGGCTATTTAGTTACAGAAGCCGGAGTTACAGTTGTACTTCCACCAACCCCAGATCAAGGTAATACTGTAGGTGTAGGTGATTACAACGGTCTTAACTTCGAAGTAACTATTAACCCTAACGGTGGTAAGATCATGGGGCTTACTGAAGATTTTACCTTTGATACCAAGAACGCTAACATAGTATTCTCTTACGTAGATACAACGGTTGGTTGGATCCTTACACAAGGTTTTGGTGAATCTGAAGCGCCACAGGCTATTGCTAACAAGGTTATAGTAACAGATGCAGTCGGACAGTCCGTTATCTCTATCCCAAATAATGGATCTCAGACGGTAGATGTATGGTATAATGGTCTTAAACTCCTACGCAACGACGACTACATCGTAGATGAGGACTTAGATACTGTTACGCTAACAGACCCTATAGACTTAAGTGATGATATAGTTGAGGTATACGCTTGGAATCAGGCTCTAGTACTAGATACTACTGATTTACTGTACCACGGTACGCAGATGCGTAAAACAATCGAGGGTGACGGTATTTCTCTTACAGAAGCTATTGAAGCCCGTGCTCCGCAACCAAATCTATTGATTAATGGTGACTTTGTTATCAACCAGCGTCAGTTTGCTATAAGTAGTGATGTTCCAATTGATGGGGAGTTCTTTGTTGACCGTTGGTTCGCTCGTAACGCAATAGGCGGTACTAACCTTTGTTACTCTGATTTCCGTAATAACACAGGTATGTATACTCGTATGACTCACACAGGAGCTGCAGTTAGCGCATACATTGGTCAAAGAATTGAAGTTATGGACTGGCGTCCGTTCGTAAATACAACAGCGTCTGTGGAAGTTAGTCACTCGCAAGATTGTGTCATGAGTGGTGTTATTCATCTTCGTCGGGTTTCTGATGATACTGTCCTTTCTTCTGTATTTAGTAATGAAGTTATCGTTACACCAGGGTTAAAGACAGTAGTGTTTACTATGGAAGGTTTAGACATCTCTATGGTGGGGTCTACAGAATGTTACGCAGAGTTCCGAATCATCTATAACAACGGAGGTAGCATCGCTACACCGGATGGTCAGTATCGTTTCTATACTGCTAAGTTGGAATCTGGTTTATTAGCTACACCATTTGTTCCGGACTCTCCTCAAGAGAGCCTGGCTAAGTGTCAGCGCTACTTCTACACAACTAGGGGCAGAACAAAGTCTCAAATATTCGGAACAGCTACCGTATCCAGTACTAACGATGGCACATTCCAAGCAGGCGTACCGATTCCTGTACCTATGCGAATTAATAAACCAGCACTTACTCAGTTTGGTTCTTTCGCTATTTACGGGGTTTCTTCTACGTCAGGTACTAAGAATGAGACAGTAACCTTTACAGACGGAGGCTCTGGGGCAGGTGTAGGTTTCATTGACATCATAATACAGTCTAATACAGTGCCTACCTTGTTAAGAGGTGCGGTAACGCTTAGGGGACTTAACTCAAGTTCGTGGTTTAATGTAGACGCGGAACTGTAA

Genome Context

Tertiary structure

PDB ID

742ea6e87680be9eb6dde6251c508e8afa8804fb0c143266aa206c131da9ab34

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,5497

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence