Genbank accession
CAB4221704.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MPFIKLQFKPGVNRDQTDYSNEGGWYECDKIRFRSGYPQKLGGWVKTTTATFYGACRQMFNWVTSFSDDLMGMGTNAKLYLEAAGIFYDITPLRTTTPTMSTPNTDNCINTTITSTTITVNLGAAHSATTGQFVTISGVSGAVGGVPASELNANHQITVIDSDSFSFTVTTAATSTVVSSGGAAIIISFEITPGYAIATKGYGWGVGTWSRGYWGLGATNPVYLPQADWFLDNFDNDMVANLRNGALYYWERGTSSDASTSLATRAVLLSTLATANGYDANAVPTQVMQALVSQQDKHLLAFGAVPYGSTSTADFDPLLVRWTDQDNPTQWTPTATNSAGFARVSRGSRIICALPTRQEILVWTDTHLYTLQFTGTTDVFALQEYADNISVASPRSMTTAANITYWMGQDKFYAYTGRVETLPCTLRDHVFRNINYNQAAQIVCGTNEEWNEVWWFYPSETSDWNDSYVVFNHLDRIWYYGTIARTAWLDTPLRLYPQAADSDPTTYTGIMYTHESGVDDDEAPMESYIQSNDFDLEDGERFMLTRRIIPDLDFGGSTAAEPEATLHIRPRNFPGSTFTASAEDEAKVIETTVGSYTDQVFIRARARQMALKISSANLGVTWQLGAPRLDVRQDGTR
Physico‐chemical
properties
protein length:637 AA
molecular weight: 70352,33740 Da
isoelectric point:4,72920
aromaticity:0,11931
hydropathy:-0,26311

Domains

View on InterPro
CAB4221704.1
1 637 aa
STR 104–186 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAB4221704.1
1 637 aa
Domain Start End Length (AA) Confidence
N-terminal 1 168 168 0,4073
Central domain 169 367 200 0,0625
C-terminal 368 637 269 0,6207
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
uncultured Caudovirales phage [NCBI] · taxon 2100421
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAB4221704.1 [NCBI]
Genbank nucleotide accession
LR797506 [NCBI]
CDS location
range 17578 -> 19491
strand -
CDS
ATGCCGTTCATCAAGCTGCAGTTCAAGCCGGGGGTTAACCGGGATCAGACCGACTACTCAAACGAGGGTGGTTGGTACGAGTGTGACAAGATCAGGTTCCGCTCGGGGTACCCGCAGAAGCTTGGCGGGTGGGTAAAAACCACGACGGCTACGTTCTACGGTGCCTGCCGCCAGATGTTCAACTGGGTCACATCCTTCTCGGATGACCTCATGGGTATGGGTACTAACGCCAAGTTGTACCTCGAAGCCGCAGGTATCTTTTACGATATCACCCCGCTCCGAACCACGACGCCGACTATGTCCACTCCCAACACCGATAATTGCATCAACACTACGATTACCTCTACCACGATAACCGTAAACCTCGGCGCAGCGCATAGCGCCACTACAGGGCAGTTTGTTACCATTTCGGGGGTATCCGGCGCGGTAGGCGGAGTACCTGCCTCAGAACTCAACGCCAACCACCAAATCACGGTTATCGACTCGGACTCGTTCTCGTTCACCGTGACTACCGCAGCGACCTCCACCGTAGTTAGCAGCGGCGGCGCAGCAATCATTATCTCGTTCGAAATTACCCCCGGGTACGCCATCGCTACCAAAGGCTATGGGTGGGGCGTAGGGACGTGGAGCCGAGGATACTGGGGCCTTGGTGCCACCAACCCGGTATACCTGCCGCAGGCCGACTGGTTCCTTGATAATTTTGACAACGATATGGTGGCCAACCTTCGTAATGGGGCGCTCTACTACTGGGAGCGGGGGACCAGCTCCGACGCTTCTACCTCCTTGGCTACACGCGCCGTGCTCCTCTCCACCCTAGCTACGGCTAACGGCTACGACGCCAACGCTGTCCCTACGCAGGTAATGCAGGCGCTCGTGTCCCAGCAGGATAAGCACCTGCTGGCTTTTGGTGCGGTCCCCTACGGGAGCACCAGCACGGCAGACTTCGACCCCCTGCTGGTCCGCTGGACGGATCAGGATAACCCAACGCAGTGGACTCCCACCGCAACTAACTCGGCTGGCTTTGCCCGGGTGTCGCGGGGCTCGCGGATTATCTGTGCGCTCCCTACAAGACAAGAAATCCTCGTGTGGACCGACACGCACCTCTACACGCTGCAGTTCACCGGGACTACGGACGTGTTCGCCCTGCAAGAGTACGCAGACAATATATCCGTAGCCTCCCCGCGTTCGATGACCACCGCAGCTAATATCACTTACTGGATGGGGCAGGATAAATTCTATGCGTACACGGGCCGCGTAGAAACGCTCCCCTGCACCCTGCGGGACCACGTGTTCCGCAACATAAACTACAATCAAGCCGCGCAGATTGTCTGTGGCACCAACGAGGAGTGGAACGAGGTATGGTGGTTCTACCCCAGCGAGACCTCTGACTGGAACGACAGCTACGTCGTGTTCAACCATCTGGACCGCATCTGGTACTACGGGACCATCGCCCGTACTGCGTGGCTGGACACCCCCCTCCGGCTGTACCCGCAGGCGGCGGACAGCGACCCGACTACGTACACGGGCATCATGTATACCCATGAGTCTGGGGTAGATGACGACGAGGCCCCCATGGAATCGTACATACAGTCGAACGACTTTGATCTAGAGGATGGGGAGCGGTTCATGCTCACCCGGCGTATAATCCCCGATCTGGATTTCGGAGGGTCCACAGCAGCAGAGCCAGAGGCTACGCTGCATATTCGGCCTCGGAACTTCCCCGGCAGCACCTTTACCGCCAGTGCCGAGGATGAGGCGAAGGTCATCGAGACCACGGTTGGTAGCTACACGGACCAAGTCTTCATCCGAGCCCGTGCGCGGCAAATGGCGTTGAAGATATCCTCCGCAAACCTCGGGGTTACTTGGCAGCTTGGAGCGCCCCGGCTGGATGTGCGGCAGGACGGCACCCGTTGA

Genome Context

Tertiary structure

CAB4221704.1
ESMFold structure
Source ESMFold
pLDDT 84.8
Oligomeric state monomer