Genbank accession
CAB4140734.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,73
TSP
Evidence RBPdetect2
Probability 0,50
Seq2Symm
C3 confidence 1,000
C3 1,000
C1 0,002
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MTETRSLSRFASIANAAFNSMTANSTAVTSMTVGGVALNANGVASNTYTIGTAAYFVANGNLGIGTTSPGSALDVNGNIAVTGAARRITSDMSSANTLVRFALQTSTTNGDTGVYVLPNGTATTSGFLLFANSNPSNTSAAIVATTSTEFLISSSRSGTGTFLPMTFSAGGSERMRLDTSGRLLVGSTSARASLFNSTFTAPVQIEGTTSDNSSLLIVRNTDTAAGGSFLILGRARGTAVGSTTAVQASDAIGSLSFQAFDGSEFVEAARIQVVVDGTPGANDMPGGMVFTTTADGAAAATERMRITATGNVGIGTSSPDTRLTVFSSSGVQIAASDGTVSQRVGYCGFGLAFSGTSSNHSYALLTNDTERMRITAAGNIGIGTSSPGLGLTVERDNGNGWGAWFGANTSSDRVGLGVRNSRASIQGFNSSGFGADLVLQPDSGNVGVGTPSPAAAKLVVLTLPNSPSLVLTDATQSTLTIKHEATNLLTYEVAGSAVQRWVSNSVERMRIDALGRVTMPNQPAFIAYGGSGLTTTGSVQTALFSVGPVNVGSHYNSGTGRFTAPVAGNYYFSCTIAQSGTATGPVAYLAKNNGQVSHAAIAYSTAYNNATVCAVINLAVNDFVSVNIIGFNSSFSFIDFGYSGFTGYLIG
Physico‐chemical
properties
protein length:651 AA
molecular weight: 66124,52700 Da
isoelectric point:6,11919
aromaticity:0,07680
hydropathy:0,13364

Domains

View on InterPro
CAB4140734.1
1 651 aa
RBD 500–651

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAB4140734.1
1 651 aa
Domain Start End Length (AA) Confidence
N-terminal 1 414 414 0,0405
Central domain 415 613 200 0,1046
C-terminal 614 651 37 0,9982
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
uncultured Caudovirales phage [NCBI] · taxon 2100421
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAB4140734.1 [NCBI]
Genbank nucleotide accession
LR796380.1 [NCBI]
CDS location
range 50665 -> 52620
strand -
CDS
ATGACAGAAACACGCAGCCTTTCCAGATTTGCTAGTATTGCCAATGCTGCTTTCAACAGCATGACAGCAAACTCAACTGCAGTCACATCGATGACTGTTGGAGGTGTTGCATTGAATGCCAATGGTGTGGCGTCAAACACATACACCATTGGTACTGCTGCTTACTTTGTCGCTAATGGTAATCTGGGCATTGGAACTACATCACCTGGATCAGCGCTGGATGTCAATGGTAACATAGCTGTAACTGGCGCTGCTCGCCGCATCACTAGTGACATGAGTAGTGCAAATACTTTAGTTCGTTTTGCACTTCAAACTAGCACTACTAACGGTGATACGGGTGTATATGTTCTTCCTAACGGTACAGCTACCACTTCAGGCTTTCTGTTGTTTGCAAACTCCAATCCATCCAATACATCGGCAGCTATAGTTGCTACGACATCTACAGAATTTCTAATTTCATCATCCCGATCTGGCACAGGCACTTTTCTTCCGATGACCTTTAGTGCTGGTGGCTCCGAGCGTATGCGTTTGGATACATCCGGACGTCTTCTAGTAGGCTCCACTAGTGCGAGAGCAAGCCTTTTCAACTCTACCTTCACAGCTCCGGTACAGATCGAGGGCACAACATCTGATAATTCGTCGCTCCTTATTGTTCGTAATACGGATACAGCAGCTGGCGGTTCGTTTTTAATTTTAGGTCGTGCTCGTGGCACAGCTGTAGGTAGTACAACAGCAGTACAGGCAAGTGACGCTATTGGGTCTTTGAGCTTCCAAGCCTTTGATGGATCTGAGTTTGTTGAAGCAGCGCGCATACAGGTTGTTGTAGATGGAACGCCTGGCGCTAACGATATGCCCGGTGGAATGGTCTTTACAACCACTGCCGATGGCGCAGCAGCTGCTACTGAACGTATGCGCATCACTGCTACTGGTAACGTTGGAATTGGAACTTCGTCGCCAGATACAAGGCTAACTGTTTTTTCTTCTAGTGGTGTACAAATTGCAGCGTCAGACGGTACGGTTTCTCAGCGTGTTGGTTATTGCGGCTTTGGGCTTGCGTTCTCCGGCACGTCGTCGAACCACTCTTACGCCCTGCTGACCAACGACACCGAGCGCATGCGTATCACTGCTGCAGGCAATATTGGCATTGGAACATCATCGCCTGGATTGGGTTTGACAGTTGAACGTGACAATGGTAACGGATGGGGTGCTTGGTTTGGTGCCAATACGAGTTCAGATCGTGTTGGATTAGGTGTAAGAAATTCTAGAGCATCTATCCAGGGATTCAACTCAAGTGGATTTGGTGCTGATCTTGTATTGCAGCCTGACTCAGGTAACGTTGGTGTTGGCACGCCGTCGCCGGCCGCAGCCAAACTGGTAGTGCTTACTCTCCCAAATAGCCCTTCTCTGGTACTTACAGACGCTACGCAATCAACGCTTACCATCAAGCACGAAGCAACCAATTTGCTGACTTACGAGGTTGCTGGATCGGCGGTTCAGCGGTGGGTCAGCAATTCCGTTGAGCGCATGCGCATCGACGCACTTGGGCGTGTTACAATGCCAAACCAACCAGCCTTTATCGCTTATGGTGGATCTGGTTTAACAACGACAGGAAGCGTGCAAACTGCTCTCTTTTCTGTAGGACCTGTGAACGTAGGATCGCACTACAATTCGGGCACTGGTAGATTTACAGCTCCTGTTGCCGGGAACTACTACTTTTCCTGCACTATAGCTCAGAGCGGCACTGCTACTGGTCCAGTAGCATACCTGGCAAAAAATAATGGTCAGGTATCACATGCAGCAATTGCTTACTCAACAGCTTACAATAACGCCACCGTTTGCGCGGTTATAAACCTAGCGGTCAATGATTTTGTATCAGTGAATATTATAGGATTTAACAGTAGCTTTAGCTTCATTGATTTTGGTTACAGTGGGTTCACAGGATATCTCATAGGATAA

Genome Context

Tertiary structure

CAB4140734.1
ESMFold structure
Source ESMFold
pLDDT 70.8
Oligomeric state monomer