Genbank accession
CAB4190220.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect
Probability 0,89
TF
Evidence RBPdetect2
Probability 0,97
Seq2Symm
C1 confidence 0,565
C1 0,565
C3 0,274
I 0,059
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSKFVGNRITLPNLETAPSSPAAGDAYYDTGNNTAYIWNGTSWVDLAAGGGGSGDITSVAAGYGLTDGGTSGAVTLNVGAGTGITVNADDVAIDTATVPLKSDNLGVFGASTSAAIGVGSIELGHASDTTIARASAGVVSVEGVALVNTNDSRLTDARTPSSTLAHASSHKSAGSDSIRLDEFAAPTASVSLNSQKLVSVADPTLAQDAATKAYVDNVTSGINTHAPVVAASTANIAGTYANGTSDQSGGLGIGATFTATANGAISLDSVSPTSDQRVLLKNQTDQKQNGVYTVTTVGTGGTPFVLTRATDSNNSTANQVRAGDFVYVNSNPATTSNGGQGWVMNTVGTGTDGTIVIGTDNLNWVQFTGVSDATAGDGLVRTGNVISVGAGYGVSVAAESVAVDRTKVSRVFYGSSAPSTPASGDMWIDDSTDVASYAAQISIGTVTTGSPGSSATVNNSGTGSNAILDFSLPAGLTGATGSTGSAGTAATISVGTVTTGSVGSSASVTNVGTSTAATFNFSIPVGATGATGATGATGATGSAVVITPSPQTASYSLVAGDLYKMIEMNVATANTVTVGTALNSLVAGSQIHILQSGAGQTTIVGSSVTVNATPGLKLRTQWSAATLVKRTAADVTPGIWVAFGDLTA
Physico‐chemical
properties
protein length:648 AA
molecular weight: 63572,79710 Da
isoelectric point:4,46041
aromaticity:0,04938
hydropathy:0,12022

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAB4190220.1
1 648 aa
Domain Start End Length (AA) Confidence
N-terminal 1 139 139 0,6338
Central domain 140 338 200 0,1029
C-terminal 339 648 309 0,4396
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
uncultured Caudovirales phage [NCBI] · taxon 2100421
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAB4190220.1 [NCBI]
Genbank nucleotide accession
LR797158 [NCBI]
CDS location
range 20294 -> 22240
strand +
CDS
ATGAGTAAATTCGTTGGTAATCGTATTACCCTGCCGAATCTGGAGACGGCCCCGTCGTCCCCAGCGGCAGGGGATGCGTACTACGACACGGGCAACAATACTGCCTACATCTGGAACGGCACTTCCTGGGTAGACCTTGCTGCCGGCGGCGGAGGGTCTGGCGATATCACCTCTGTTGCTGCGGGATACGGCCTTACTGATGGGGGAACATCTGGGGCAGTAACTCTCAATGTCGGCGCGGGCACGGGAATCACCGTTAACGCTGACGATGTGGCGATTGATACTGCAACAGTACCGCTGAAATCTGACAATCTCGGCGTGTTTGGTGCATCAACATCCGCCGCAATCGGTGTTGGCTCCATTGAGCTCGGGCATGCCTCAGACACGACCATCGCCCGAGCATCTGCTGGGGTTGTTTCAGTTGAGGGCGTTGCCCTTGTCAATACCAACGACTCTCGTCTTACTGATGCGCGTACCCCAAGTTCAACACTGGCACATGCCTCCTCACATAAGTCTGCTGGCAGCGACAGTATCCGACTAGACGAGTTTGCTGCCCCCACCGCAAGTGTTTCGCTCAACTCCCAGAAGCTTGTATCAGTTGCTGATCCAACCCTTGCCCAAGATGCCGCCACCAAGGCATATGTAGACAATGTAACCTCAGGGATAAATACTCACGCCCCGGTTGTTGCCGCCTCTACGGCGAACATTGCTGGAACATATGCAAACGGAACATCTGACCAGAGCGGTGGGCTTGGGATCGGTGCAACGTTCACCGCAACGGCAAACGGTGCGATCTCACTTGACTCTGTTTCGCCAACAAGCGATCAGCGCGTTCTTCTTAAGAATCAGACTGACCAGAAGCAAAACGGTGTCTATACAGTCACCACTGTTGGAACTGGCGGAACTCCATTTGTTTTGACTCGAGCAACGGATTCCAACAACAGCACTGCAAATCAAGTTCGCGCAGGTGACTTTGTTTATGTGAACAGCAACCCAGCAACCACATCAAACGGTGGTCAGGGCTGGGTGATGAACACGGTCGGGACTGGCACTGACGGAACTATTGTAATCGGAACAGACAATCTCAACTGGGTGCAGTTCACTGGGGTCTCTGACGCCACAGCCGGAGATGGTCTAGTCCGAACAGGAAATGTGATTTCGGTTGGAGCTGGATATGGCGTGTCAGTTGCTGCCGAAAGCGTTGCTGTTGATCGCACTAAAGTTTCTAGGGTGTTTTATGGATCTAGCGCGCCATCAACTCCAGCATCAGGAGATATGTGGATTGACGACAGCACTGATGTTGCATCATACGCCGCGCAGATTTCTATTGGAACAGTTACAACTGGCTCTCCTGGGTCTAGCGCAACTGTAAATAATTCTGGGACCGGAAGCAATGCAATACTTGATTTTAGCCTGCCGGCTGGATTAACCGGAGCAACTGGATCAACTGGAAGCGCAGGAACAGCAGCAACAATCTCCGTTGGAACTGTTACAACTGGATCTGTTGGGTCCTCCGCGTCGGTTACAAATGTTGGAACCTCAACTGCTGCAACATTTAACTTTTCTATTCCAGTTGGCGCAACTGGCGCGACCGGAGCGACTGGGGCAACCGGAGCAACTGGATCGGCAGTAGTGATAACTCCAAGCCCACAGACTGCGTCGTATTCCTTAGTTGCTGGCGATCTGTACAAAATGATTGAGATGAATGTTGCCACGGCAAATACTGTCACCGTTGGAACTGCTCTTAACAGTCTTGTTGCTGGTTCTCAAATCCATATTCTTCAAAGCGGAGCCGGGCAAACCACGATTGTGGGATCTAGTGTAACTGTAAACGCAACCCCAGGGCTTAAACTGCGAACGCAATGGTCCGCAGCAACGCTAGTTAAACGAACGGCTGCCGATGTAACGCCTGGAATTTGGGTTGCTTTTGGAGATCTCACAGCATGA

Genome Context

Tertiary structure

CAB4190220.1
ESMFold structure
Source ESMFold
pLDDT 74.3
Oligomeric state monomer