Genbank accession
CAD2272902.1 [GenBank]
Protein name
long tail fiber proximal subunit
RBP type
TSP
Evidence RBPdetect
Probability 0,52
TF
Evidence RBPdetect2
Probability 0,69
Seq2Symm
C3 confidence 0,962 truncated
C3 0,962
C1 0,292
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSDLLKQHFRATNGLDAGGNKVINVALADRNVKTDGVSVEYVIQENTIQKYDPTRGYLTDFAVTYGRRIWIANKDIPKPAGAFNQANWTSLRVDPNWIYTVRKGEFEVQSGQFINVDSNAAGNATLLLPLAPDEGDTIVVRDIGGRPGYNGILIKAQDTGASIVFGESRLREVRLTRPYSQIMLTFSNGAWRASLTDFGDTAKMVVPNGIVPTQVQAGDNVVRRYTSNSEIFITLPLFANSNDIINFTDLDGTSPINHMTVRTFDPTISIGTPGQTEVQVRTSGNGFLVYDSIDKIWRIFENDLRTRVRIITSDVTLMPNEHISVFGADNNTVKTINVTLPTDVAVGDTVTIAMNYMRKGQTVVIKASDGDTIASNLNLLQFPKRSEYPPDAAWVQSSSITFNGTTSYVPVLGLAYIEDKASGKSYWIVTESDPTVERVDAKDNTTRARLGVIALATQAQANAESNPEKELAITPETLNGRRSTETQTGIARIATSSEVNQATTASYLDNVIVTPKKLNERSATETRRGLAEIATNAKMDAGEDDFTIVTPKKLLYRTTSDSRLGVIQLVKTGGAPNTTADRSSAGTGIFDHSDYKNAVTPKTLREYKATVNQSGIVWLATDSEVRNGTPASSNIPTVVTPEALHKKVATDGAIGLIQIATQTEVNAGGVTNKAVTPKTLNDRTATNDRTGIARFATPGAQGEFEAGTSSTVMVNPKLLFDKFANTDRIQVNTSSGLTITGNLWDHYTINIQEASTSQRGTTTLATAAEVRTGTDAKKIVTAATLHAKTATEGAIGLAQYATQAQVDAGTLSDRIVPPAYLKQTIQVTESWQATDSVRGTVRLSTGDGTWKGNDTNGSTLPDNGYASKGVAVSPYELNLTLKHYLPRLGKAYDTGMLGGQTPDKYARRDIAQTISGAWTFSQDTSFSNNISVQNIIYANGGEVKISPTADTGNVHVRFQNRDGSERGIIYAEPQTASAGNLKVRVKNGTGTTAASQTYTFGGNGTLEVPNEVSTKTLRSSGNAIVGGTVMVKDVQMLAVEGLNSIFGAQSQSAFIRSRDADTQIFAQDSTGSYPILTTKNYARLADGRYVNKAGDTMTGNLNLSGSAIVITGSESWYVPTNETVIRQGSWTAEIKDATKLKGLRGYMVPIRTPIDPGNPSTLVVTGYEEKTAAGGVLTQVGVTTNNTYQLWTPYPPTTETADKRFAHTVWMRIYNPNLNKFDDWMRVFTSATPPTAADIGAPSSVSTQVKTLEVLEWIKLGPVKIWPDRPNQTLKFEWVGD
Physico‐chemical
properties
protein length:1281 AA
molecular weight: 138388,13340 Da
isoelectric point:6,63592
aromaticity:0,07182
hydropathy:-0,33365

Domains

View on InterPro
CAD2272902.1
1 1281 aa
ATT 1127–1228 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAD2272902.1
1 1281 aa
Domain Start End Length (AA) Confidence
N-terminal 1 844 844 0,8767
Central domain 845 1043 200 0,2293
C-terminal 1044 1281 237 0,6569
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Host No host information

Coding sequence (CDS)

Genbank protein accession
CAD2272902.1 [NCBI]
Genbank nucleotide accession
LR877331 [NCBI]
CDS location
range 76657 -> 80502
strand -
CDS
ATGAGCGATTTACTGAAACAACATTTCCGTGCAACAAACGGTTTGGATGCCGGCGGAAATAAAGTTATAAATGTGGCACTTGCTGACCGCAACGTTAAAACCGACGGCGTCTCCGTCGAGTACGTTATTCAAGAAAATACTATCCAAAAATATGACCCGACGCGTGGGTATCTCACCGATTTTGCTGTGACTTATGGACGTCGTATCTGGATTGCAAATAAAGATATTCCAAAACCCGCTGGCGCTTTCAATCAAGCCAACTGGACTTCATTGCGTGTTGACCCGAACTGGATTTATACCGTCCGTAAAGGCGAGTTTGAAGTCCAATCAGGGCAATTCATCAATGTTGACTCAAACGCTGCTGGTAACGCTACATTACTGCTTCCGTTAGCACCTGATGAAGGCGATACTATCGTTGTAAGGGATATCGGTGGACGCCCTGGGTATAACGGAATCTTAATTAAAGCACAAGATACTGGTGCGTCTATCGTATTTGGTGAATCGCGCCTGCGTGAGGTAAGACTTACACGTCCGTATTCACAAATTATGCTTACGTTTAGTAATGGTGCATGGCGTGCAAGTTTAACCGATTTTGGCGATACTGCTAAAATGGTAGTTCCGAACGGGATTGTTCCGACGCAAGTTCAGGCAGGTGATAACGTAGTTCGTCGTTATACTTCCAACTCAGAGATTTTTATTACTCTGCCGTTGTTCGCTAATTCAAACGATATCATCAATTTTACTGACCTTGACGGTACATCGCCAATTAACCATATGACTGTGCGTACGTTTGACCCAACTATCTCAATTGGGACTCCTGGGCAAACAGAGGTTCAAGTACGTACTTCAGGTAATGGATTTTTGGTGTATGACTCGATTGACAAAATCTGGCGTATCTTTGAAAATGATTTACGCACCCGAGTAAGAATAATTACTTCTGATGTTACTTTAATGCCTAATGAGCATATTTCTGTATTTGGCGCAGATAACAATACCGTTAAAACAATTAACGTTACTTTGCCTACAGACGTAGCTGTTGGTGATACTGTCACAATCGCAATGAATTATATGCGTAAAGGACAGACTGTAGTAATTAAAGCTTCTGATGGTGATACCATCGCTAGCAATTTGAATTTACTGCAGTTTCCAAAACGCTCAGAGTATCCACCTGATGCAGCATGGGTGCAATCAAGCTCGATTACCTTTAATGGAACTACATCGTATGTTCCTGTTCTTGGGCTTGCATATATTGAAGATAAAGCATCCGGAAAAAGCTATTGGATTGTAACTGAATCTGACCCTACCGTAGAACGTGTTGATGCTAAAGACAACACTACCAGAGCACGATTAGGTGTTATTGCTCTTGCTACACAGGCTCAAGCTAACGCGGAGTCAAATCCAGAAAAAGAATTAGCAATTACGCCAGAAACCTTAAACGGACGTCGTTCTACTGAAACTCAGACTGGTATAGCAAGAATTGCAACTTCTAGCGAAGTTAATCAGGCAACAACTGCTTCTTACTTGGATAACGTAATCGTTACTCCTAAAAAGCTTAACGAAAGGTCTGCTACTGAAACCCGTAGAGGTTTAGCAGAGATTGCAACTAATGCTAAAATGGATGCAGGTGAAGACGATTTTACAATTGTTACTCCTAAGAAGTTGCTTTATCGCACTACATCAGATTCACGATTAGGTGTTATTCAATTAGTAAAAACTGGTGGTGCTCCTAACACAACTGCTGATCGTTCTTCTGCTGGCACCGGTATATTCGATCATTCTGATTACAAAAATGCAGTTACTCCAAAAACTCTTCGTGAGTATAAAGCTACTGTAAATCAGTCAGGAATAGTTTGGTTAGCAACTGATAGCGAAGTTAGAAACGGAACTCCGGCTTCTTCAAATATTCCTACAGTCGTTACACCAGAAGCTTTGCATAAAAAAGTTGCTACTGACGGAGCAATTGGATTAATCCAAATAGCTACACAAACTGAAGTTAATGCTGGCGGCGTGACTAATAAAGCAGTTACACCTAAAACATTAAATGACCGTACAGCAACTAACGATCGTACTGGTATTGCTCGCTTCGCGACACCTGGTGCCCAGGGTGAATTTGAAGCTGGTACTTCAAGTACAGTAATGGTAAACCCTAAATTACTGTTCGATAAATTTGCTAATACTGATCGTATCCAAGTTAATACTAGTTCTGGCTTAACTATTACTGGGAACCTCTGGGACCATTATACCATCAACATACAGGAAGCAAGTACTTCTCAAAGAGGTACAACTACTCTTGCAACTGCTGCTGAGGTTAGAACCGGCACCGACGCCAAGAAAATAGTTACTGCTGCCACGCTACATGCTAAAACAGCAACTGAAGGAGCTATCGGTCTTGCTCAGTATGCTACGCAGGCACAAGTTGATGCAGGCACATTAAGTGATAGAATTGTTCCTCCTGCTTACTTGAAACAGACTATTCAGGTAACAGAGTCATGGCAAGCTACAGACAGCGTTAGAGGGACCGTCAGGCTATCCACAGGCGATGGAACGTGGAAAGGTAATGATACCAATGGCTCAACTCTTCCGGATAACGGGTATGCCTCTAAGGGCGTCGCAGTGTCTCCGTATGAATTGAACCTTACACTGAAACATTACTTGCCTCGTCTCGGTAAAGCCTATGACACAGGAATGTTAGGTGGTCAAACCCCAGACAAATATGCTCGTCGCGATATAGCGCAGACTATTTCTGGAGCTTGGACATTTAGTCAGGACACTTCATTTAGCAATAATATTTCTGTCCAGAATATTATATATGCTAATGGTGGAGAAGTAAAAATTTCTCCAACTGCTGACACTGGAAATGTGCATGTTCGTTTTCAGAATAGAGATGGAAGCGAGCGTGGTATAATTTATGCTGAGCCTCAAACAGCTTCAGCCGGAAACTTAAAAGTTCGCGTAAAAAACGGAACAGGAACTACTGCTGCAAGCCAGACCTACACATTTGGCGGTAACGGTACGTTAGAAGTTCCTAACGAAGTGTCAACTAAAACTCTGAGGTCTTCTGGAAATGCAATAGTTGGCGGAACTGTTATGGTTAAGGACGTTCAGATGCTTGCTGTCGAGGGATTGAATTCAATATTCGGTGCCCAATCACAGTCCGCATTTATTCGTTCCCGTGACGCTGATACACAAATTTTTGCACAGGATTCAACTGGATCGTATCCAATTTTAACTACCAAAAACTATGCAAGATTAGCTGACGGCCGTTATGTTAATAAAGCTGGTGATACCATGACCGGAAATCTTAACTTAAGCGGTTCTGCTATCGTTATCACAGGTTCTGAATCGTGGTATGTACCAACAAATGAAACTGTAATAAGACAAGGTTCTTGGACTGCTGAAATTAAAGACGCTACTAAATTAAAAGGTCTTCGCGGTTATATGGTTCCAATCAGAACACCGATTGACCCTGGTAACCCAAGCACTTTAGTAGTGACTGGGTATGAAGAAAAAACTGCAGCTGGTGGTGTTTTAACTCAGGTTGGTGTAACTACAAACAATACTTATCAACTTTGGACTCCTTATCCTCCAACAACCGAAACTGCCGATAAGCGTTTCGCGCATACTGTGTGGATGAGGATTTATAATCCAAACCTTAATAAGTTTGATGATTGGATGCGGGTATTTACATCTGCTACTCCTCCAACTGCAGCTGATATCGGAGCTCCAAGCTCAGTATCAACTCAGGTTAAAACCCTTGAAGTTTTGGAATGGATTAAGCTTGGTCCAGTTAAAATCTGGCCAGACCGTCCAAACCAAACTCTCAAATTTGAATGGGTAGGTGATTAA

Genome Context

Tertiary structure

CAD2272902.1
ESMFold structure
Source ESMFold
pLDDT 56.1
Oligomeric state monomer