Genbank accession
AGK86604.1 [GenBank]
Protein name
tail tubular protein B
RBP type
TSP
Evidence DepoScope
Probability 1,00
Seq2Symm
C6 confidence 0,975
C6 0,975
C3 0,010
C1 0,007
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MASVTQLVPNLLGGVSKQPDDKKIPGQVREAINAYADPTYGLSKRPGTKWLGNLSSTTNEFQNGKWFYINRDEAEKYIGVIYGANIKIWNINNPTATVTVTNSGSSYLTYGSSNAKDSLQVLTVQDTTIVVNNKVTVTTLAAPSYTLKSRATLRLLSAEYGAEYKVTINGTTSTFTTKNSEDPALSNTTTTKVLSADQVLDTIYNNVNAIKPAGSTVTKLKGTIEISGATSAFTIEASGGISGEELLVFQDEVQNFSNLPAESLQGRIVKINNTVAKEDSYYAVFNAENGTSGKGNWQETVAPNVSKGLTASTMPHELVNTALNTFELRPITWEERLVGDDETNEHPSFVGKTIQQVFFHNNRLGFLTGDNVSMSQSGEFYNFYHVSALTQADNDPIDISCSSLRPAVLHSVLPAAQGLVLFSKSQQFLMYSDDGILTPKTSVIRTIANYENEELIPPVDVGTNMVFLSKSPGYTRIYAMATRGQQENPDVLDVGRIVSEWVPDSVEDLVASPQNSFFAMYGPTSEYLYFFRTYVVGEETAMQTWFNWKMHGNVQFFGVDSDDTYVVTYQSGQYVLSKANLTQTPDEAILRADSGQVVQLCLDQYATPSSVSYDSATKTNRCYLRYKDITGLEPAVIIADPNNTGESGFTVTPARGNDGNPYFEFVGDDYSGLASTVYVGFKYDFDVQLPTIFYQIGENRSDYTANLTISRVKFSVGLSSNVGFKLKAKGQSEWYDVQSIQDADYYLANDVPLNEQTVYTLPIHQRNSNFDLKVFSDSPFPISLTSMMWEGSYSPRFYRRA
Physico‐chemical
properties
protein length:801 AA
molecular weight: 88394,32450 Da
isoelectric point:4,82253
aromaticity:0,10986
hydropathy:-0,30824

Domains

View on InterPro
AGK86604.1
1 801 aa
TTP 1–799 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

AGK86604.1
1 801 aa
Domain Start End Length (AA) Confidence
N-terminal 1 134 134 0,9021
Central domain 135 333 200 0,2605
C-terminal 334 801 467 0,3551
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AGK86604.1 [NCBI]
Genbank nucleotide accession
KC310803 [NCBI]
CDS location
range 31984 -> 34389
strand +
CDS
ATGGCAAGTGTAACTCAACTAGTACCTAATCTGCTTGGTGGTGTATCTAAGCAACCTGATGACAAGAAGATTCCAGGTCAAGTCAGAGAAGCGATCAATGCTTACGCTGATCCGACCTATGGTTTATCGAAGCGTCCTGGCACCAAATGGCTAGGCAATCTTTCCTCCACCACTAATGAATTCCAGAATGGTAAGTGGTTCTATATCAACCGTGATGAAGCTGAGAAGTACATCGGTGTGATCTATGGAGCCAACATCAAGATCTGGAATATCAATAACCCAACAGCAACAGTAACGGTAACTAACTCTGGTAGTAGCTACCTGACCTATGGGTCATCCAACGCAAAGGATAGCCTGCAGGTACTGACAGTTCAAGACACAACCATTGTCGTCAATAACAAAGTCACTGTAACGACTCTTGCTGCACCATCTTATACACTGAAGTCAAGAGCAACACTACGACTGCTTAGTGCTGAATATGGCGCTGAGTATAAGGTGACAATCAATGGTACAACAAGTACATTCACAACAAAGAACAGTGAAGACCCTGCTCTAAGTAACACTACAACCACAAAGGTGCTAAGTGCAGATCAGGTGCTAGATACAATCTACAACAATGTGAATGCAATAAAGCCAGCTGGTTCGACAGTAACAAAGCTGAAGGGAACCATCGAGATTAGTGGTGCTACAAGTGCATTCACTATCGAAGCATCTGGTGGCATCAGTGGTGAAGAACTTCTGGTCTTCCAAGATGAAGTGCAGAACTTCTCTAATCTTCCAGCTGAATCCTTGCAAGGCAGAATTGTAAAGATCAACAATACTGTTGCAAAGGAAGACTCATATTATGCAGTCTTTAATGCAGAGAACGGTACGTCTGGTAAAGGAAACTGGCAGGAGACCGTGGCACCAAATGTGTCTAAAGGTCTTACTGCCTCAACCATGCCGCATGAGCTGGTAAATACTGCACTCAATACATTTGAGTTGAGACCTATTACCTGGGAAGAGCGTCTTGTTGGTGATGATGAGACCAACGAACACCCTAGCTTTGTTGGAAAAACAATCCAACAGGTCTTCTTCCACAACAACCGTCTTGGCTTCTTAACAGGCGATAACGTCTCAATGAGTCAAAGTGGTGAGTTCTATAACTTCTACCACGTATCTGCTCTTACCCAAGCTGACAACGATCCTATTGACATCAGTTGCTCTAGCTTGAGACCTGCTGTTCTTCACTCAGTACTACCTGCTGCTCAGGGTCTAGTGCTGTTCAGTAAGAGTCAACAGTTCTTGATGTATTCCGATGATGGCATCCTGACTCCTAAGACATCCGTGATTAGGACTATTGCCAACTATGAAAATGAAGAACTGATACCACCTGTTGATGTCGGTACAAATATGGTGTTCCTGAGCAAATCTCCGGGATACACACGTATTTACGCAATGGCCACTCGTGGTCAACAGGAGAACCCTGATGTATTGGACGTTGGACGGATTGTATCTGAATGGGTCCCTGACTCTGTAGAGGATCTTGTGGCATCTCCACAGAACTCATTCTTTGCGATGTATGGACCTACATCAGAATATCTCTACTTCTTCAGAACTTATGTGGTTGGTGAAGAGACAGCAATGCAGACATGGTTCAACTGGAAGATGCATGGCAACGTGCAGTTCTTTGGTGTAGACAGTGATGACACCTATGTTGTCACCTACCAGTCTGGACAGTATGTACTAAGCAAAGCAAACCTCACTCAGACCCCTGATGAAGCCATTCTGAGAGCCGATAGTGGCCAGGTGGTGCAACTATGCCTAGACCAGTATGCAACGCCTTCTAGCGTCTCCTACGACAGTGCTACGAAGACCAATCGTTGCTACCTCAGGTATAAGGACATCACTGGGTTAGAACCTGCTGTAATCATCGCTGATCCCAACAACACTGGTGAGTCTGGTTTTACAGTGACACCAGCACGTGGTAATGACGGTAACCCATACTTTGAGTTTGTTGGTGATGATTATTCAGGACTAGCTTCTACTGTGTATGTCGGGTTTAAGTATGACTTCGACGTGCAACTACCAACTATCTTCTACCAGATCGGAGAGAACAGGTCTGACTATACAGCCAACCTTACTATCTCACGAGTTAAGTTCTCAGTTGGTCTTTCGAGCAACGTTGGCTTCAAGCTTAAAGCTAAAGGTCAATCTGAATGGTACGACGTTCAATCCATCCAAGATGCTGACTACTACTTAGCAAATGACGTTCCTTTGAATGAACAGACTGTGTACACATTACCTATTCATCAACGTAATTCAAACTTTGACCTAAAGGTCTTTAGTGATTCACCATTCCCGATCTCTCTTACTTCGATGATGTGGGAAGGATCTTATTCACCACGATTCTATAGGAGGGCGTAA

Genome Context

Tertiary structure

AGK86604.1
ESMFold structure
Source ESMFold
pLDDT 88.9
Oligomeric state monomer