Genbank accession
WWD12790.1 [GenBank]
Protein name
long tail fiber protein distal subunit
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,88
TSP
Evidence RBPdetect2
Probability 0,80
Seq2Symm
C3 confidence 0,980
C3 0,980
C1 0,011
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MADLSRIQFKRTSTKGRRPDAGTMNPGELAINLADQYLLTKNDSGAIINLSCPPVYDSDVTMAGKVKGNNYILSKTANYFEDQTARDLNYFGAFRPNNADGWSNLILNIPHPSGKAHGRGFEFEYGSSSSQVKTYGFDKDGNKRFSFRMYHEGDKPTPSELNVYSKQEIDRMFVKNVKMSTPSGEATRGYFKIASAMIPQSGRMAFLRIYGGNGFNVNSYDQVDFLEIVIRSGNNNPKGVSIAAYRRNSLNVHEVFAINTSGDNYDIYVNYGRFTDNVIVEFGKTVDVALTVHDVPEFSATKPETGTKFDARVITMFNTENKAGTLMFDNNSQATYDIVSLSNAPDNSRNYLRKFRSKANETIWHETVQGDVYRLATGSTDQKEVLKIVGSDGLFVNRLHLQGNNAIRMWRPTGCSNYFEYMDQRDGANKRQGWFGFGSTETNDFQWYSDEGKNFVKLEASGQVSLSAGATKIVYTNGQYVAANSDAYRMIFGNYGAFWRNDGTKVYLMSTAENDRFGGWNAYRPFIYDLTSGNVQLGGDGNEDALTLESASRAARFSNDVYIKKGLLTFDAGRLGSRDFFKINHWGDSNNARDNILQFEDSQGAHFTTERAMGTGNITARFKGFVRVESGEIAFDANRGSQSQFTLHTWGNEQRKQVFECKDATSYHWYTERTQGGTGPILFCMAGSLNVGSNITTTGADITFKRAGNKHIWFRDPDGLELGLMYCDDAGVIRFRGQKQAQAWKFADKMIQLESGTVSGGGNGLIRGEVAGGSWASWRDRAAGLMVGCPQSTDSAHNIWKATHWGKYHIAAMGVHVPSGTIGNAIARLNVHDANFEFSASGDMSAGRNGSFNDVYIRSDTRLKINKEEYKENATDKVNRLTVYTYDKVKSLTDRTVIAHEVGIIAQDLEKELPEAVTTSKIGDPDKPEEILTISNSAVNALLIKAFQEMSEELKAVKAELAELKKN
Physico‐chemical
properties
protein length:967 AA
molecular weight: 107479,43900 Da
isoelectric point:7,02686
aromaticity:0,10962
hydropathy:-0,53433

Domains

View on InterPro
WWD12790.1
1 967 aa
ATT 462–526 · CHP 859–961 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WWD12790.1
1 967 aa
Domain Start End Length (AA) Confidence
N-terminal 1 264 264 0,1670
Central domain 265 463 200 0,4353
C-terminal 464 967 503 0,7147
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WWD12790.1 [NCBI]
Genbank nucleotide accession
OR896832 [NCBI]
CDS location
range 65048 -> 67951
strand +
CDS
ATGGCAGATTTAAGCAGAATCCAATTTAAACGTACTAGCACTAAAGGCCGTCGACCTGATGCTGGTACGATGAATCCGGGGGAATTGGCAATCAACCTTGCGGATCAATATCTTCTTACTAAAAATGATTCCGGTGCTATTATCAATTTAAGTTGTCCTCCGGTTTATGACAGCGATGTTACAATGGCGGGTAAGGTTAAAGGAAATAATTATATTTTAAGTAAAACCGCTAATTATTTTGAAGACCAAACCGCGCGAGATCTTAATTATTTTGGTGCGTTTCGACCGAATAATGCTGATGGTTGGTCTAACTTGATTCTGAACATTCCTCATCCCAGCGGTAAAGCACACGGTCGCGGGTTTGAATTTGAATATGGTTCTAGTTCCTCTCAGGTTAAAACCTATGGCTTTGATAAGGATGGTAACAAGAGATTCAGCTTTCGCATGTATCACGAAGGTGATAAACCTACTCCCTCAGAATTGAACGTCTATAGCAAACAAGAAATTGACCGTATGTTTGTTAAGAACGTTAAAATGTCCACTCCTTCCGGTGAAGCAACCCGTGGTTATTTTAAAATTGCATCCGCAATGATCCCGCAGAGTGGTCGGATGGCGTTTCTGCGAATCTATGGTGGGAACGGATTTAATGTTAACTCCTACGATCAGGTGGATTTCCTTGAAATTGTGATTCGTAGTGGTAATAATAACCCTAAAGGCGTTAGTATTGCTGCATATCGTCGAAATTCTTTGAACGTCCATGAAGTATTTGCAATTAATACTTCCGGTGATAACTATGACATTTATGTTAACTATGGTCGCTTCACCGATAACGTTATTGTAGAGTTTGGAAAAACTGTTGATGTTGCATTGACTGTTCACGATGTTCCTGAATTTTCGGCGACTAAACCAGAAACCGGAACTAAATTTGATGCTCGTGTTATTACCATGTTCAACACCGAAAACAAAGCAGGAACGTTGATGTTTGATAATAACTCACAAGCAACCTATGATATTGTGAGCCTTAGCAATGCACCTGATAATAGCCGAAATTATCTGCGTAAATTCCGTAGCAAAGCGAATGAAACAATATGGCATGAAACTGTTCAAGGTGATGTGTATCGTTTGGCTACTGGTTCCACCGACCAAAAAGAAGTATTAAAAATTGTTGGTAGTGATGGTTTATTTGTCAATAGACTTCATCTGCAAGGCAATAACGCGATTCGTATGTGGCGTCCTACTGGTTGTAGTAACTATTTTGAATATATGGATCAGCGAGACGGGGCTAATAAACGTCAAGGGTGGTTTGGTTTTGGTTCTACAGAAACCAACGATTTTCAATGGTATAGTGACGAAGGTAAAAACTTTGTTAAGCTAGAAGCAAGTGGTCAAGTATCTTTAAGCGCAGGTGCAACCAAAATTGTATACACTAATGGTCAATATGTAGCTGCCAATTCTGATGCATACCGTATGATCTTTGGTAATTATGGTGCATTCTGGCGTAATGACGGCACTAAAGTTTATCTTATGTCTACTGCCGAAAATGATAGATTTGGTGGCTGGAATGCCTATCGTCCATTCATTTATGATTTAACTTCCGGTAACGTTCAATTAGGCGGTGATGGTAACGAAGATGCATTAACGTTAGAAAGTGCTTCTCGTGCCGCTCGCTTTAGTAATGACGTTTACATTAAGAAAGGGCTTTTGACTTTCGACGCTGGACGATTAGGATCTCGTGATTTCTTTAAAATCAACCATTGGGGTGATAGCAATAACGCCCGTGATAACATTTTGCAGTTTGAAGACAGTCAGGGCGCACATTTTACCACTGAACGTGCTATGGGTACTGGTAACATAACAGCACGTTTTAAAGGCTTTGTTCGTGTAGAATCTGGCGAAATTGCATTTGATGCTAATCGGGGGTCGCAGTCTCAATTTACCTTACACACATGGGGTAACGAGCAACGCAAACAGGTTTTTGAATGTAAGGATGCTACAAGTTATCACTGGTATACTGAACGTACTCAGGGTGGCACTGGACCTATTCTGTTCTGTATGGCTGGTAGTCTAAACGTTGGTAGCAATATCACAACAACTGGTGCTGATATTACGTTTAAACGCGCTGGCAATAAGCACATCTGGTTTAGAGATCCAGACGGTTTAGAGTTGGGCTTGATGTATTGCGATGACGCTGGTGTTATTCGCTTCCGTGGTCAGAAACAAGCCCAGGCGTGGAAATTTGCAGATAAAATGATCCAGTTGGAATCTGGTACTGTATCTGGTGGCGGTAATGGCCTGATTCGTGGTGAAGTTGCTGGCGGTAGTTGGGCTAGCTGGCGTGACCGTGCTGCTGGCCTTATGGTTGGGTGTCCTCAATCAACCGATTCCGCTCATAACATCTGGAAAGCTACTCATTGGGGTAAATATCACATCGCAGCAATGGGTGTACACGTTCCTAGCGGTACTATCGGTAATGCTATAGCTCGCCTAAACGTTCATGACGCCAACTTTGAATTTAGCGCCTCCGGTGACATGTCGGCAGGGCGTAACGGTTCGTTTAACGATGTTTATATTCGTTCTGATACTCGCCTTAAAATCAATAAGGAAGAGTATAAGGAGAATGCCACCGATAAAGTTAATCGCTTGACGGTATACACCTATGACAAGGTTAAATCTTTAACCGACCGTACTGTCATTGCTCATGAAGTTGGTATTATTGCTCAGGATCTTGAAAAAGAATTGCCGGAAGCCGTAACAACTTCTAAGATCGGCGATCCTGATAAGCCAGAAGAGATCTTAACAATTTCTAACTCTGCTGTCAACGCTCTTTTAATTAAGGCGTTTCAGGAAATGAGCGAAGAACTTAAAGCCGTTAAAGCTGAACTAGCGGAACTTAAAAAGAATTAA

Genome Context

Tertiary structure

WWD12790.1
ESMFold2 structure
Source ESMFold2
pLDDT 64.7
Oligomeric state monomer