UniProt accession
A0A2Z4QB51 [UniProt]
Protein name
Long tail fiber, proximal subunit
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,52
TF
Evidence RBPdetect2
Probability 0,62
Seq2Symm
C3 confidence 0,967 truncated
C3 0,967
C1 0,321
D3 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSDLLKQHFRATNGLDAGGNKVINVALADRNVKTDGVSVEYVIQENTIQKYDPTRGYLTDFAVTYGRRIWIANKDIPKPAGDFNQANWTSLRVDPNWIYTVRKGEFEIQSGQFINVDSNAAGNATLLLPLAPDEGDTIVVRDIGGRPGYNGILIKAQDTGASIVFGESRLREVRLTRPYSQIMLTFSNGAWRASLTDFGDTAKMVVPNGIVPTQVQSGDNVVRRYTSNSEIFITLPLFANSNDIINFTDLDGTSPINHMTVRTFDPTISIGTPGQTEVQVRTSGTGFLVYDSIDKIWRIFENDLRTRVRIITSDVTLMPNEHISVFGADNNTVKTINVTLPTDVAVGDTVTIAMNYMRKGQTVVIKASDGDTIASNLNLLQFPKRSEYPPDAAWVQSSSITFNGTTSYVPVLGLAYIEDKASGKSYWIVTESDPTVERVDAKDNTTRARLGVIALATQAQANAESNPEKELAITPETLNGRRSTETQTGIARIATSSEVNQSTTASYLDNVIVTPKKLNERAATETRRGLAEIASNAKMDAGTDDFTIVTPKKLLYRTTSDSRLGVIQLVKTGGAPNTTADRSSAGTGIFDHSDYKNAVTPKTLREYKATVNQSGIVWLATDSEVRNGTPSASNIPTVVTPEALHKKVATDGAIGLIQIATQTEVNAGGVTNKAVTPKTLNDRTATNDRTGIARFATPGAQGEFEAGTSSIVMVNPKLLFDKFANTDRIQVNTSSGLTITGNLWDHYTINIQEASTSQRGTTTLATAAEVRTGTDAKKIVTAATLHAKTATEGAIGLAQYATQAQVDAGTLSDRIVPPAYLKQTIQVTESWQATDSVRGTVRLSTGDGTWKGNDTNGSTLPDNGYASKGVAVSPYELNLTLKHYLPRLGKAYDTGMLGGQTPDKYARRDIAQTISGAWSFSQDTSFSNNISVQNIIYANGGEVKISPTADTGNVHVRFQNRDGTERGIIYAEPQTASAGTLKIRVKNGTGTTATSQTYVFGGNGTLDVPNEVSTKTLRSSGNAIVGGTVMVKDTVLLTIETQNAIMGARSHSAFIDTRDADTQIFARDNTNSYPILTTKNYARLADGRYVKKAGDTMTGNLNLSGSAIVITGSESWYVPTNETVIRQGSWTAEIKDATKLQGLRGYMVPIRTPIDPANPSTLVVTGYEEKTAAGGVLTQVGVTTNNTYQLWTPYPPTTETADKRFAHTVWMRIYNPNLNKFDDWMRVFTSATPPTAADIGAPSSVSTQVKTLEVLEWIKLGPVKIWPDRPNQTLKFEWVGD
Physico‐chemical
properties
protein length:1281 AA
molecular weight: 138610,45870 Da
isoelectric point:6,66826
aromaticity:0,07104
hydropathy:-0,33286

Domains

View on InterPro
A0A2Z4QB51
1 1281 aa
ATT 1127–1228 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

A0A2Z4QB51
1 1281 aa
Domain Start End Length (AA) Confidence
N-terminal 1 842 842 0,8611
Central domain 843 1041 200 0,2511
C-terminal 1042 1281 239 0,6534
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AWY07146.1 [NCBI]
Genbank nucleotide accession
MH333064 [NCBI]
CDS location
range 147752 -> 151597
strand +
CDS
ATGAGCGATTTACTGAAACAACATTTCCGTGCAACAAACGGCTTGGATGCAGGCGGAAATAAAGTTATAAATGTGGCACTAGCTGACCGCAACGTTAAAACCGACGGCGTCTCCGTCGAGTACGTTATTCAAGAAAACACTATCCAAAAATATGACCCGACACGTGGGTATCTCACTGATTTTGCTGTGACTTATGGACGTCGTATCTGGATTGCAAATAAAGATATTCCAAAACCTGCTGGAGATTTTAACCAGGCGAATTGGACTTCTTTACGTGTTGACCCGAACTGGATTTATACCGTCCGTAAAGGAGAGTTTGAAATTCAATCTGGCCAGTTCATCAACGTTGACTCTAACGCTGCAGGTAATGCTACATTACTGCTTCCGTTAGCACCAGATGAAGGCGATACCATCGTAGTTCGTGATATTGGCGGCCGTCCTGGCTATAACGGAATCTTAATTAAAGCACAAGATACTGGTGCGTCTATCGTATTTGGTGAATCGCGTCTGCGTGAGGTAAGACTTACACGTCCGTATTCACAAATTATGCTTACGTTTAGTAATGGTGCATGGCGTGCAAGTTTAACCGATTTCGGCGATACTGCTAAAATGGTAGTTCCGAACGGGATTGTTCCAACCCAGGTACAGTCAGGTGATAACGTAGTTCGTCGTTATACTTCCAACTCAGAGATTTTTATTACTCTTCCGTTGTTCGCTAATTCAAACGATATCATCAATTTTACTGACCTTGATGGTACATCGCCGATTAACCATATGACTGTGCGTACGTTTGACCCAACTATCTCAATTGGGACTCCTGGACAAACAGAGGTTCAAGTACGTACTTCAGGCACCGGATTTTTGGTATATGACTCGATTGACAAAATCTGGCGTATCTTTGAAAATGATTTACGCACCAGAGTAAGAATAATTACTTCTGATGTTACTTTAATGCCTAATGAGCATATTTCTGTATTTGGCGCAGATAACAATACCGTTAAAACAATTAACGTTACTTTGCCTACAGACGTAGCTGTTGGGGATACTGTCACAATCGCAATGAATTATATGCGCAAAGGACAGACTGTAGTAATTAAAGCTTCTGATGGTGATACCATCGCAAGTAATTTGAATTTACTACAATTTCCAAAACGTTCAGAGTATCCACCTGATGCAGCATGGGTGCAATCAAGCTCAATTACCTTTAACGGAACTACATCGTATGTTCCTGTTCTTGGGCTTGCATATATTGAAGATAAAGCATCCGGAAAAAGCTATTGGATTGTAACTGAATCTGACCCTACCGTAGAACGAGTTGATGCTAAAGACAATACTACCAGAGCACGATTAGGTGTTATTGCTCTTGCTACACAGGCTCAAGCTAATGCGGAGTCAAACCCAGAAAAAGAATTAGCAATTACGCCAGAAACCTTAAATGGACGTCGTTCTACTGAAACCCAAACTGGTATAGCAAGAATTGCAACTTCCAGCGAAGTTAATCAGTCAACAACTGCTTCTTACTTGGATAATGTAATCGTTACTCCTAAAAAGCTTAACGAAAGAGCTGCTACTGAAACCCGTAGAGGTTTAGCTGAAATTGCGTCTAATGCTAAAATGGATGCAGGAACAGACGATTTTACAATTGTTACTCCTAAGAAGTTGCTTTATCGTACTACATCGGATTCACGGTTAGGTGTTATTCAGTTAGTAAAAACTGGCGGTGCTCCTAACACAACTGCTGATCGTTCTTCTGCTGGCACCGGTATATTCGATCATTCTGATTACAAAAATGCAGTTACTCCAAAAACTCTTCGTGAGTATAAAGCTACTGTAAATCAGTCAGGAATAGTTTGGTTAGCAACTGATAGCGAAGTTAGAAACGGAACTCCTTCTGCTTCAAATATTCCTACTGTTGTTACTCCGGAAGCTTTGCATAAAAAAGTTGCTACTGACGGAGCAATTGGATTAATCCAAATAGCTACACAGACGGAAGTTAATGCTGGCGGCGTGACTAATAAAGCAGTTACACCTAAAACATTAAATGACCGTACAGCAACTAACGATCGTACTGGTATTGCTCGCTTCGCGACACCTGGTGCCCAGGGTGAATTTGAAGCTGGTACTTCAAGTATAGTAATGGTAAACCCTAAATTATTATTTGATAAATTTGCTAATACCGATCGTATCCAAGTTAATACTAGTTCTGGCTTAACTATTACTGGGAACCTCTGGGACCATTATACCATCAACATACAGGAAGCAAGTACTTCTCAAAGAGGTACAACCACTCTTGCTACTGCTGCTGAGGTTAGAACCGGCACCGACGCCAAGAAAATAGTTACTGCTGCCACGCTACATGCTAAAACAGCAACTGAAGGAGCTATCGGTCTTGCTCAGTATGCTACACAGGCACAAGTTGATGCAGGCACATTAAGTGATAGAATTGTTCCTCCTGCTTACTTGAAACAGACTATTCAGGTAACAGAGTCATGGCAAGCTACAGACAGCGTTAGAGGGACCGTGAGGCTATCTACAGGCGATGGAACGTGGAAAGGTAATGATACCAATGGCTCAACTCTTCCGGATAACGGGTATGCCTCTAAGGGCGTCGCAGTGTCTCCGTATGAATTGAACCTTACACTGAAACATTACTTGCCTCGTCTCGGTAAAGCCTATGACACAGGAATGCTAGGTGGTCAAACACCAGACAAATATGCTCGTCGCGATATAGCGCAGACTATTTCTGGAGCTTGGTCATTTAGTCAGGACACTTCATTTAGCAATAATATTTCTGTCCAGAATATTATATATGCTAATGGTGGTGAAGTGAAGATTTCTCCAACAGCTGATACTGGAAATGTGCATGTTCGTTTTCAAAATAGAGATGGAACTGAACGTGGTATAATTTATGCTGAGCCGCAAACTGCTTCAGCTGGAACTTTAAAAATTCGTGTCAAAAACGGAACTGGAACTACTGCTACAAGTCAAACTTATGTATTTGGCGGAAATGGTACACTAGACGTTCCTAACGAAGTGTCAACTAAAACTCTGAGGTCTTCTGGAAATGCAATAGTTGGCGGAACTGTTATGGTAAAAGATACGGTTCTATTAACTATTGAAACTCAAAATGCTATTATGGGTGCTAGGTCACACTCTGCATTTATTGATACTCGTGACGCTGATACGCAAATTTTTGCTCGAGATAACACTAACTCGTATCCGATTTTAACTACCAAAAACTACGCAAGATTAGCTGATGGTCGTTATGTTAAGAAAGCTGGTGATACCATGACTGGCAATCTTAACTTAAGCGGTTCTGCTATCGTCATTACGGGTTCTGAATCATGGTATGTGCCAACTAATGAAACTGTAATAAGACAAGGTTCTTGGACTGCTGAAATCAAAGACGCTACTAAATTACAAGGTCTTCGTGGTTATATGGTTCCGATCAGAACACCAATTGACCCTGCTAATCCAAGCACATTAGTAGTGACTGGGTATGAAGAAAAAACTGCAGCCGGTGGTGTTTTAACTCAGGTTGGTGTAACTACAAACAATACTTATCAGCTTTGGACACCTTATCCTCCGACAACCGAAACTGCTGATAAGCGTTTCGCGCATACTGTGTGGATGAGGATTTATAATCCAAACCTTAATAAGTTTGATGATTGGATGCGAGTATTTACATCTGCTACTCCTCCAACTGCAGCTGATATCGGAGCTCCAAGTTCAGTATCAACTCAGGTTAAAACCCTTGAAGTTTTGGAATGGATTAAGCTTGGTCCAGTTAAAATCTGGCCAGACCGTCCAAATCAAACTCTCAAATTTGAATGGGTAGGTGATTAA

Genome Context

Tertiary structure

A0A2Z4QB51
ESMFold structure
Source ESMFold
pLDDT 55.6
Oligomeric state monomer