UniProt accession
A0A1Q1PW90 [UniProt]
Protein name
Tail fiber protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,79
TF
Evidence RBPdetect2
Probability 0,96
Seq2Symm
C3 confidence 0,690 truncated
C3 0,690
C1 0,004
C6 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MIKTNMRLRDMAEEIKIYGAKGGSQKQHQPVEQEDNLISLNKVKVLLAVADGEVDSNFSMKDLYLADVPVQNQDGSYNYEGVRAEFRAGTQYQEYIAGLDGANSEIQASREITNDTPYIIAVNNTQLSAIRIKLFWPRLVKQESNGDLNGITCEYAIDLSVNGGAYQEYTRGVANGKTTTGYDRSIRVNLPAEFDSALVRIRKITADSTSSTLVNGMQITTYQEVIDAKFRYPLTALVYVEFGSDLFPNGIPTISIKKRWKLIQVPTNYDPETRTYSGTWNGLFKMAWSNNPAWVLYDLVTNRRYGLDQRELGVEIDKWGLYEAAQFCDQMVPDGKGGMEPRYLCDMVVQNKVEAYTLIRDICSIFRGLTFYDGEKIGIVVDKPRNPSYIFTNDNVVNGLFSRTFASDKSLYTTANVQFDDVENNYQQDVEPVFELEATRRFGFNPVDLTAIGCTRRSEANRRGRWLLKTNLRSETISFTTGLEGMIPMIGEVIAVNDAAWSSNYQLNLSGRIESVQGLQVFTPFKVDAAPGDRILLNKPDGSPEARTIASVSEDGRTINLNTAFSFVAQPDTVFAIDKDNLALQQYVVTGIQKADSDGSDSFQYTITAVEYDPNKYDEIDYGVNIVDRPTSIVEPDRLSPPENLTVSSYSKVVQGLSVETMVIGWDKAPYAKTYNVQWRKENGNWINVPRTASTEVDIEGIYAGIYDVRVRSVSDTENVSAWSDIVTVSLTGKIGRPSAPTVITASNDEVFGIRVKWGFPDGSGDTAYTELQQVADNGDGTYNPDNASLLTLLPYPAYEYWHTPIQPGKVIWYRARLIDRIGNTSDWSNFSRGMSTDDANIINDYIKVDIEGSEGFKYLEQNAIQKNQDIQNQAESILENALANDTDVRRMTKENGKRKAEYVQAVNLIADETQARVEALTQLKAQIDDEVVASITEVQTALATETEARTTSDTQLSARIGDNEAALNQKLDAFANATSTGVQYGISLGLKYNGQTYSSGMSMELVGTGGNVRSQFIFDANRFAISNGIGSGSGQWQLPFVVENGNVIIQSAVIGDGSISNAKIGNFIQSNNYVAGTTGWRIDKSGSAELSNATVRGNLYANNGNFAFNGTNNTVQINNNGITVNLPNGGRVVVGVW
Physico‐chemical
properties
protein length:1138 AA
molecular weight: 125823,62680 Da
isoelectric point:4,74619
aromaticity:0,09315
hydropathy:-0,37267

Domains

View on InterPro
A0A1Q1PW90
1 1138 aa
ATT 103–228 · ATT 353–499 · STR 638–735 · RBD 968–1106 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

A0A1Q1PW90
1 1138 aa
Domain Start End Length (AA) Confidence
N-terminal 1 519 519 0,9373
Central domain 520 1070 552 0,0437
C-terminal 1071 1138 67 0,6366
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AQN32352.1 [NCBI]
Genbank nucleotide accession
KY398841 [NCBI]
CDS location
range 20873 -> 24289
strand +
CDS
ATGATCAAAACAAACATGAGGCTTCGTGATATGGCTGAAGAGATTAAGATTTATGGTGCTAAGGGTGGTAGCCAGAAGCAGCACCAACCAGTGGAGCAGGAAGACAACCTCATTTCACTAAACAAGGTTAAGGTTTTGCTTGCTGTCGCTGACGGAGAGGTGGATTCAAACTTCTCAATGAAGGATTTATACCTTGCTGACGTTCCCGTGCAAAACCAGGATGGTAGCTACAACTACGAAGGTGTTCGCGCTGAGTTCCGTGCTGGCACGCAGTATCAGGAATATATCGCTGGTCTTGATGGTGCCAACTCAGAGATTCAGGCTTCCAGAGAAATCACGAACGATACCCCGTACATCATTGCGGTTAACAATACTCAGCTATCAGCGATTCGAATTAAGCTATTTTGGCCTCGACTAGTTAAACAAGAGAGTAACGGTGACCTGAATGGTATAACTTGCGAGTATGCAATTGACCTTTCCGTTAATGGTGGTGCTTACCAGGAATACACTCGCGGAGTTGCTAACGGGAAGACCACTACAGGTTACGACCGCAGCATTCGCGTGAACCTTCCTGCAGAGTTTGATAGCGCATTGGTTCGCATCCGTAAGATTACAGCAGATTCAACAAGTAGCACGCTGGTTAACGGAATGCAGATTACAACCTATCAGGAAGTAATCGACGCTAAATTCCGCTATCCGCTTACGGCACTTGTTTATGTTGAGTTCGGCTCTGACTTGTTCCCTAACGGCATCCCGACAATCTCAATCAAGAAGCGATGGAAGTTAATTCAGGTCCCAACGAACTATGATCCTGAGACTAGAACCTACAGCGGCACGTGGAATGGCCTGTTCAAAATGGCGTGGTCAAACAACCCTGCCTGGGTTCTTTATGACTTAGTGACAAACCGCCGATATGGTCTTGATCAGCGAGAGCTTGGTGTAGAGATTGATAAATGGGGACTGTATGAAGCTGCGCAATTCTGCGACCAGATGGTGCCGGATGGTAAGGGTGGAATGGAACCGCGATATCTATGCGACATGGTTGTACAGAACAAGGTTGAGGCCTACACACTAATTCGTGACATTTGCTCAATCTTTCGTGGACTGACTTTCTATGATGGAGAAAAGATTGGTATCGTGGTTGATAAACCTCGCAATCCATCTTACATCTTCACTAATGATAACGTTGTAAACGGATTATTCAGCCGCACTTTTGCCAGCGATAAAAGCCTTTACACTACGGCAAACGTTCAGTTTGATGATGTGGAGAACAACTATCAGCAGGATGTTGAGCCAGTATTTGAGCTCGAGGCTACTCGCCGATTTGGTTTTAACCCGGTCGACCTAACGGCAATTGGATGTACGCGAAGAAGTGAAGCAAACAGACGCGGAAGATGGCTACTGAAAACCAACCTGAGAAGCGAAACTATCAGCTTCACTACCGGGTTGGAAGGCATGATTCCGATGATTGGTGAGGTTATTGCGGTTAATGACGCTGCATGGTCGAGCAACTACCAGTTAAACCTTTCCGGTCGTATTGAATCAGTTCAGGGATTGCAGGTTTTCACCCCGTTCAAAGTTGACGCGGCACCGGGTGACAGAATTCTTCTGAACAAGCCTGACGGAAGCCCGGAAGCAAGAACTATCGCCAGCGTTTCGGAAGATGGTAGAACTATCAACCTGAATACTGCTTTTAGTTTTGTAGCTCAGCCTGACACTGTATTCGCAATCGATAAGGATAATCTGGCGCTTCAGCAGTATGTTGTGACCGGGATTCAAAAAGCAGATTCTGATGGTTCGGATTCATTCCAGTATACGATTACCGCGGTGGAGTATGACCCGAACAAGTATGACGAGATTGACTACGGCGTTAACATTGTTGACCGTCCAACTTCAATTGTGGAACCTGACAGATTATCGCCACCAGAAAACCTGACCGTGTCAAGTTATAGTAAGGTTGTTCAGGGCTTGTCGGTTGAGACGATGGTTATCGGATGGGATAAGGCTCCATACGCTAAAACCTACAATGTTCAATGGAGGAAAGAAAATGGTAACTGGATTAACGTACCCAGAACAGCAAGTACAGAGGTTGATATCGAAGGTATTTACGCAGGAATCTATGACGTTAGGGTTCGCAGCGTATCAGATACTGAAAACGTGTCTGCCTGGTCTGACATTGTAACTGTATCACTAACTGGCAAGATTGGTCGTCCCTCTGCACCTACGGTTATCACGGCATCAAATGATGAAGTATTTGGTATCCGTGTTAAGTGGGGTTTCCCTGATGGCTCTGGCGATACTGCTTATACTGAACTTCAGCAGGTTGCTGATAATGGTGATGGTACATACAATCCTGATAACGCAAGTTTGCTTACGTTACTTCCGTACCCAGCCTATGAATACTGGCATACGCCAATTCAGCCAGGCAAGGTTATCTGGTATCGCGCAAGATTGATTGACAGAATCGGAAATACGTCTGATTGGTCTAATTTCTCAAGAGGCATGAGTACTGACGACGCCAACATTATCAATGATTACATCAAGGTTGATATTGAGGGTTCTGAAGGATTCAAATACCTCGAGCAGAATGCGATTCAAAAGAATCAGGACATTCAGAATCAGGCAGAGTCAATTCTTGAGAACGCATTAGCTAATGACACTGATGTTCGTCGCATGACTAAGGAGAATGGCAAACGTAAGGCTGAATATGTTCAGGCGGTGAATCTCATAGCTGATGAAACTCAGGCGCGTGTAGAAGCTCTAACGCAGCTTAAGGCGCAAATTGATGATGAGGTCGTTGCATCAATTACTGAAGTTCAGACAGCGTTAGCAACCGAGACGGAGGCAAGAACTACATCCGACACTCAGCTATCAGCAAGAATTGGTGATAACGAGGCAGCGTTAAACCAGAAGCTGGACGCTTTTGCTAACGCCACATCGACTGGCGTACAGTACGGGATTAGCCTTGGCCTGAAATACAATGGGCAGACTTATTCATCCGGGATGAGCATGGAGCTTGTTGGCACCGGTGGGAATGTTCGCAGCCAGTTCATTTTTGATGCAAACAGATTCGCGATCAGTAACGGCATTGGCTCTGGTTCCGGTCAGTGGCAGCTCCCCTTCGTTGTCGAGAACGGAAACGTAATCATCCAGAGCGCAGTAATCGGTGATGGTTCAATCAGTAACGCGAAGATTGGTAACTTTATTCAGTCAAATAACTATGTGGCAGGAACTACAGGCTGGAGGATTGATAAATCAGGAAGTGCAGAGCTAAGCAACGCCACTGTAAGAGGTAATCTTTACGCTAACAATGGTAACTTCGCATTCAACGGAACCAATAACACTGTTCAGATTAACAACAATGGAATTACGGTAAACTTACCGAACGGAGGTAGAGTTGTAGTTGGAGTGTGGTAA

Genome Context

Tertiary structure

A0A1Q1PW90
ESMFold structure
Source ESMFold
pLDDT 76.8
Oligomeric state monomer