Genbank accession
QKW95290.1 [GenBank]
Protein name
putative tail fiber protein
RBP type
TF
Evidence RBPdetect
Probability 0,84
TF
Evidence RBPdetect2
Probability 0,67
Seq2Symm
C3 confidence 0,987
C3 0,987
C1 0,245
D3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MITPELIPSPFAAQGDKDPIPQTSSTGFANLRDGYTPDYEISLASNNPQAKAVERKIQNQLFFIATQNAQAWQRQMAPPWFQGMPGGYEQNAEVVRVGNDGIMRRYRSMVNANASDPLSSTTWEEQPAWSAMRSNIPMPAGGPGLSSGGEVITTGRNFNDLLNGTWEFFSDSVVIASQNAPVYPASAGAAAGMLEAKSWVSGANTFCVQRYTDRVGNVAVRGLNAGAWTNWMYAVNVMALQQGRVTYGVAAGSANAYTLTLVPQLQGGLVDGMILRVKFNTMNTGASTINVSGLGAKAIVGAANFPLTGGELGQGLIAELVFDAAGDRWRILAGAPRIQVGNADQDYQAPSWKQVKDYVASQKLTEVDWADVVNKPNVAIQDTTPWFANLELSDARPFIDFHFNNNRAKDFDYRFISEADGSMAFYSRQGSAGPTQDILFSRSNVTFLQPRLDVAKNLAYIANSGPLWQNTTADQPGWKFTFAQGVDANNNAVIAVNTTNPDGSYRSQIMRWDWASTNVIFNNRPLFAGQYTPWDSGNFDPSTKLTVNATNQIAGPTGIRNTNGNTGNMNTWGSSSTTASYGNAALQIFGKGGGEPAALYFDNSQTGWYLGMDKDGQLKRAGWSLGNNAYVITDESNIRFHVNSMAGTPVWGGNEFWGPWNFNPNTKLTIKAGTQETSSTAIFSGTMPFAPIASLSDYSQAPLTVYNAPTGPSAKPAVIAFIRPGNWGAFFGIDTDNKLKWGGGSLGNSSREIADSSNIMNLWAANPTAPSWNGQTVWRSGNFDPATKVDLNAANATNGNMIFNRISGTGSGIASSGRVGAINLQNGAHSGQAAAVTFERGGSIFVNFGLDTDNVLKVGGGNLGANAYPVIHAGNYNNYINQALVQVGLGGVGSYGIFAVLDNAAPTATVQPGVVVDGSILIYSSCAANYNSGQRPAGTWRCMGYVVNRDANTPDSATLFQRVT
Physico‐chemical
properties
protein length:964 AA
molecular weight: 102932,16430 Da
isoelectric point:5,66153
aromaticity:0,10477
hydropathy:-0,25757

Domains

View on InterPro
QKW95290.1
1 964 aa
STR 152–231 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QKW95290.1 [NCBI]
Genbank nucleotide accession
MT349888 [NCBI]
CDS location
range 33050 -> 35944
strand +
CDS
GTGATCACACCCGAACTGATCCCCAGTCCGTTTGCCGCTCAGGGCGATAAAGACCCGATTCCACAAACCTCCTCCACTGGCTTCGCAAACCTTCGCGACGGCTATACGCCGGACTACGAAATCAGCCTGGCGTCGAACAACCCGCAGGCCAAAGCGGTCGAGCGGAAAATTCAAAACCAACTCTTCTTCATCGCGACCCAGAACGCACAGGCGTGGCAGCGACAAATGGCGCCGCCGTGGTTTCAGGGCATGCCTGGCGGCTACGAACAGAATGCAGAAGTCGTGCGCGTCGGAAATGACGGCATAATGCGGCGTTATCGTTCCATGGTGAATGCCAATGCGAGCGACCCTCTCAGCAGCACGACTTGGGAAGAACAACCCGCATGGTCGGCGATGCGCTCCAACATCCCGATGCCGGCCGGAGGCCCAGGCCTATCTTCTGGCGGAGAAGTCATCACGACCGGCCGCAACTTCAACGACCTGTTAAATGGGACGTGGGAGTTCTTCTCTGATTCAGTGGTTATCGCTTCTCAGAATGCCCCCGTATATCCGGCTTCCGCTGGTGCCGCTGCTGGCATGTTGGAGGCGAAATCTTGGGTGTCCGGAGCCAATACGTTCTGCGTCCAACGCTACACTGATCGCGTCGGGAACGTCGCTGTGCGCGGGCTTAATGCCGGAGCGTGGACCAACTGGATGTATGCGGTAAACGTCATGGCTCTTCAACAAGGTCGGGTCACCTATGGAGTCGCGGCCGGATCGGCGAACGCTTACACGTTGACGCTAGTTCCGCAGCTCCAAGGCGGCCTGGTGGATGGCATGATTCTTCGGGTCAAGTTCAACACCATGAACACCGGCGCCTCCACCATCAACGTCTCCGGACTCGGCGCCAAAGCCATCGTCGGCGCGGCCAACTTCCCTCTCACCGGCGGCGAACTTGGCCAAGGACTCATCGCTGAGCTTGTATTCGACGCAGCAGGCGACCGCTGGAGAATCCTCGCAGGCGCGCCACGCATCCAAGTTGGCAACGCCGATCAAGATTACCAGGCCCCCAGCTGGAAACAGGTGAAGGATTACGTCGCGTCCCAAAAGCTGACTGAAGTGGACTGGGCTGACGTCGTCAACAAGCCGAACGTCGCTATCCAAGACACTACGCCGTGGTTCGCCAATCTGGAGTTGTCTGACGCTCGGCCTTTCATCGATTTCCACTTCAACAACAACCGCGCCAAAGACTTCGACTATCGCTTTATCTCTGAAGCTGATGGGTCGATGGCGTTCTACTCTCGCCAGGGGTCAGCTGGTCCTACCCAGGATATCCTGTTCAGCAGGTCGAATGTTACATTCCTCCAGCCGCGACTGGATGTTGCGAAAAACCTCGCGTACATCGCGAACTCTGGTCCCCTTTGGCAGAACACCACTGCCGATCAGCCTGGTTGGAAATTCACCTTCGCACAAGGTGTGGACGCCAACAACAACGCGGTTATCGCAGTCAATACCACCAATCCGGACGGCTCCTATCGCTCACAGATCATGCGATGGGACTGGGCGTCCACGAACGTCATATTCAACAATCGTCCGCTCTTTGCCGGTCAATACACTCCTTGGGATTCTGGAAACTTTGATCCCTCCACCAAGTTGACTGTGAATGCCACGAACCAAATCGCCGGCCCGACCGGGATTCGGAATACAAACGGCAACACCGGCAACATGAACACATGGGGCTCCAGTTCCACGACGGCTTCATACGGAAACGCTGCTCTTCAAATCTTCGGGAAAGGTGGTGGCGAGCCTGCCGCGCTTTATTTCGACAACTCCCAGACAGGATGGTATCTGGGGATGGACAAGGATGGACAGCTCAAGCGGGCCGGCTGGTCGCTCGGCAATAACGCCTACGTGATTACCGACGAATCCAACATTCGTTTCCACGTGAATTCCATGGCTGGCACTCCTGTTTGGGGCGGAAACGAATTCTGGGGGCCGTGGAACTTTAATCCGAACACCAAGCTGACCATCAAAGCCGGCACCCAGGAAACTAGCAGCACTGCGATATTCAGCGGAACTATGCCATTCGCTCCAATCGCATCGCTGTCCGATTATTCTCAGGCCCCTTTGACGGTTTACAACGCGCCAACCGGTCCGTCTGCAAAACCGGCCGTCATCGCGTTCATTCGTCCTGGCAACTGGGGCGCGTTCTTCGGCATCGATACCGACAACAAGCTGAAATGGGGCGGCGGATCGCTCGGCAACAGTTCCAGGGAAATCGCCGATTCCAGCAACATCATGAATCTTTGGGCGGCCAACCCGACCGCGCCGTCCTGGAACGGCCAAACCGTTTGGCGATCCGGAAACTTTGATCCGGCGACGAAAGTGGATTTGAACGCCGCGAACGCCACCAACGGCAACATGATCTTCAACCGCATTTCTGGAACTGGTAGCGGCATAGCTTCGTCAGGTCGAGTTGGCGCCATCAACCTGCAGAATGGGGCGCATTCGGGGCAAGCGGCAGCAGTCACTTTCGAGCGGGGCGGCAGTATCTTCGTCAACTTCGGCTTGGATACCGACAACGTTCTCAAAGTAGGTGGCGGAAACCTGGGGGCAAATGCCTATCCGGTCATCCACGCCGGGAACTACAATAACTACATCAACCAGGCGCTGGTTCAGGTGGGTCTTGGCGGAGTCGGTTCCTATGGCATCTTTGCGGTTCTGGACAATGCCGCTCCAACCGCGACCGTTCAACCGGGAGTGGTTGTGGACGGTTCCATTCTCATCTACTCGTCTTGCGCCGCAAACTACAATAGCGGTCAAAGGCCTGCCGGAACTTGGCGCTGCATGGGATATGTAGTCAACCGGGATGCCAACACTCCTGACTCCGCGACCCTTTTCCAGCGAGTGACGTAA

Genome Context

Tertiary structure

QKW95290.1
ESMFold2 structure
Source ESMFold2
pLDDT 64.1
Oligomeric state monomer