Genbank accession
ARU13589.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect2
Probability 1,00
Seq2Symm
C3 confidence 0,971
C3 0,971
C1 0,044
C2 0,004
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MQIWIHDKSMRKVCALNNEIPGMLPYTNSQWHPYLEYSTSTFDFTIPKIVNRKLHDDIKYINDQMFVSFYFDNSYHVFYVSKLVENDFSFQVTCNNTNLELAMEVARPLADSGGPKTIEWYLQNLELLGFAGLEIGVNEISDRTRTLTFESQSGTKLEQLHSLMNQFDAEFIFRTELNRDGTMKRFIIDIYQEADENHHGIGKARGDVILYYQSGLKGVQVTSDKTQLFNAGNFIGQDGVNLNDVEFEEKNELGQVEFYSRKGTSFVFAPLSRERYPSTMNPDSADNWTRRDFQTEYKDVESLKAYALRTIKQYAYPLLTYTVDVQSSFLDNYKDINLGDTVKIIDNNFRGGLALEARVSEMIISFDNPTNNSVVFTNFRKLDNKPSSELQQRIDEIVSKSLPYHVEIRTTNGTVFKNGIGRSTVKPILKQGDKIVDATYRFVIDGTIKYVGMTYDMVASEITQPTTLTIAAWVDNKEVASEEITFLNVSDGKPGADGRTPYVHFAYADSADGQKGFSLTQTGSKRYLGVLTNFIKEDSTNPSDYTWNDTAGSVSVGGENLIINSAFPKNLNNWGFWEPGLPNENLHIATHVFYYNAARNLFRLDDNSNSGVPAASRRFPVKRNTDYSFNIQTFATGNIKGLTIYFLGRKANETDKAFTKVVNLKTHTGSPSVTQAVKWHLTFNSGDCDEGYIRIDNSGTTDGKTSMLFFAELDCYEGTTDRAWQASSKDLEEEIDTKADDVLTQAQLNRLNETNSIIKAELNAKASLDTLNQWVEAYQNFVNANNANRAQAEKDLADASARVTKLENDLNDMSERWNFIDSYMAASNEGLVIGKKDESSSIMFNPNGRISMFSAGNEVMYISKGVIHIENGIFSKTIQIGRYREEQDLLNPDRNVIRYVGGA
Physico‐chemical
properties
protein length:903 AA
molecular weight: 102040,56250 Da
isoelectric point:5,12065
aromaticity:0,10963
hydropathy:-0,48261

Domains

View on InterPro
ARU13589.1
1 903 aa
ENZ 142–381 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
ARU13589.1 [NCBI]
Genbank nucleotide accession
KY705264.1 [NCBI]
CDS location
range 14795 -> 17506
strand +
CDS
ATGCAAATCTGGATTCATGATAAAAGTATGCGTAAAGTGTGTGCTTTGAATAATGAAATTCCCGGAATGTTGCCATATACGAACAGTCAATGGCATCCATACCTTGAATACTCAACAAGTACGTTTGATTTTACAATTCCTAAAATTGTGAACAGGAAACTGCACGATGATATCAAATATATCAATGACCAGATGTTTGTATCATTCTATTTCGATAATTCCTATCATGTTTTTTATGTATCAAAACTCGTTGAGAATGATTTTAGTTTTCAAGTCACTTGTAATAACACCAACCTTGAATTGGCAATGGAAGTTGCACGACCACTTGCAGACAGTGGCGGTCCCAAAACTATTGAATGGTATCTTCAAAATCTTGAGTTGCTTGGTTTTGCAGGTCTGGAAATAGGTGTCAATGAAATTTCTGATAGAACAAGAACGCTTACTTTTGAATCTCAAAGTGGAACTAAACTAGAGCAACTTCATAGCTTGATGAATCAATTTGATGCAGAATTTATTTTCCGTACCGAATTAAACCGAGACGGAACTATGAAACGTTTCATCATCGACATCTACCAAGAAGCAGATGAAAACCATCACGGTATAGGTAAGGCAAGAGGAGATGTTATTCTCTACTACCAAAGCGGATTGAAAGGCGTTCAAGTTACTAGTGATAAAACGCAACTTTTCAACGCTGGTAATTTCATTGGACAAGATGGCGTTAACCTAAACGATGTCGAATTTGAGGAAAAGAACGAGCTAGGACAAGTAGAGTTCTATTCTCGAAAGGGCACTAGCTTCGTTTTCGCCCCACTGTCAAGGGAACGCTACCCATCTACCATGAATCCAGACAGCGCTGATAACTGGACACGTAGGGATTTTCAGACAGAATACAAGGACGTTGAATCCTTAAAAGCTTACGCCTTGCGTACTATCAAGCAGTATGCTTATCCACTATTGACTTACACAGTAGATGTTCAGTCTAGCTTTCTGGATAACTATAAAGACATCAATCTAGGTGACACTGTTAAAATCATCGATAATAATTTTAGAGGTGGTTTAGCCCTCGAAGCGCGTGTATCTGAAATGATTATCAGCTTTGACAATCCCACAAACAACTCGGTTGTTTTTACTAATTTCAGAAAATTGGATAATAAACCGTCTAGCGAATTACAACAACGTATCGATGAGATTGTTTCTAAGTCATTGCCATATCATGTTGAGATAAGGACCACAAACGGTACAGTATTTAAAAACGGTATTGGTCGTTCTACTGTTAAACCCATCTTGAAACAAGGCGATAAAATTGTTGATGCAACTTATCGATTTGTGATTGACGGAACTATTAAATACGTAGGTATGACTTACGATATGGTAGCGTCAGAGATAACTCAACCAACAACGTTGACGATTGCTGCGTGGGTAGATAATAAAGAAGTAGCTTCGGAAGAGATTACTTTCTTAAATGTATCAGATGGTAAACCTGGAGCAGACGGACGTACGCCTTACGTCCATTTTGCTTATGCCGATAGTGCCGATGGTCAAAAGGGTTTCAGTTTGACACAGACTGGAAGTAAACGCTATTTAGGTGTGCTAACCAACTTCATAAAAGAAGACAGTACTAATCCATCGGACTATACGTGGAATGACACGGCTGGCAGTGTTTCGGTTGGCGGTGAGAATCTAATCATTAACTCGGCTTTTCCAAAGAATCTTAACAATTGGGGATTTTGGGAACCGGGATTGCCTAATGAGAATCTTCATATAGCAACACATGTATTTTATTATAATGCTGCAAGAAACCTGTTTAGGCTAGATGATAATAGCAATAGTGGGGTTCCTGCTGCATCAAGACGTTTTCCAGTCAAACGCAACACAGACTACTCGTTCAATATTCAGACATTCGCTACTGGTAATATCAAGGGCTTAACTATCTATTTTTTGGGTCGGAAGGCAAATGAAACTGACAAGGCATTTACTAAAGTCGTGAATCTCAAAACACATACAGGTTCACCGTCAGTAACACAAGCTGTTAAATGGCACTTAACGTTTAATTCTGGTGATTGTGATGAAGGTTACATCCGTATAGACAACAGTGGAACGACTGACGGTAAAACCTCTATGCTATTCTTCGCTGAGTTAGACTGCTATGAGGGAACCACTGACCGAGCGTGGCAAGCGTCGTCGAAAGATTTGGAAGAGGAAATAGACACCAAAGCCGATGATGTCCTAACACAAGCACAACTCAACAGACTGAACGAAACGAACTCTATTATTAAAGCTGAATTAAACGCTAAAGCATCACTTGATACACTCAATCAGTGGGTGGAAGCCTATCAAAATTTTGTTAACGCAAACAATGCCAATCGTGCACAAGCTGAAAAAGATTTAGCTGATGCAAGTGCTCGTGTAACTAAACTAGAAAACGACTTAAATGATATGTCAGAACGTTGGAATTTTATCGATAGCTACATGGCAGCATCAAATGAAGGTCTTGTTATTGGTAAAAAAGATGAATCAAGCTCTATCATGTTCAATCCAAACGGGCGTATCTCAATGTTCTCAGCTGGAAACGAGGTAATGTACATTTCAAAAGGTGTCATCCATATCGAAAACGGTATTTTCTCTAAAACTATCCAAATCGGACGATATCGAGAGGAACAAGATTTATTGAATCCAGACCGTAATGTCATTAGATACGTAGGAGGTGCATAA

Genome Context

Tertiary structure

ARU13589.1
ESMFold structure
Source ESMFold
pLDDT 76.9
Oligomeric state monomer