Genbank accession
ARU14342.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,83
Seq2Symm
C1 confidence 0,999 truncated
C1 0,999
C2 0,002
C3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MLLTIHDNNLQKVAYIDNEKQSTLNFFNDKWTRSLESGTSVFEFSVFKKSIKSKSNVDFAYKYLNERSFVSFKHKRRSYLFNVMKFEEDEHIIRCYCENLSLELLLEYRGAYKASKPMTFKEYFDDWGMERFAKLTIGVNEVSDQKRTLEWEGQETTLARLISLARNFDAEIEFETKLQANSQLDEFVLNVYKSHDDKNQGVGLRRSDIVLKYDKNIKSIKRSVDKTQIYNMITPYGRKTETNKETKRISDPVTIQNPVVVPSTRVEKRYTGGDLTYAGHTLSASLVQTIFNLCIQRNLLPSGVISQLYLESFWGSSNVARRDNNWSGMTGGAQTRPSGVIVTTGSPRPASEGGTYMHYASVDDFMKDYTYLLAEQTSGGRKMYGVKGKQNIEEYTKGLFRIGGALYDYAAAGYNHYIYLMRDIRNGINRSNGNILDKLDDLWRQPDNQITQPNQPVTRTVKADKVIAVLNEMQGLKGRRVGNGQCYALAAWYSMKLGGPGLGAGVTGKSGAIGSGMCASNIGTDYAWDKFGWSVVRPSSVNQLKAGAIANIKAYNSYLGTSVWGHVSIIIANNGSTVTVLEQNYAGRQYVIQNSYPASAYLGSIETLCYPPELKEGKTVEGRTETVSALNVEVQKVEIPPIDVEVTSESTDALTIDSKRKQEWKNDKGQVEFYLENGSLYAPISKELYPSILTGKENGDNWIRKDMEIDTDSEDVLISTALRNLRKFCYPAITYEVDGFIDLDIGDTVKIQDTCFSPILMLEARVSEQQISFTNPVENKTVFANYQALQNKVSDSLLSRMTKLAEQAIPYELKLSTDNGTTFKNSVGQSVLKASLEKNGVVYQPIFFYKNGDAIIGTGNQLVVKPTDFENTLQVTVEAYLDDELVASTEITFTDVSDGEQGPQGPQGIDGKTPYVHTAWSYSADGTDRFTKVYPNLNLIDDTRDFSGNWDRAWGWQNDGTYKGLTVKKRIDLWQGINKEFKAPKDGTYTFSAYIKTSGNTANIARHIHLNGYWNKDTFKTFRNNFDWLRDSFSVNLKTGDTISARYELSGEGILWTAGHKWEEGPVATPWMPSASEVTTADYPKYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGPKGERGPQGLQGPQGDQGIPGPKGEDGKTQYTHIAYADTISGSGFSQTDVNKPYIGMYQDFNPIDSNNPQDYRWTKWKGSDGKDGIPGKAGADGRTPYVHFAYADSADGRDGFSLTQTGSKRYLGVLTNFIKEDSTNPEEYTWNDTAGGISVGARNLLKGSKGPFKPDSKPTNFDNYHYYQNETSVYLEQNKKYIISAKTDGNFTASHNPNSESDNVVLWLIDDKWTINQIISDSNTGTTGTQFTWNNPTGIYHLRVNTYHKTAIKSVWEVKIEEGIIKTDWTPAIEDVQDEIDSKADAVLTTEQINKLNEEANIIKAEVEAKAKADIVNNWIKDYNDFLEVSERERVKAEQDLKNAQQRLNAINKDLKEMTERWNFIDTYMSASNEGFVIGKQDGSKSIMLNADGGITFFSAGRSTMTISEGKTEMNNGVVKKSLKVGRYIEQPYHIDPDINVIRYVGEE
Physico‐chemical
properties
protein length:1581 AA
molecular weight: 177519,96910 Da
isoelectric point:5,58985
aromaticity:0,10563
hydropathy:-0,60670

Domains

View on InterPro
ARU14342.1
1 1581 aa
ENZ 136–244 · ENZ 274–402 · STR 403–610 · RBD 973–1062 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
ARU14342.1 [NCBI]
Genbank nucleotide accession
KY705280.1 [NCBI]
CDS location
range 15665 -> 20410
strand +
CDS
ATGTTACTAACAATACATGACAATAATTTGCAGAAAGTTGCATATATAGATAACGAAAAACAATCCACGCTAAATTTTTTCAACGACAAATGGACTCGATCACTTGAAAGCGGAACATCTGTTTTTGAGTTTTCGGTTTTTAAGAAAAGCATTAAATCTAAATCGAATGTAGATTTTGCTTATAAATATCTTAACGAGAGATCTTTTGTCAGCTTCAAACACAAGAGACGCTCTTACCTTTTCAATGTTATGAAATTTGAAGAGGATGAGCATATTATTCGATGCTACTGTGAAAACTTGAGCCTTGAATTACTTTTAGAGTATCGAGGTGCTTACAAAGCATCAAAACCTATGACATTCAAAGAGTATTTTGACGATTGGGGAATGGAACGATTCGCTAAATTGACTATTGGTGTCAACGAGGTTTCTGATCAAAAGAGGACTCTAGAGTGGGAAGGACAAGAAACAACTCTTGCTCGACTGATTTCGTTAGCTAGGAACTTTGATGCTGAAATAGAATTTGAGACAAAGCTACAAGCTAATAGTCAACTTGATGAGTTTGTTTTAAACGTTTACAAGTCTCATGATGATAAAAATCAAGGTGTTGGTCTCAGACGCTCAGATATTGTTCTGAAGTATGATAAGAACATAAAAAGCATTAAGCGTAGCGTTGACAAGACTCAGATTTATAACATGATAACACCTTATGGTAGAAAAACTGAGACGAATAAAGAAACCAAAAGAATCTCCGATCCAGTTACTATTCAAAATCCAGTTGTTGTTCCATCTACTAGAGTTGAAAAAAGGTATACTGGAGGTGACTTGACTTATGCAGGCCATACGTTGAGTGCTAGTTTGGTTCAAACCATCTTTAATCTTTGTATACAGCGAAATCTTTTGCCATCAGGCGTCATATCTCAGCTCTATCTTGAATCGTTCTGGGGGTCTTCTAATGTAGCTAGACGAGACAATAACTGGAGCGGCATGACTGGTGGTGCACAAACTCGCCCATCTGGTGTCATTGTAACAACGGGTAGTCCTAGACCAGCTAGCGAAGGTGGAACGTACATGCACTATGCTAGCGTTGACGACTTCATGAAAGACTACACTTATCTACTAGCAGAGCAGACGAGTGGTGGTCGTAAGATGTACGGTGTCAAAGGCAAGCAGAACATTGAAGAATACACAAAAGGGCTCTTCCGAATTGGAGGAGCTCTTTATGATTATGCTGCTGCTGGATACAACCACTATATCTATCTTATGCGAGATATTCGAAATGGTATCAACCGTTCAAATGGAAACATTTTGGATAAGTTAGATGATTTGTGGAGACAGCCAGACAATCAAATCACTCAACCAAACCAACCAGTAACGAGAACTGTTAAGGCAGATAAAGTTATCGCCGTCCTCAATGAAATGCAAGGGTTGAAAGGTCGTCGAGTAGGTAACGGTCAATGTTATGCATTAGCAGCTTGGTATTCTATGAAATTAGGTGGTCCCGGTCTCGGTGCTGGAGTTACTGGCAAGTCTGGTGCAATTGGTTCTGGTATGTGTGCATCCAATATTGGTACTGACTACGCTTGGGATAAGTTCGGTTGGAGTGTTGTTAGACCTAGCAGTGTTAACCAATTAAAAGCTGGGGCTATTGCTAATATCAAGGCATACAATAGTTATCTAGGTACGTCTGTTTGGGGACACGTTTCAATTATCATCGCTAACAACGGTAGCACTGTTACGGTTCTAGAACAAAACTACGCTGGCCGTCAATACGTTATCCAAAATAGCTATCCTGCTAGTGCTTATTTAGGATCTATTGAAACATTATGTTATCCTCCTGAATTGAAAGAGGGTAAAACGGTTGAGGGTAGGACTGAAACAGTTAGCGCTCTAAACGTTGAAGTTCAAAAGGTAGAGATTCCACCTATCGACGTTGAAGTAACATCTGAAAGCACAGATGCACTTACTATTGATAGCAAACGAAAGCAAGAATGGAAGAACGATAAAGGTCAAGTTGAGTTTTATCTTGAAAACGGTTCGCTATATGCTCCGATTTCAAAAGAACTATATCCATCCATTTTAACCGGTAAAGAGAATGGCGATAACTGGATACGGAAAGATATGGAAATAGACACGGACAGCGAAGACGTGCTTATTTCGACAGCTCTTAGAAACCTACGAAAATTCTGTTATCCAGCTATTACTTATGAGGTTGATGGTTTCATTGATTTAGATATTGGGGACACAGTTAAAATCCAAGACACTTGTTTCTCGCCTATTTTGATGCTTGAAGCTCGTGTCAGCGAACAACAGATTAGTTTCACTAATCCCGTCGAGAATAAGACGGTATTCGCTAACTACCAAGCACTTCAAAACAAAGTTTCAGACAGTTTATTATCCCGAATGACTAAATTGGCTGAGCAAGCTATTCCTTACGAGTTGAAACTTTCAACCGATAATGGGACTACATTTAAGAATAGTGTTGGTCAAAGCGTACTAAAAGCTTCGCTTGAAAAGAACGGTGTAGTTTATCAACCAATATTCTTCTATAAAAATGGCGATGCTATCATCGGTACTGGCAATCAGTTAGTTGTTAAACCAACAGATTTTGAAAATACTTTACAGGTAACTGTTGAAGCGTACCTTGACGACGAGTTAGTAGCAAGTACAGAAATCACATTCACAGATGTCTCAGATGGCGAACAAGGACCACAAGGTCCACAAGGTATAGACGGTAAAACGCCTTACGTTCACACGGCTTGGTCTTACAGTGCAGATGGTACAGATAGATTCACTAAGGTTTATCCGAATTTGAACTTGATTGATGATACAAGAGATTTCAGTGGAAATTGGGATAGAGCGTGGGGATGGCAAAATGACGGAACATATAAAGGTTTAACTGTTAAAAAAAGAATAGATTTATGGCAGGGTATTAATAAAGAATTCAAGGCACCAAAAGATGGTACTTATACTTTCTCAGCTTATATTAAAACTTCAGGAAACACTGCTAATATAGCCAGACATATTCATTTAAATGGATATTGGAATAAAGATACTTTTAAAACTTTTAGAAATAACTTTGATTGGTTAAGAGATAGCTTCTCTGTAAACCTAAAAACTGGAGATACTATTTCTGCAAGATACGAATTATCAGGAGAAGGTATTTTATGGACCGCTGGTCATAAATGGGAAGAAGGTCCAGTAGCTACTCCATGGATGCCTTCCGCTTCCGAAGTCACAACTGCTGATTATCCAAAATACATTGGTCAATATACGAACTATATGGAAGTAGATAGTCCTAATCCTCAAGATTATACTTGGAGTCTAATTCGAGGGAACGATGGCAAGCAAGGTCCACAAGGTCCTAAAGGTGAACGGGGTCCTCAAGGTTTACAGGGACCTCAAGGCGACCAAGGAATCCCGGGACCAAAGGGTGAAGATGGTAAAACGCAGTATACCCATATAGCTTACGCTGATACTATTTCTGGTAGTGGATTTAGTCAAACAGATGTCAATAAACCATACATCGGAATGTACCAAGACTTCAATCCTATTGATAGTAATAACCCTCAAGACTATCGTTGGACGAAGTGGAAGGGCAGCGATGGTAAAGACGGGATTCCCGGTAAAGCTGGGGCAGATGGACGAACACCTTACGTGCATTTTGCTTATGCAGACAGTGCTGATGGACGAGATGGTTTTAGTCTTACCCAGACTGGAAGTAAACGCTATCTAGGTGTACTTACAAACTTCATCAAAGAAGACAGCACAAATCCAGAAGAATATACATGGAATGATACTGCTGGTGGTATTTCTGTTGGTGCTAGGAATCTATTGAAAGGCTCGAAGGGTCCTTTCAAACCAGACAGTAAACCAACAAATTTTGATAATTATCATTATTACCAAAACGAAACTTCTGTCTACTTAGAACAAAATAAAAAGTACATCATTAGTGCTAAAACAGATGGTAATTTTACTGCGTCTCACAATCCAAACTCCGAAAGCGACAATGTTGTACTATGGTTAATCGATGATAAATGGACAATTAATCAGATTATATCTGATTCAAATACAGGGACAACAGGAACTCAGTTCACTTGGAATAATCCAACAGGGATATATCATCTACGTGTCAATACATATCACAAAACAGCAATCAAATCTGTGTGGGAAGTGAAGATCGAAGAAGGGATAATCAAAACTGATTGGACTCCTGCTATTGAGGATGTCCAAGATGAGATTGATTCCAAAGCGGATGCTGTTTTGACAACTGAACAGATTAATAAACTAAACGAAGAAGCCAATATTATTAAAGCCGAGGTAGAAGCCAAAGCTAAAGCTGACATCGTGAATAACTGGATTAAAGATTACAACGATTTTCTTGAAGTAAGCGAAAGAGAACGTGTTAAAGCAGAGCAAGATTTGAAAAATGCTCAACAGCGCTTGAATGCCATCAATAAAGACCTTAAAGAAATGACGGAACGTTGGAATTTCATTGACACATACATGAGTGCTTCTAACGAAGGGTTCGTAATAGGCAAACAAGATGGTAGCAAGAGCATTATGCTTAATGCTGATGGTGGTATTACATTTTTTAGTGCAGGTCGTTCGACAATGACTATTTCTGAAGGTAAAACTGAGATGAATAACGGGGTAGTCAAAAAATCTCTCAAAGTTGGTAGATATATTGAACAACCATATCACATTGACCCAGATATTAATGTTATACGATATGTAGGAGAAGAATAA

Genome Context

Tertiary structure

ARU14342.1
ColabFold structure
Source ColabFold
pLDDT 79.0
Oligomeric state monomer