Protein
- Genbank accession
- ARU14342.1 [GenBank]
- Protein name
- tail fiber protein and host specificity
- RBP type
-
TFTF
- Seq2Symm
-
C1 confidence 0,999 truncated
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C1 0,999 C2 0,002 C3 0,001 - Protein sequence
-
MLLTIHDNNLQKVAYIDNEKQSTLNFFNDKWTRSLESGTSVFEFSVFKKSIKSKSNVDFAYKYLNERSFVSFKHKRRSYLFNVMKFEEDEHIIRCYCENLSLELLLEYRGAYKASKPMTFKEYFDDWGMERFAKLTIGVNEVSDQKRTLEWEGQETTLARLISLARNFDAEIEFETKLQANSQLDEFVLNVYKSHDDKNQGVGLRRSDIVLKYDKNIKSIKRSVDKTQIYNMITPYGRKTETNKETKRISDPVTIQNPVVVPSTRVEKRYTGGDLTYAGHTLSASLVQTIFNLCIQRNLLPSGVISQLYLESFWGSSNVARRDNNWSGMTGGAQTRPSGVIVTTGSPRPASEGGTYMHYASVDDFMKDYTYLLAEQTSGGRKMYGVKGKQNIEEYTKGLFRIGGALYDYAAAGYNHYIYLMRDIRNGINRSNGNILDKLDDLWRQPDNQITQPNQPVTRTVKADKVIAVLNEMQGLKGRRVGNGQCYALAAWYSMKLGGPGLGAGVTGKSGAIGSGMCASNIGTDYAWDKFGWSVVRPSSVNQLKAGAIANIKAYNSYLGTSVWGHVSIIIANNGSTVTVLEQNYAGRQYVIQNSYPASAYLGSIETLCYPPELKEGKTVEGRTETVSALNVEVQKVEIPPIDVEVTSESTDALTIDSKRKQEWKNDKGQVEFYLENGSLYAPISKELYPSILTGKENGDNWIRKDMEIDTDSEDVLISTALRNLRKFCYPAITYEVDGFIDLDIGDTVKIQDTCFSPILMLEARVSEQQISFTNPVENKTVFANYQALQNKVSDSLLSRMTKLAEQAIPYELKLSTDNGTTFKNSVGQSVLKASLEKNGVVYQPIFFYKNGDAIIGTGNQLVVKPTDFENTLQVTVEAYLDDELVASTEITFTDVSDGEQGPQGPQGIDGKTPYVHTAWSYSADGTDRFTKVYPNLNLIDDTRDFSGNWDRAWGWQNDGTYKGLTVKKRIDLWQGINKEFKAPKDGTYTFSAYIKTSGNTANIARHIHLNGYWNKDTFKTFRNNFDWLRDSFSVNLKTGDTISARYELSGEGILWTAGHKWEEGPVATPWMPSASEVTTADYPKYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGPKGERGPQGLQGPQGDQGIPGPKGEDGKTQYTHIAYADTISGSGFSQTDVNKPYIGMYQDFNPIDSNNPQDYRWTKWKGSDGKDGIPGKAGADGRTPYVHFAYADSADGRDGFSLTQTGSKRYLGVLTNFIKEDSTNPEEYTWNDTAGGISVGARNLLKGSKGPFKPDSKPTNFDNYHYYQNETSVYLEQNKKYIISAKTDGNFTASHNPNSESDNVVLWLIDDKWTINQIISDSNTGTTGTQFTWNNPTGIYHLRVNTYHKTAIKSVWEVKIEEGIIKTDWTPAIEDVQDEIDSKADAVLTTEQINKLNEEANIIKAEVEAKAKADIVNNWIKDYNDFLEVSERERVKAEQDLKNAQQRLNAINKDLKEMTERWNFIDTYMSASNEGFVIGKQDGSKSIMLNADGGITFFSAGRSTMTISEGKTEMNNGVVKKSLKVGRYIEQPYHIDPDINVIRYVGEE
- Physico‐chemical
properties -
protein length: 1581 AA molecular weight: 177519,96910 Da isoelectric point: 5,58985 aromaticity: 0,10563 hydropathy: -0,60670
Domains
Domain architecture
ARU14342.1
1
1581 aa
ENZ 136–244 · ENZ 274–402 · STR 403–610 · RBD 973–1062 ·
ATT Attachment Domain
STR Structural Domain
RBD Receptor-Binding Domain
CBM Carbohydrate-Binding Module
LEC Lectin-like Domain
ENZ Enzymatic Domain
CHP Intramolecular Chaperone
LNK Linker/Spacer Domain
TAS Tail-Associated Structural
TTP Tail Tubular Protein
UNK Uncharacterized Domain
Unmapped
Proteins with similar domain architecture
Taxonomy
Coding sequence (CDS)
Genbank protein accession
ARU14342.1
[NCBI]
Genbank nucleotide accession
KY705280.1
[NCBI]
CDS location
range 15665 -> 20410
strand +
strand +
CDS
ATGTTACTAACAATACATGACAATAATTTGCAGAAAGTTGCATATATAGATAACGAAAAACAATCCACGCTAAATTTTTTCAACGACAAATGGACTCGATCACTTGAAAGCGGAACATCTGTTTTTGAGTTTTCGGTTTTTAAGAAAAGCATTAAATCTAAATCGAATGTAGATTTTGCTTATAAATATCTTAACGAGAGATCTTTTGTCAGCTTCAAACACAAGAGACGCTCTTACCTTTTCAATGTTATGAAATTTGAAGAGGATGAGCATATTATTCGATGCTACTGTGAAAACTTGAGCCTTGAATTACTTTTAGAGTATCGAGGTGCTTACAAAGCATCAAAACCTATGACATTCAAAGAGTATTTTGACGATTGGGGAATGGAACGATTCGCTAAATTGACTATTGGTGTCAACGAGGTTTCTGATCAAAAGAGGACTCTAGAGTGGGAAGGACAAGAAACAACTCTTGCTCGACTGATTTCGTTAGCTAGGAACTTTGATGCTGAAATAGAATTTGAGACAAAGCTACAAGCTAATAGTCAACTTGATGAGTTTGTTTTAAACGTTTACAAGTCTCATGATGATAAAAATCAAGGTGTTGGTCTCAGACGCTCAGATATTGTTCTGAAGTATGATAAGAACATAAAAAGCATTAAGCGTAGCGTTGACAAGACTCAGATTTATAACATGATAACACCTTATGGTAGAAAAACTGAGACGAATAAAGAAACCAAAAGAATCTCCGATCCAGTTACTATTCAAAATCCAGTTGTTGTTCCATCTACTAGAGTTGAAAAAAGGTATACTGGAGGTGACTTGACTTATGCAGGCCATACGTTGAGTGCTAGTTTGGTTCAAACCATCTTTAATCTTTGTATACAGCGAAATCTTTTGCCATCAGGCGTCATATCTCAGCTCTATCTTGAATCGTTCTGGGGGTCTTCTAATGTAGCTAGACGAGACAATAACTGGAGCGGCATGACTGGTGGTGCACAAACTCGCCCATCTGGTGTCATTGTAACAACGGGTAGTCCTAGACCAGCTAGCGAAGGTGGAACGTACATGCACTATGCTAGCGTTGACGACTTCATGAAAGACTACACTTATCTACTAGCAGAGCAGACGAGTGGTGGTCGTAAGATGTACGGTGTCAAAGGCAAGCAGAACATTGAAGAATACACAAAAGGGCTCTTCCGAATTGGAGGAGCTCTTTATGATTATGCTGCTGCTGGATACAACCACTATATCTATCTTATGCGAGATATTCGAAATGGTATCAACCGTTCAAATGGAAACATTTTGGATAAGTTAGATGATTTGTGGAGACAGCCAGACAATCAAATCACTCAACCAAACCAACCAGTAACGAGAACTGTTAAGGCAGATAAAGTTATCGCCGTCCTCAATGAAATGCAAGGGTTGAAAGGTCGTCGAGTAGGTAACGGTCAATGTTATGCATTAGCAGCTTGGTATTCTATGAAATTAGGTGGTCCCGGTCTCGGTGCTGGAGTTACTGGCAAGTCTGGTGCAATTGGTTCTGGTATGTGTGCATCCAATATTGGTACTGACTACGCTTGGGATAAGTTCGGTTGGAGTGTTGTTAGACCTAGCAGTGTTAACCAATTAAAAGCTGGGGCTATTGCTAATATCAAGGCATACAATAGTTATCTAGGTACGTCTGTTTGGGGACACGTTTCAATTATCATCGCTAACAACGGTAGCACTGTTACGGTTCTAGAACAAAACTACGCTGGCCGTCAATACGTTATCCAAAATAGCTATCCTGCTAGTGCTTATTTAGGATCTATTGAAACATTATGTTATCCTCCTGAATTGAAAGAGGGTAAAACGGTTGAGGGTAGGACTGAAACAGTTAGCGCTCTAAACGTTGAAGTTCAAAAGGTAGAGATTCCACCTATCGACGTTGAAGTAACATCTGAAAGCACAGATGCACTTACTATTGATAGCAAACGAAAGCAAGAATGGAAGAACGATAAAGGTCAAGTTGAGTTTTATCTTGAAAACGGTTCGCTATATGCTCCGATTTCAAAAGAACTATATCCATCCATTTTAACCGGTAAAGAGAATGGCGATAACTGGATACGGAAAGATATGGAAATAGACACGGACAGCGAAGACGTGCTTATTTCGACAGCTCTTAGAAACCTACGAAAATTCTGTTATCCAGCTATTACTTATGAGGTTGATGGTTTCATTGATTTAGATATTGGGGACACAGTTAAAATCCAAGACACTTGTTTCTCGCCTATTTTGATGCTTGAAGCTCGTGTCAGCGAACAACAGATTAGTTTCACTAATCCCGTCGAGAATAAGACGGTATTCGCTAACTACCAAGCACTTCAAAACAAAGTTTCAGACAGTTTATTATCCCGAATGACTAAATTGGCTGAGCAAGCTATTCCTTACGAGTTGAAACTTTCAACCGATAATGGGACTACATTTAAGAATAGTGTTGGTCAAAGCGTACTAAAAGCTTCGCTTGAAAAGAACGGTGTAGTTTATCAACCAATATTCTTCTATAAAAATGGCGATGCTATCATCGGTACTGGCAATCAGTTAGTTGTTAAACCAACAGATTTTGAAAATACTTTACAGGTAACTGTTGAAGCGTACCTTGACGACGAGTTAGTAGCAAGTACAGAAATCACATTCACAGATGTCTCAGATGGCGAACAAGGACCACAAGGTCCACAAGGTATAGACGGTAAAACGCCTTACGTTCACACGGCTTGGTCTTACAGTGCAGATGGTACAGATAGATTCACTAAGGTTTATCCGAATTTGAACTTGATTGATGATACAAGAGATTTCAGTGGAAATTGGGATAGAGCGTGGGGATGGCAAAATGACGGAACATATAAAGGTTTAACTGTTAAAAAAAGAATAGATTTATGGCAGGGTATTAATAAAGAATTCAAGGCACCAAAAGATGGTACTTATACTTTCTCAGCTTATATTAAAACTTCAGGAAACACTGCTAATATAGCCAGACATATTCATTTAAATGGATATTGGAATAAAGATACTTTTAAAACTTTTAGAAATAACTTTGATTGGTTAAGAGATAGCTTCTCTGTAAACCTAAAAACTGGAGATACTATTTCTGCAAGATACGAATTATCAGGAGAAGGTATTTTATGGACCGCTGGTCATAAATGGGAAGAAGGTCCAGTAGCTACTCCATGGATGCCTTCCGCTTCCGAAGTCACAACTGCTGATTATCCAAAATACATTGGTCAATATACGAACTATATGGAAGTAGATAGTCCTAATCCTCAAGATTATACTTGGAGTCTAATTCGAGGGAACGATGGCAAGCAAGGTCCACAAGGTCCTAAAGGTGAACGGGGTCCTCAAGGTTTACAGGGACCTCAAGGCGACCAAGGAATCCCGGGACCAAAGGGTGAAGATGGTAAAACGCAGTATACCCATATAGCTTACGCTGATACTATTTCTGGTAGTGGATTTAGTCAAACAGATGTCAATAAACCATACATCGGAATGTACCAAGACTTCAATCCTATTGATAGTAATAACCCTCAAGACTATCGTTGGACGAAGTGGAAGGGCAGCGATGGTAAAGACGGGATTCCCGGTAAAGCTGGGGCAGATGGACGAACACCTTACGTGCATTTTGCTTATGCAGACAGTGCTGATGGACGAGATGGTTTTAGTCTTACCCAGACTGGAAGTAAACGCTATCTAGGTGTACTTACAAACTTCATCAAAGAAGACAGCACAAATCCAGAAGAATATACATGGAATGATACTGCTGGTGGTATTTCTGTTGGTGCTAGGAATCTATTGAAAGGCTCGAAGGGTCCTTTCAAACCAGACAGTAAACCAACAAATTTTGATAATTATCATTATTACCAAAACGAAACTTCTGTCTACTTAGAACAAAATAAAAAGTACATCATTAGTGCTAAAACAGATGGTAATTTTACTGCGTCTCACAATCCAAACTCCGAAAGCGACAATGTTGTACTATGGTTAATCGATGATAAATGGACAATTAATCAGATTATATCTGATTCAAATACAGGGACAACAGGAACTCAGTTCACTTGGAATAATCCAACAGGGATATATCATCTACGTGTCAATACATATCACAAAACAGCAATCAAATCTGTGTGGGAAGTGAAGATCGAAGAAGGGATAATCAAAACTGATTGGACTCCTGCTATTGAGGATGTCCAAGATGAGATTGATTCCAAAGCGGATGCTGTTTTGACAACTGAACAGATTAATAAACTAAACGAAGAAGCCAATATTATTAAAGCCGAGGTAGAAGCCAAAGCTAAAGCTGACATCGTGAATAACTGGATTAAAGATTACAACGATTTTCTTGAAGTAAGCGAAAGAGAACGTGTTAAAGCAGAGCAAGATTTGAAAAATGCTCAACAGCGCTTGAATGCCATCAATAAAGACCTTAAAGAAATGACGGAACGTTGGAATTTCATTGACACATACATGAGTGCTTCTAACGAAGGGTTCGTAATAGGCAAACAAGATGGTAGCAAGAGCATTATGCTTAATGCTGATGGTGGTATTACATTTTTTAGTGCAGGTCGTTCGACAATGACTATTTCTGAAGGTAAAACTGAGATGAATAACGGGGTAGTCAAAAAATCTCTCAAAGTTGGTAGATATATTGAACAACCATATCACATTGACCCAGATATTAATGTTATACGATATGTAGGAGAAGAATAA
Genome Context
Tertiary structure
ARU14342.1
ColabFold structure
Source
ColabFold
pLDDT
79.0
Oligomeric state
monomer