Genbank accession
YP_010683231.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,85
Seq2Symm
C1 confidence 0,998 truncated
C1 0,998
C2 0,003
C3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MLLTIHDNNLQKVAYIDNEKQSTLNFFNDKWTRSLESGTSVFEFSVFKKSIKSKSNVDFAYKYLNERSFVSFKHKRRSYLFNVMKVEEDEHIIRCYCENLSLELLLEYRGAYKASKPMTFKEYFDDWGMERFAKLTIGVNEVSDQKRTLEWEGQETTLARLISLARNFDAEIEFETKLQANSQLDEFVLNVYKSHDDKNQGVGLRRSDIVLKYDKNIKSIKRSVDKTQIYNMITPYGRKTETNKETKRISDPVTIQNPVVVPSTRVEKRYTGGDLTYAGHTLSASLVQTIFNLCIQRNLLPSGVISQLYLESFWGSSNVARRDNNWSGMTGGAQTRPSGVIVTTGSPRPASEGGTYMHYASVDDFMKDYTYLLAEQTSGGRKMYGVKGKQNIEEYTKGLFRIGGALYDYAAAGYNHYIYLMRDIRNGINRSNGNILDKLDDLWRQPDNQITQPNQPVTRTVKADKVIAVLNEMQGLKGRRVGNGQCYALAAWYSMKLGGPGLGAGVTGKSGAIGSGMCASNIGTDYAWDKFGWSVVRPSSVNQLKAGAIANIKAYNSYIGTSVWGHVSIIIANNGSTVTVLEQNYAGRQYVVQNSYPASAYLGSIETLCYPPELKEGKTVEGRTETVSALNVEVQKVEIPPIDVEVTSESTDALTIDSKRKQEWKNDKGQVEFYLENGSLYAPISKELYPSILTGKENGDNWIRKDMEIDTDSEDVLISTALRNLRKFCYPAITYEVDGFIDLDIGDTVKIQDTGFSPILMLEARVSEQQISFTNPVENKTVFANYQALQNKVSDSLLSRMTKLAEQAIPYELKLSTDNGTTFKNSVGQSVLKASLEKNGVVYQPIFFYKNGDAIIGTGNQLVVKPTDFENTLQVTVEAYLDDELVASTEITFTDVSDGEQGPQGPQGIDGKTPYVHTAWSYSADGTDRFTTVYPNLNLIDGTRDFSGNWDRDWAWSNDGSYKGLTVKKRTDEWQGINKEFKAPKDGTYTFSAYIKTSGNTANIARHIHLNGSWNKDTYKTFRNNFDWLRDSFSVNLKTGDTISARYELPGEGILWTAGHKWEEGPVATPWMPSASEVTTADYPKYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGPKGESGPQGLQGPKGDQGIPGPKGEDGKTQYTHIAYADTISGSGFSQTDVNKPYIGMYQDFNAVDSQNPQDYRWSKWKGSDGRDGIPGKPGADGRTPYVHFAYADSADGQKGFSLTQTGAKRYLGVLTNFFKEDSTNPSDYTWNDTAGSISVGGRNLLVKTNQGITNWNWQLSDGDKSVEEVKVDGIRAVKLIKGSTTANTGWNFIEYNGLLRELIQPKSKYVLSFDVKPSVDVTFYATLTNGDFTETLTDTVAMHKALANQWNKVSCVLTSKETLPNIAWQTVYLAGMPTTNGNWVIIKNIKLEEGDIPTQWTPAIEDIQDEIDSKADSAMTTEQINALNERAAIIQAETEARASAEILNKWIKNYQDFVKANETERAAAEKALVSSSQRVSTIAKELGELSDRWNFIDTYMNTSNDGLVIGKNDGSSSIVFNPNGRISMYSAGSEVMYISQGVIHIENGIFSKTIQVGRYREEQYHLNPDMNVIRYVGGF
Physico‐chemical
properties
protein length:1612 AA
molecular weight: 179993,91830 Da
isoelectric point:5,56234
aromaticity:0,10360
hydropathy:-0,53654

Domains

View on InterPro
YP_010683231.1
1 1612 aa
ENZ 136–244 · ENZ 274–402 · STR 403–610 · RBD 969–1062 · STR 1257–1427 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_010683231.1 [NCBI]
Genbank nucleotide accession
NC_071079.1 [NCBI]
CDS location
range 15239 -> 20077
strand +
CDS
ATGTTACTAACAATACATGACAATAATTTGCAGAAAGTTGCATATATAGATAACGAAAAACAATCCACGCTAAATTTTTTCAACGACAAATGGACTCGATCACTTGAAAGCGGAACATCTGTTTTTGAGTTTTCGGTTTTTAAGAAAAGCATTAAATCTAAATCGAATGTAGATTTTGCTTATAAATATCTTAACGAGAGATCTTTTGTCAGCTTCAAACACAAGAGACGCTCTTACCTTTTCAATGTTATGAAAGTTGAAGAGGATGAGCATATTATTCGATGCTACTGTGAAAACTTGAGCCTTGAATTACTTTTAGAGTATCGAGGTGCTTACAAAGCATCAAAACCTATGACATTCAAAGAGTATTTTGACGATTGGGGAATGGAACGATTCGCTAAATTGACTATTGGTGTCAACGAGGTTTCTGATCAAAAGAGGACTCTAGAGTGGGAAGGACAAGAAACAACTCTTGCTCGACTGATTTCGTTAGCTAGGAACTTTGATGCTGAAATAGAATTTGAGACAAAGCTACAAGCTAATAGTCAACTTGATGAGTTTGTTTTAAACGTTTACAAGTCTCATGATGATAAAAATCAAGGTGTTGGTCTCAGACGCTCAGATATTGTTCTGAAGTATGATAAGAACATAAAAAGCATTAAGCGTAGCGTTGACAAGACTCAGATTTATAACATGATAACACCTTATGGTAGAAAAACTGAGACGAATAAAGAAACCAAAAGAATCTCCGATCCAGTTACTATTCAAAATCCAGTTGTTGTTCCATCTACTAGAGTTGAAAAAAGGTATACTGGAGGTGACTTGACTTATGCAGGCCATACGTTGAGTGCTAGTTTGGTTCAAACCATCTTTAATCTTTGTATACAGCGAAATCTTTTGCCATCAGGCGTCATATCTCAGCTCTATCTTGAATCGTTCTGGGGGTCTTCTAATGTAGCTAGACGAGACAATAACTGGAGCGGCATGACTGGTGGTGCACAAACTCGCCCATCTGGTGTCATTGTAACAACGGGTAGTCCTAGACCAGCTAGCGAAGGTGGAACGTACATGCACTATGCTAGCGTTGACGACTTCATGAAAGACTACACTTATCTACTAGCAGAGCAGACGAGTGGTGGTCGTAAGATGTACGGTGTCAAAGGCAAGCAGAACATTGAAGAATACACAAAAGGGCTCTTCCGAATTGGAGGAGCTCTTTATGATTATGCTGCTGCTGGATACAACCACTATATCTATCTTATGCGAGATATTCGAAATGGTATCAACCGTTCAAATGGAAACATTTTGGATAAGTTAGATGATTTGTGGAGACAGCCAGACAATCAAATCACTCAACCAAACCAACCAGTAACGAGAACTGTTAAGGCAGATAAAGTTATCGCCGTCCTCAATGAAATGCAAGGGTTGAAAGGTCGTCGAGTAGGTAACGGTCAATGTTATGCATTAGCAGCTTGGTATTCTATGAAATTAGGTGGTCCAGGTCTCGGTGCTGGAGTTACTGGCAAGTCTGGTGCAATTGGTTCTGGTATGTGTGCATCCAATATTGGTACTGACTACGCTTGGGATAAGTTCGGTTGGAGTGTTGTTAGACCTAGCAGTGTTAACCAATTAAAAGCTGGGGCTATTGCTAATATCAAGGCATACAATAGTTATATAGGTACGTCTGTTTGGGGACACGTTTCAATTATCATCGCTAACAACGGTAGCACTGTTACGGTTCTAGAACAAAACTACGCTGGCCGTCAATACGTTGTCCAAAATAGCTATCCTGCTAGTGCTTATTTAGGATCTATTGAAACATTATGTTATCCTCCTGAATTGAAAGAGGGTAAAACGGTTGAGGGTAGGACTGAAACAGTTAGCGCTCTAAACGTTGAAGTTCAAAAGGTAGAGATTCCACCTATCGACGTTGAAGTAACATCTGAAAGCACAGATGCACTTACTATTGATAGCAAACGAAAGCAAGAATGGAAGAACGATAAAGGTCAAGTTGAGTTTTATCTTGAAAACGGTTCGCTATATGCTCCGATTTCAAAAGAACTATATCCATCCATTTTAACCGGTAAAGAGAATGGCGATAACTGGATACGGAAAGATATGGAAATAGACACGGACAGCGAAGACGTGCTTATTTCGACAGCTCTTAGAAACCTACGAAAATTCTGTTATCCAGCTATTACTTATGAGGTTGATGGTTTCATTGATTTAGATATTGGGGACACAGTTAAAATCCAAGACACTGGGTTCTCGCCTATTTTGATGCTTGAAGCTCGTGTCAGCGAACAACAGATTAGTTTCACTAATCCCGTCGAGAATAAGACGGTATTCGCTAACTACCAAGCACTTCAAAACAAAGTTTCAGACAGTTTATTATCCCGAATGACTAAATTGGCTGAGCAAGCTATTCCTTACGAGTTGAAACTTTCAACCGATAATGGGACTACATTTAAGAATAGTGTTGGTCAAAGCGTACTAAAAGCTTCGCTTGAAAAGAACGGTGTAGTTTATCAACCAATATTCTTCTATAAAAATGGCGATGCTATCATCGGTACTGGCAATCAGTTAGTTGTTAAACCAACAGATTTTGAAAATACTTTACAGGTAACTGTTGAAGCGTACCTTGACGACGAGTTAGTAGCAAGTACAGAAATCACATTCACAGATGTCTCAGATGGCGAACAAGGACCACAAGGTCCACAAGGTATAGACGGTAAAACGCCTTACGTTCACACGGCTTGGTCTTACAGTGCAGATGGTACAGATAGATTCACTACGGTTTATCCGAATTTGAACTTGATTGATGGTACAAGAGATTTCAGTGGTAATTGGGATAGAGATTGGGCTTGGTCAAATGATGGATCATACAAAGGATTAACCGTTAAAAAAAGAACTGATGAATGGCAGGGTATTAATAAAGAATTCAAGGCACCAAAAGATGGTACTTATACTTTCTCAGCTTATATTAAAACTTCAGGAAACACTGCTAATATAGCCAGACATATTCATTTAAACGGATCTTGGAATAAAGATACTTATAAGACTTTTAGAAATAACTTTGATTGGTTAAGAGATAGCTTCTCTGTAAACCTAAAAACTGGAGATACTATTTCTGCAAGATACGAATTACCAGGAGAAGGTATTTTATGGACCGCAGGCCATAAATGGGAAGAAGGTCCAGTAGCTACTCCATGGATGCCTTCCGCTTCCGAAGTCACAACTGCTGATTATCCAAAATACATTGGTCAATATACGAACTATATGGAAGTAGATAGTCCTAATCCTCAAGATTATACTTGGAGTCTAATTCGAGGGAACGATGGCAAGCAAGGTCCACAAGGTCCTAAAGGTGAAAGTGGTCCTCAAGGTTTACAGGGCCCTAAAGGCGACCAAGGAATCCCGGGACCAAAGGGTGAAGATGGTAAAACGCAGTATACCCATATAGCTTACGCTGATACTATTTCTGGTAGTGGATTTAGTCAAACAGATGTCAATAAACCATACATCGGAATGTACCAAGACTTCAATGCTGTTGATAGCCAAAACCCACAAGATTATCGTTGGAGCAAGTGGAAAGGTAGCGATGGACGAGATGGTATTCCGGGAAAACCGGGAGCTGACGGACGAACACCTTATGTTCACTTTGCCTATGCCGATAGTGCCGATGGTCAAAAGGGTTTCAGTTTAACCCAGACTGGCGCCAAGCGCTATTTAGGTGTGCTTACAAACTTCTTCAAAGAAGACAGTACTAATCCTTCTGATTACACGTGGAATGACACGGCTGGCAGTATATCCGTTGGTGGTCGGAACTTACTTGTAAAAACCAATCAAGGTATTACTAATTGGAATTGGCAGCTTTCCGATGGCGACAAGAGCGTTGAAGAAGTAAAAGTTGATGGCATTCGTGCTGTAAAACTAATCAAAGGTTCAACAACAGCAAACACTGGTTGGAATTTCATTGAATATAATGGCTTGCTGCGTGAACTCATACAGCCGAAGTCAAAGTATGTTCTTTCGTTCGATGTTAAACCAAGTGTTGATGTAACTTTCTATGCAACGCTAACAAATGGAGACTTTACAGAGACGCTGACTGATACTGTCGCTATGCATAAAGCATTAGCCAATCAGTGGAATAAGGTATCGTGCGTTTTGACAAGCAAAGAAACTTTGCCAAATATTGCATGGCAGACTGTATACTTAGCAGGTATGCCAACAACAAACGGCAATTGGGTAATAATTAAAAATATCAAACTTGAAGAAGGTGACATACCTACTCAGTGGACACCTGCAATTGAAGACATACAAGATGAAATTGATTCCAAAGCCGATTCTGCTATGACGACTGAACAGATTAATGCGCTTAATGAAAGGGCTGCAATTATTCAAGCAGAGACGGAAGCTAGAGCAAGCGCTGAAATTTTGAATAAATGGATTAAAAATTACCAAGATTTCGTCAAGGCAAACGAGACCGAGAGAGCTGCTGCCGAGAAAGCTTTGGTTAGCTCAAGTCAGCGGGTATCAACCATTGCTAAGGAGTTAGGTGAACTGTCTGATCGTTGGAATTTCATCGATACTTACATGAACACATCGAATGATGGGCTTGTGATTGGAAAGAATGACGGTAGCTCAAGCATTGTGTTCAACCCTAACGGTCGAATTTCAATGTATTCAGCAGGGTCTGAAGTTATGTATATTTCTCAAGGTGTAATCCACATCGAAAACGGTATCTTCTCGAAAACAATCCAAGTTGGTCGATATCGTGAGGAACAATACCATCTCAACCCAGACATGAATGTCATTCGTTATGTAGGAGGTTTTTAA

Genome Context

Tertiary structure

YP_010683231.1
ColabFold structure
Source ColabFold
pLDDT 80.8
Oligomeric state monomer