Genbank accession
YP_010674083.1 [GenBank]
Protein name
tail fiber protein host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,90
Seq2Symm
C1 confidence 0,111
C1 0,111
D3 0,001
C2 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MALYPIKSLGAVGVIADQAPTDLAPNAFTNAINARFVEQRVFKTGGNAPLSYVDEDKDLTPLSFVSMPFDYYSAGNSFLVVGTDKKLYKLTDESLTDISRKVATVTKKASASIKIYPVVSQIVPKESTISMNFNQTKNLEVSLLPADANNTDLIWEVSNSSYGSIAVDPSDSKLATLTSFEKEGNLVVTISTANESVVAQIAVNIIDGDSGIFLSQDTVTIRKGGTTTLTAVTGKTPVTWSSNNASIVSVTPNANSLTAVITANGEGNVTITADNGTKIASCEVVSIPQIDSISLSQSDVTVSRGSQYILTATLSPANAPNQNITWTSSNPNIATVSGTSTQGTINALLAGFTEITATTEEGNRVAVCTVRVDLAGRTMRTSAMAFAAPVSESVETQEEEVVTPPESEETVYFAEPTSGIDTSGMYEGNNFYDYSNVNDIEGFARASLLATPLSSVTLDIVSASLDVGEEIVITATASPEGEYSYQWSVDKTGYVSTTSVTGKSIKLVALRKGEINVTCTVSQMTQKDYDAFDDYPWYHAVISNCAVATTHYETPQVKEFESEYFVDLPGWGEQTVVDNDGNPSVKKFNWKCERVRSFNNRLFALNMREANASGVTTNYPLRLRWSNFANENKAPTLWDDFAYDRVVSSDLASNIVGQTQALENGYAGYIDLADSNGSLIDILPLKDYLFVYTEFETYIGSPTNNTYQPLMFKKLFNDSGILAPECVVEVEGSHFVVTQNDVILHNGATKKSIASNRVKNMLINEVCLVNPLATRVHLHQDKKEVWVLYVGPGEPKESFACTKAAVWNYEFDTWSFRTIPYAQCIGLVDPPVLERGPIWSDFQEITWDDPSIKELVWRKDATNFRQRVTIVGSFLKGFYQVDVGALDYFYDRLNDVVIEKPLEMRLERTGIDFDNVTNEWNQKHINRFRPQTTGSGTYIFEAGGSQFSNEYGHPHTSKTYTIGVDRHVSVRLNHPYLFYNVIDNDVNSNAAINGLTIEFAVGGRR
Physico‐chemical
properties
protein length:1005 AA
molecular weight: 110233,75100 Da
isoelectric point:4,72948
aromaticity:0,09552
hydropathy:-0,19920

Domains

View on InterPro
YP_010674083.1
1 1005 aa
STR 117–373 · STR 452–531 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_010674083.1
1 1005 aa
Domain Start End Length (AA) Confidence
N-terminal 1 865 865 0,8495
Central domain 866 994 130 0,1907
C-terminal 995 1005 10 0,9901
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_010674083.1 [NCBI]
Genbank nucleotide accession
NC_070990.1 [NCBI]
CDS location
range 22953 -> 25970
strand +
CDS
ATGGCGCTGTATCCAATAAAGTCACTAGGTGCTGTAGGCGTTATCGCTGATCAGGCTCCGACAGACTTAGCTCCTAATGCTTTCACTAATGCTATAAATGCTCGATTTGTTGAGCAGAGAGTATTTAAGACGGGGGGCAATGCCCCTCTTTCTTATGTAGATGAAGATAAGGATTTAACCCCTCTGTCTTTCGTTTCTATGCCTTTCGATTATTATAGCGCAGGTAATAGCTTTCTTGTTGTAGGTACGGATAAGAAGTTATATAAACTGACAGATGAAAGCTTGACTGATATTAGCCGTAAGGTTGCTACAGTCACTAAGAAGGCTTCTGCCTCAATTAAGATTTATCCAGTTGTTTCTCAGATCGTTCCTAAAGAATCAACTATCTCAATGAACTTCAATCAGACCAAGAATCTAGAGGTTTCTCTTCTCCCTGCTGATGCTAACAATACTGATCTTATTTGGGAGGTTAGTAACTCATCCTATGGAAGTATTGCGGTAGACCCTAGTGACTCTAAACTTGCTACTCTAACATCTTTTGAGAAAGAGGGTAATCTTGTAGTAACTATCTCTACTGCCAATGAATCCGTAGTGGCTCAGATTGCTGTTAATATTATCGACGGTGATTCAGGCATCTTCTTGAGTCAAGACACTGTTACAATTCGTAAAGGGGGGACTACTACTCTCACGGCTGTTACTGGCAAAACTCCTGTAACTTGGTCCAGCAATAACGCTTCTATTGTATCCGTAACCCCTAACGCCAACTCTTTAACTGCTGTCATTACAGCGAATGGAGAAGGTAATGTAACAATCACTGCTGATAACGGAACGAAGATTGCTTCTTGTGAGGTTGTTTCCATCCCTCAGATTGATAGTATCTCTTTAAGCCAGTCAGATGTTACTGTTAGTAGAGGTTCTCAGTATATCTTAACTGCTACCCTTTCTCCTGCTAACGCCCCTAATCAAAATATTACTTGGACCTCTTCTAATCCAAATATTGCAACAGTATCAGGGACTAGCACACAAGGGACGATCAACGCTCTACTTGCTGGTTTTACTGAGATTACAGCTACCACTGAAGAAGGTAACAGAGTTGCTGTCTGTACTGTACGTGTGGATTTAGCTGGAAGGACAATGAGAACAAGTGCTATGGCATTTGCCGCTCCTGTGTCAGAGTCAGTAGAAACTCAAGAGGAAGAAGTAGTAACTCCTCCTGAAAGTGAAGAGACGGTTTATTTTGCTGAGCCTACATCCGGTATTGATACGTCAGGGATGTACGAAGGTAATAACTTCTATGACTACTCTAACGTGAATGACATTGAAGGTTTTGCAAGAGCTTCTTTACTGGCAACCCCTTTGTCATCTGTAACCTTAGATATTGTCAGTGCTTCTCTTGATGTTGGTGAAGAGATTGTCATTACAGCCACAGCTTCTCCAGAAGGTGAGTACTCTTATCAGTGGTCTGTTGATAAAACTGGTTATGTTTCTACAACCTCAGTTACTGGTAAATCTATCAAACTGGTTGCTCTTCGTAAAGGGGAGATTAATGTAACATGTACTGTCAGTCAGATGACTCAGAAAGATTACGATGCTTTTGATGACTATCCTTGGTATCACGCTGTTATCTCTAACTGTGCAGTTGCTACAACTCACTATGAAACTCCTCAGGTAAAAGAATTCGAATCAGAATACTTTGTAGACCTTCCGGGATGGGGTGAGCAAACAGTTGTGGATAATGATGGAAACCCTTCAGTCAAGAAGTTTAACTGGAAATGTGAGAGAGTAAGATCTTTTAACAACCGTCTTTTTGCTCTGAATATGAGAGAGGCTAATGCTTCTGGTGTTACCACTAACTATCCGCTTCGTCTTCGTTGGTCTAACTTTGCCAATGAGAACAAGGCTCCTACACTGTGGGATGACTTTGCCTATGATCGAGTTGTGTCTTCGGACTTAGCTTCTAACATCGTAGGGCAGACTCAGGCTCTAGAGAATGGGTATGCTGGTTACATTGACTTAGCTGACTCTAATGGTAGCTTGATTGATATCCTGCCTCTTAAAGATTACTTGTTTGTTTATACAGAGTTTGAAACGTATATTGGTTCTCCAACTAATAACACGTACCAACCTCTAATGTTCAAGAAGCTTTTTAACGACTCTGGTATCCTTGCTCCTGAGTGTGTGGTTGAAGTAGAAGGTAGTCACTTCGTAGTTACTCAGAACGATGTAATCTTACACAACGGTGCAACTAAGAAATCAATTGCATCTAACCGTGTCAAGAACATGCTGATTAACGAGGTGTGTCTGGTTAATCCTTTAGCAACTCGAGTACACTTGCATCAGGATAAGAAAGAGGTTTGGGTTCTGTATGTAGGTCCGGGGGAGCCAAAAGAAAGCTTCGCTTGTACTAAAGCTGCTGTATGGAACTACGAGTTTGATACTTGGTCCTTCCGTACTATCCCATATGCTCAGTGTATTGGTCTGGTTGATCCTCCTGTTTTAGAAAGAGGTCCAATCTGGTCCGACTTCCAAGAAATCACTTGGGATGATCCATCTATTAAAGAACTCGTTTGGAGAAAGGATGCAACAAACTTTAGACAGAGGGTTACGATAGTAGGTTCATTCTTGAAGGGATTCTATCAAGTGGATGTGGGTGCTCTTGATTACTTCTATGACAGGCTAAATGATGTTGTTATAGAGAAGCCTCTGGAAATGAGGTTGGAGAGGACTGGTATAGATTTTGATAATGTGACGAATGAGTGGAATCAGAAGCATATTAACAGGTTCCGACCTCAGACAACTGGTTCAGGTACTTACATATTTGAAGCTGGTGGTAGTCAATTCTCAAATGAATATGGACACCCACACACATCTAAGACATATACGATCGGTGTTGACAGGCATGTCTCGGTGAGACTGAACCATCCATACCTTTTCTATAATGTTATAGATAATGATGTTAATAGTAATGCTGCTATCAATGGTTTAACGATAGAGTTTGCTGTTGGCGGGCGGAGATAA

Genome Context

Tertiary structure

YP_010674083.1
ESMFold structure
Source ESMFold
pLDDT 77.3
Oligomeric state monomer