Genbank accession
YP_010742498.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,87
TF
Evidence RBPdetect2
Probability 0,92
Seq2Symm
C3 confidence 1,000
C3 1,000
C1 0,001
D3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAAGTLSVTNNSKAVVGVGTTFTAFKAGDFLTLVVGQVPYTVAIASIESATALTLVLPFDGPTATGLAWDGVKRDTMSLATMGVTVQAQKALRLMIADENNWRAIFGEEEEISVTLPNGQVVQGMSWGYLSKLLKDVDPVELQAIADQTITAKNQAQGFRNEAEGFKNTANTAKTAAEAAQGKAETAKTAAESAKTAAETAKSQAVTAKSQAVTAKDQAKGFRDEAEGFANSADASQKVPYAGVTVNAPTGVRDMLKRLRDAVKGGFWRVDDISQFQAGEMTPFRYGPGVCGGAGDTFFAINVDWQTSRVKVFSGNNAAINGSSGRVSAIELAKLGSNGDVAIGDGGTGASNDQGARANLQAMHERRATLVSEDLNDLQGDKAGFYYTGLSANATPERNYPFQEAGCLLVQRTGANDPKSCVQTYTLYRNGRRWIRWLDNAATGIWSQWYELYNAGSSPTFSGVITGSAVRASVDGKIITIKPGAKDVFVHNSASNKYFQLRDNGELAYDNNLIAYNGLAASGTFAMTVPSIKVITANGGFRIDGTASTNDQPLHVTGYNSAGTRLWFLGKDTGTNALFLNDITSCKVELIKDGVVLGTKNFAGKAYVQAASLEINRPSGKYFKMQNDGNSSHPATFKLWGNGAGRPSVIEFGLDDGPGWLFYAQYNSNGTRQMSVNGTVNCTTVNQSSDRELKDNIKPIENARAGLAKMGGYTYTLKKDGMPYAGVIAQEVMDVVPEAVSTFEDHEYLAGPTQDGEELVGRQRFFQVDYGAIAAYAVQVCKEQEEELVSLRSELEELKAAVAALSKA
Physico‐chemical
properties
protein length:808 AA
molecular weight: 86127,26690 Da
isoelectric point:5,54853
aromaticity:0,08540
hydropathy:-0,26510

Domains

View on InterPro
YP_010742498.1
1 808 aa
STR 366–453 · CHP 689–795 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_010742498.1 [NCBI]
Genbank nucleotide accession
NC_073088.1 [NCBI]
CDS location
range 8458 -> 10884
strand -
CDS
ATGGCAGCGGGTACTCTATCCGTAACGAATAACAGCAAGGCGGTTGTAGGGGTAGGCACAACGTTTACCGCGTTTAAAGCTGGTGACTTCTTAACGCTGGTGGTAGGACAAGTCCCCTACACCGTAGCGATCGCGTCCATTGAAAGCGCAACCGCGCTCACGCTGGTGTTGCCGTTCGACGGCCCAACGGCAACCGGCCTTGCGTGGGATGGCGTTAAGCGCGATACCATGTCGCTGGCGACGATGGGCGTAACCGTCCAGGCGCAAAAAGCGCTGCGATTGATGATCGCAGATGAGAACAACTGGCGCGCAATCTTCGGAGAAGAAGAGGAAATCTCGGTCACGCTGCCGAACGGTCAAGTAGTGCAGGGCATGTCGTGGGGCTACCTGTCTAAACTGCTTAAAGATGTAGACCCGGTTGAATTGCAGGCTATCGCAGACCAGACCATCACGGCTAAAAACCAGGCGCAAGGCTTCCGTAACGAGGCGGAAGGATTCAAGAACACCGCGAATACAGCTAAAACAGCGGCGGAGGCCGCACAGGGCAAAGCCGAGACAGCTAAGACGGCAGCCGAGTCCGCAAAGACTGCCGCGGAGACAGCTAAGTCGCAGGCCGTAACTGCTAAGTCGCAGGCCGTAACTGCTAAAGATCAGGCAAAAGGATTCCGCGACGAGGCAGAAGGCTTTGCGAACAGCGCGGACGCCTCGCAGAAAGTGCCGTATGCGGGCGTCACCGTAAACGCTCCGACTGGCGTGAGGGATATGCTAAAGCGGTTGCGCGATGCGGTCAAAGGCGGTTTTTGGCGCGTTGATGATATTTCGCAGTTCCAAGCCGGTGAGATGACCCCTTTCAGATACGGACCCGGTGTATGTGGCGGCGCGGGGGATACATTCTTTGCAATCAACGTTGACTGGCAAACCTCGCGCGTTAAAGTTTTCTCGGGAAACAATGCCGCGATTAACGGATCGTCTGGAAGGGTTAGCGCTATTGAGCTTGCGAAGCTGGGGTCAAATGGGGACGTGGCGATCGGAGACGGTGGGACAGGTGCGTCAAACGACCAGGGCGCGCGCGCCAATCTTCAGGCAATGCACGAGCGCCGGGCAACGTTGGTAAGCGAAGACCTTAACGACCTTCAGGGTGATAAGGCCGGATTTTATTATACTGGCCTGAGTGCCAACGCAACGCCGGAGCGTAATTATCCCTTTCAGGAAGCAGGTTGCCTACTTGTTCAGCGCACTGGCGCTAACGACCCGAAGAGTTGCGTACAGACGTACACATTATACCGCAACGGGCGGCGCTGGATTCGATGGCTAGACAACGCGGCTACTGGAATATGGTCGCAGTGGTACGAGTTGTATAACGCAGGGTCGTCGCCGACTTTTTCTGGAGTAATTACTGGATCTGCGGTGCGCGCTTCCGTTGACGGAAAGATCATAACTATTAAACCTGGCGCCAAAGATGTATTTGTTCACAACTCGGCATCTAATAAATACTTTCAACTTCGTGACAACGGCGAACTGGCGTATGACAACAATCTGATCGCGTATAACGGGCTTGCAGCCAGCGGCACATTTGCTATGACCGTACCCAGCATTAAAGTTATAACCGCTAATGGCGGATTTCGTATCGACGGAACAGCGTCAACAAACGACCAACCACTGCACGTAACAGGGTACAACTCCGCAGGCACACGTCTTTGGTTTTTAGGGAAAGACACTGGGACGAACGCCTTATTCCTGAACGATATTACATCGTGTAAGGTTGAGCTGATCAAGGACGGCGTTGTGCTTGGTACAAAGAATTTTGCGGGTAAAGCATACGTTCAGGCCGCAAGTTTAGAGATCAACCGTCCGAGTGGCAAGTATTTCAAAATGCAGAACGACGGCAACTCGTCACACCCAGCAACCTTCAAATTGTGGGGTAACGGGGCAGGTCGCCCGTCGGTTATTGAGTTTGGGCTTGACGATGGTCCGGGGTGGCTTTTTTACGCCCAGTATAACAGCAACGGCACGCGCCAGATGAGCGTTAACGGGACGGTAAACTGCACGACGGTAAACCAGTCATCGGACCGCGAGTTGAAGGACAACATCAAGCCGATCGAGAACGCTCGCGCGGGCCTTGCTAAGATGGGCGGTTACACCTACACCCTGAAAAAAGACGGTATGCCTTACGCCGGGGTTATTGCGCAGGAAGTAATGGACGTTGTGCCGGAAGCAGTGAGCACGTTTGAGGACCACGAATACCTCGCAGGGCCAACGCAAGACGGAGAGGAGCTGGTGGGTCGTCAGCGCTTCTTTCAGGTCGACTATGGCGCTATTGCCGCTTATGCAGTGCAGGTGTGCAAAGAGCAGGAAGAAGAACTGGTGTCGTTGCGTAGTGAACTGGAGGAATTGAAAGCTGCCGTAGCGGCGCTGTCTAAAGCATAA

Genome Context

Tertiary structure

YP_010742498.1
ESMFold structure
Source ESMFold
pLDDT 68.0
Oligomeric state monomer