Genbank accession
YP_007003420.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,56
TF
Evidence RBPdetect2
Probability 0,80
Seq2Symm
C3 confidence 0,992 truncated
C3 0,992
C1 0,087
C7-C9 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MPQLKLRYNGRWVTIGGGLSGGDTGEIVDYIDQIKKELQNNLEKISTDLNNTDIYIDGAFRDGIITETEAKKIKAYLNTLNTSKVQLDQRFEEIYKNIYLPAFNKEGLVSANNTYQTAYENLHKTILDAIVDGKATEEESNAVDTAFDVYTRALSLLVSALEVSVDAINNAKNKETLDNSKKYTDDLYVPLDERVVKAESEIKTTKEQISLRVTKEEFTQGLNNNLDSAKQYSDTQKKALETDLSTLRGDLQETDEYINGAFRDGIVYDSEKIQIEGYLNTIKTSKSQYDNRYQSVHDNSYLPETPKLNLESAKTDYDTKYNMLVLAITNAIDDQLADDDETAKVNAAFDAYNQALALLTLSLEVAIDAISKAKAEEARKLAEGYADELKQGLDKDIANVQQSIKETDDYITHAFRDGLVSETEAKRIEGYLLGLAQNHQAIMERYTEIYENPMLAGTAKTDLYQKQTDYATAYDSLVTTINDATSDGQTTAEESNNVQLKFYDYNNRFKELTKAIETAIDFISTSKANKSEENSKDYTDGKVTPIETRLTTAESNITQNAKEISLRVKEETYNQGMQLVDGIDTRLKSAESTIVQHADAISQRVTIENFDTKAKQLQLDADNARKAADAAQQTADAAKSGVDDAVKSISDLTSDNKLSQSEKTEAKREWEAIKAEKITLEKQATDYGITTAKTNYIAAYNSLEAFLTPLIADLSTISDVDGETFRAKFKAYYDTRSTLLQAIASASKKQSDDLDTRLTNLKYVNANILAGSMFGEGDVLPIDSGTVVRVQPNDGDVNSLQVKQYSPSSAVYGFKTTRQTTEFKTGTVYTLSMQVAIGDVTKLDEIYIKSAEGGSQKLPSIPITWSDTAYRTVTLTFTSNISTSRGYIQVATADLSSTRIEYFYIKKLKIEEGGVATPYIPSGADTGTLGSQVAKAESEIKQNAEQIQLRVSKTDFNGKNVVSMINQTADEVLIEASKIKLNGDVNVGGFSNYVQDPDCEKALSLNWTVTSTGSGGFSYAVLPTNDVPPAGEPNFPPPTRYGIKLQVNEKKLYEMKQPKFDVEPGTPLAISCYTYKKLNETAIYSGWFAVNFYNARGSLLQDEFYVPLRGNDDEPLWSLVRAEMKVPATAAKAEVYIRFKPLADEEYPLTYYIGSPKVSKPGTMDVDSIYSYLVYSQRVTVNKTLDFGYRGNIKQQGYLAPYGDIKMQDGVLTSTKSDYKLHIGNGHISAVKYYDIDSDSLNPRMILDAVGLHAFSSGSNKNAMFSTDGNLEMYRDAAIVFKSSPSSMTFNKYGNLTPTTPSSASATASWNVGHVNGGNVIKAFFGSSGGSNNAYGIQLIPGGSGNGFEFVNLDSTNIGMKGPNQIIKFLGRSSTTQFRNRADSDYASITVGGLTNHSYRDSKTGIEKSTMNASDIIKNLIVREYYKGSDLVVKDECGNDLYCELPDSTVLLSPKKQIGLIWDEAADCIRNPDGIDLYKFCTLLLKALQETDERLTAGGL
Physico‐chemical
properties
protein length:1500 AA
molecular weight: 165614,62770 Da
isoelectric point:4,88960
aromaticity:0,08533
hydropathy:-0,48487

Domains

View on InterPro
YP_007003420.1
1 1500 aa

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Phage

Coding sequence (CDS)

Genbank protein accession
YP_007003420.1 [NCBI]
Genbank nucleotide accession
NC_019487 [NCBI]
CDS location
range 87255 -> 91757
strand +
CDS
ATGCCGCAACTAAAACTAAGGTACAACGGTAGATGGGTTACAATTGGTGGAGGTCTCTCAGGCGGAGATACGGGAGAAATTGTAGACTACATCGATCAAATCAAAAAGGAACTTCAAAATAATCTTGAAAAAATATCAACAGACCTTAACAATACTGATATCTACATTGACGGCGCTTTTCGAGACGGTATTATAACAGAAACTGAAGCCAAGAAAATAAAGGCATATCTTAACACTCTTAATACCTCGAAAGTACAGCTTGACCAGCGTTTCGAAGAGATTTATAAAAATATATACTTGCCGGCTTTTAACAAAGAAGGACTAGTGAGCGCGAACAACACTTATCAGACAGCTTACGAGAACCTTCATAAAACAATTTTAGATGCTATTGTTGACGGAAAAGCGACTGAAGAAGAGTCAAACGCTGTAGATACTGCGTTCGATGTTTATACAAGAGCTCTGTCCCTTCTTGTCTCAGCATTAGAAGTCTCAGTTGATGCTATTAACAACGCAAAGAACAAAGAGACGTTAGATAACTCCAAAAAGTACACTGATGACCTTTATGTTCCATTAGACGAGAGAGTTGTAAAAGCTGAATCTGAGATCAAAACAACTAAGGAGCAGATTTCTCTTAGAGTTACTAAAGAAGAGTTTACACAAGGGTTAAACAACAACTTAGACTCTGCTAAGCAGTACTCTGATACGCAGAAAAAGGCTCTCGAGACCGACTTGTCAACTCTTCGGGGAGACCTTCAGGAAACAGACGAATACATCAATGGAGCGTTTAGAGATGGAATTGTATACGACTCCGAAAAGATACAGATTGAGGGGTACTTGAATACGATCAAAACTTCAAAGAGTCAGTATGATAATCGTTACCAAAGTGTTCATGATAACTCATATCTCCCAGAGACCCCTAAACTAAACCTGGAGAGCGCTAAGACAGACTACGATACGAAATATAACATGCTTGTACTAGCCATTACAAATGCTATTGACGACCAGCTAGCGGACGATGACGAAACGGCCAAAGTCAACGCAGCCTTTGACGCTTATAACCAAGCGTTAGCGCTTCTTACCCTATCTTTGGAGGTCGCTATAGATGCGATTAGCAAAGCGAAGGCAGAAGAGGCTAGAAAGCTTGCAGAGGGCTACGCTGATGAGCTGAAGCAAGGGCTAGACAAAGACATTGCGAATGTACAACAGTCGATTAAGGAAACTGATGATTATATTACCCATGCGTTCCGGGATGGACTAGTTAGTGAGACAGAAGCCAAACGAATCGAAGGTTACTTACTAGGTTTGGCTCAGAATCATCAAGCTATTATGGAGCGTTACACAGAGATTTATGAGAATCCAATGCTAGCTGGAACAGCGAAGACTGACTTGTACCAAAAACAAACTGATTACGCGACGGCTTACGACTCACTTGTAACGACAATAAATGACGCGACATCAGACGGTCAGACAACAGCGGAAGAGAGCAACAATGTTCAACTAAAGTTCTATGACTATAACAATAGGTTCAAAGAGCTTACAAAGGCGATAGAGACAGCCATTGACTTCATCTCTACATCAAAAGCGAATAAATCAGAAGAGAACTCAAAAGATTACACAGATGGGAAAGTAACACCAATTGAAACCAGACTCACAACTGCAGAGTCAAATATAACTCAAAACGCAAAGGAGATATCGCTGAGAGTTAAAGAAGAGACATATAATCAAGGTATGCAACTAGTCGATGGAATTGACACACGTCTTAAGTCGGCAGAGTCAACTATTGTTCAACACGCAGATGCAATCAGTCAGCGCGTTACGATAGAGAATTTTGATACAAAAGCAAAACAGCTACAACTAGATGCTGACAACGCGAGAAAAGCGGCAGACGCAGCTCAACAAACAGCGGACGCGGCCAAGTCTGGAGTAGATGACGCGGTCAAATCAATCTCTGACTTAACATCTGACAACAAGTTGTCTCAATCTGAAAAGACTGAAGCTAAACGTGAGTGGGAAGCGATCAAAGCAGAAAAGATAACACTCGAGAAACAAGCAACCGACTATGGAATAACGACAGCAAAGACTAACTATATCGCTGCTTACAATTCTCTCGAGGCGTTTTTAACTCCTCTGATTGCAGACTTGTCTACTATATCTGACGTCGATGGCGAGACGTTCCGAGCGAAGTTCAAGGCTTACTATGACACTCGCTCTACGCTACTTCAGGCAATCGCATCGGCTTCTAAAAAGCAATCTGACGACTTAGACACTAGGTTAACAAACTTGAAGTATGTAAACGCCAACATACTTGCTGGATCAATGTTCGGGGAAGGAGATGTCCTTCCTATTGATTCAGGTACTGTTGTTAGAGTACAGCCAAATGATGGCGATGTTAACAGCTTACAAGTAAAGCAGTACTCTCCTTCTTCTGCGGTCTATGGATTTAAGACTACTAGACAGACAACTGAGTTTAAAACAGGAACTGTATACACCCTGTCAATGCAAGTGGCTATTGGAGACGTTACAAAACTTGATGAGATTTATATTAAGTCTGCTGAGGGAGGATCTCAGAAGCTGCCTTCAATCCCCATAACTTGGTCTGATACTGCGTATAGAACTGTAACACTCACGTTTACAAGTAACATTTCAACGTCTAGAGGTTACATTCAAGTCGCAACAGCAGACTTAAGTTCAACAAGAATCGAGTATTTCTATATCAAAAAGTTGAAGATTGAGGAAGGCGGTGTTGCGACACCGTACATCCCTTCTGGCGCAGACACGGGTACGCTTGGAAGTCAGGTAGCTAAGGCTGAGTCTGAAATAAAGCAAAACGCAGAGCAGATACAGTTGAGAGTTTCAAAGACCGACTTTAATGGTAAGAACGTAGTATCTATGATTAACCAAACAGCCGACGAAGTTCTCATTGAGGCCAGCAAGATAAAACTAAATGGGGACGTTAATGTCGGGGGTTTTTCAAACTATGTACAAGACCCTGACTGCGAAAAAGCTTTATCTCTGAACTGGACAGTAACGTCGACAGGTTCAGGAGGATTTTCATACGCAGTCCTGCCGACAAACGATGTACCGCCGGCAGGTGAACCAAACTTTCCCCCGCCAACCAGATATGGAATAAAATTACAAGTCAACGAGAAGAAGCTTTACGAAATGAAACAGCCAAAGTTTGATGTTGAGCCGGGAACTCCATTGGCTATTAGCTGTTACACTTATAAAAAGCTAAATGAAACGGCCATATATTCCGGATGGTTTGCGGTTAACTTTTACAACGCAAGAGGTTCATTACTGCAAGACGAGTTTTATGTACCATTGAGAGGGAACGACGACGAACCTTTATGGTCACTAGTAAGAGCCGAGATGAAAGTTCCGGCAACAGCTGCGAAAGCAGAAGTGTATATAAGGTTCAAACCACTAGCAGATGAGGAGTACCCATTAACTTACTATATTGGTAGTCCAAAGGTTTCTAAACCCGGTACGATGGATGTTGACTCTATATACTCTTATCTAGTTTACTCTCAACGTGTTACAGTTAACAAAACGCTAGATTTTGGGTACAGAGGTAACATAAAACAACAAGGTTACTTAGCGCCTTATGGAGACATAAAGATGCAAGATGGAGTGTTGACTTCTACAAAGAGTGACTACAAGTTGCACATCGGTAACGGGCATATCTCTGCTGTTAAGTACTATGACATTGATAGCGATTCCTTGAATCCGAGGATGATACTAGACGCTGTTGGACTACACGCGTTCTCGTCAGGCAGCAATAAGAACGCTATGTTTTCAACTGATGGGAATCTGGAGATGTATCGCGACGCGGCGATAGTTTTCAAATCTTCACCGTCTAGTATGACTTTTAACAAATATGGGAACTTGACTCCAACAACACCTAGCAGCGCTTCTGCAACAGCAAGTTGGAACGTTGGTCACGTAAATGGTGGGAATGTAATCAAAGCTTTCTTCGGTTCAAGCGGAGGAAGTAATAACGCTTATGGAATTCAACTTATCCCGGGAGGGTCAGGTAACGGATTTGAGTTCGTAAATCTCGACAGCACGAACATCGGCATGAAAGGTCCAAACCAGATTATTAAGTTTCTAGGCAGGAGCAGTACAACACAGTTTAGAAACAGGGCTGACTCTGACTACGCCTCAATAACTGTCGGAGGATTAACGAACCACTCGTATCGAGACTCAAAGACAGGGATTGAAAAATCTACTATGAACGCGTCAGATATTATTAAAAACCTCATTGTAAGGGAGTACTACAAAGGGTCAGACTTAGTTGTAAAAGACGAATGTGGAAACGATTTATATTGTGAGTTACCTGACTCTACAGTGTTGTTGTCACCCAAGAAGCAGATTGGGTTGATCTGGGACGAAGCTGCGGATTGTATACGAAACCCAGATGGAATTGATTTATACAAGTTCTGTACGTTGTTACTAAAGGCGTTACAGGAGACAGATGAAAGACTAACTGCAGGAGGCTTATAA

Genome Context

Tertiary structure

YP_007003420.1
ESMFold structure
Source ESMFold
pLDDT 62.6
Oligomeric state monomer