Genbank accession
XNS37842.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,53
Seq2Symm
C1 confidence 0,997
C1 0,997
C2 0,004
C3 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MYPIPLFMSTTSASVVTATSITTSSIGIAIVGSKKQLTYTVSPEDGALFDIAFSSSDNTKMVIDNSGMMEFVAEGGFDAIMTAKNNLGAVLTDQSGGYASELSVYTESLSAMDVGTTQQLVATISPEGAKDLPDMVITYTTTDPEVATVSPTGLITALKDGNCRIGCTATYQGTVVASDSSYLGVNAIPVISNVTAVANSYGDVRVAWDVADPLDGDTYTVEVLDLSNNSVQWTTTTTNTYAYFDISDSIPLYGFAPTYLKISVKSTKAAAVIFNNSIATDDSFIKEVIVFAGQDNVNAHFTELSGANKAAMSSTTARNAYATQRGLANAEVLPLNTASGSSAADKYADDKAGTGTPDNYWYDLDNTADGPCLTNFITKVTPYASKVKAIIWGQGENDAVSASSTVAGRYSNTTRYHDATIAIFDKMRTIVPASQAKIVWQILGRSYLYGVEVNGVDWQKYRNVQRTISTARDDVIIGSWVDGAERYSGYVYEEGIDGRIHYISSVYQTAATKLAKSAADGTDLTSTSPVWVDMAVPTGATATSQSNQDTILAWDAQGYSKHYFRNINVLTASVLTEQTLNTNSYTFTYADQVEQYGFAAGTTIFDVAYYDEANDVLSPLVRFNVNVTAGTVEDKPVVMDYDLTQETLPSDVKVNGGNSFARASGDILVATNTLVAPLEYVGTTPVGRRVTANTATQIFVNNALTSASPWVKTNLTVAASSDNSPAGTTANVFKLTPTTTSGSHILTATYTNAYNINAGRNWSASVFLKANGITKAKLRLKAGTEVNEGTFDLAAGTFTGSEANIISMGNGWYRAILHKTGIAKQSFISFEIIALDATGAEIFAGDGTSNLAVWLPQLEGASTGETSKAGSPYVCTYPGNLGGVSFTIPRNGHTGVDVYYSNGDVVRDVFSGTASTWTINYSSLYDWGSVFITGLKYYD
Physico‐chemical
properties
protein length:939 AA
molecular weight: 99906,66940 Da
isoelectric point:4,59085
aromaticity:0,09904
hydropathy:-0,06379

Taxonomy

Phage
Escherichia phage Antha [NCBI] · taxon 3233687

Coding sequence (CDS)

Genbank protein accession
XNS37842.1 [NCBI]
Genbank nucleotide accession
PP925826 [NCBI]
CDS location
range 69118 -> 71937
strand -
CDS
ATGTATCCTATTCCTTTATTTATGTCAACAACATCAGCTTCAGTAGTAACAGCTACATCTATAACCACTTCCTCTATTGGTATTGCAATAGTTGGTAGTAAAAAGCAACTGACATACACAGTTTCACCGGAAGATGGTGCGTTATTTGATATAGCTTTTTCATCTTCAGATAATACCAAAATGGTTATAGATAATAGTGGTATGATGGAGTTTGTTGCCGAAGGTGGTTTTGATGCAATAATGACAGCTAAAAATAATTTAGGTGCTGTCTTAACTGATCAATCTGGGGGTTATGCTTCAGAATTAAGCGTGTACACTGAAAGTCTCTCAGCTATGGATGTAGGCACTACTCAACAGTTGGTTGCTACAATCAGTCCAGAAGGTGCTAAAGATCTTCCAGACATGGTAATTACGTACACCACAACAGATCCAGAAGTAGCTACTGTAAGCCCTACAGGATTAATAACTGCTCTTAAAGATGGTAATTGCCGTATAGGTTGTACTGCAACTTATCAAGGAACAGTGGTGGCCTCTGATAGTTCTTATTTAGGTGTTAATGCTATTCCTGTTATTTCTAATGTAACAGCCGTGGCAAACAGCTATGGAGACGTTCGTGTTGCTTGGGATGTAGCTGATCCGCTAGATGGTGATACTTATACTGTAGAAGTATTAGATTTAAGTAATAATAGTGTTCAGTGGACTACAACAACCACGAATACTTACGCTTACTTTGATATCTCTGACTCTATTCCTCTTTATGGGTTTGCTCCAACATACCTTAAAATTAGCGTTAAGAGCACCAAAGCAGCAGCCGTTATCTTTAATAACTCAATAGCTACAGATGATTCGTTCATTAAAGAAGTTATTGTCTTTGCTGGACAAGATAACGTAAATGCACACTTTACAGAACTATCTGGTGCAAATAAAGCAGCAATGAGTAGCACAACAGCCCGTAATGCATATGCCACGCAACGTGGTTTAGCAAATGCTGAAGTTCTTCCGTTAAATACAGCTTCTGGATCATCAGCAGCAGATAAATATGCAGATGATAAAGCCGGAACAGGAACACCAGACAACTACTGGTATGATCTGGATAACACAGCAGATGGGCCATGCTTAACTAACTTTATCACTAAAGTCACACCTTATGCAAGTAAGGTTAAAGCCATTATTTGGGGACAAGGTGAAAATGATGCTGTATCAGCATCTTCAACTGTTGCAGGTAGATACAGTAACACTACACGTTACCATGATGCTACGATAGCTATCTTTGATAAGATGCGTACAATAGTTCCTGCTTCTCAAGCAAAAATTGTTTGGCAGATCCTAGGTCGTTCTTATTTATATGGTGTAGAAGTTAATGGTGTGGATTGGCAGAAGTACAGAAATGTACAAAGAACCATCTCTACAGCACGTGATGATGTTATCATTGGTTCTTGGGTAGATGGTGCTGAACGTTACAGTGGTTATGTTTATGAAGAAGGTATTGATGGTCGTATCCATTATATTTCTTCTGTATACCAAACAGCAGCTACAAAACTTGCTAAATCAGCAGCAGACGGTACAGACCTAACATCAACGTCACCTGTATGGGTTGATATGGCTGTTCCAACTGGAGCAACAGCTACTTCCCAATCTAATCAAGATACAATTTTAGCATGGGATGCTCAAGGCTATAGTAAACACTACTTCCGTAATATTAACGTCTTAACCGCATCTGTATTAACTGAACAAACGCTTAATACGAACAGTTATACGTTTACCTATGCAGATCAAGTAGAACAATATGGTTTTGCAGCAGGAACTACTATATTTGATGTTGCATATTATGATGAAGCAAATGATGTGTTATCTCCTTTAGTACGTTTTAATGTTAACGTTACAGCAGGAACCGTAGAAGATAAACCTGTCGTGATGGATTATGATTTGACGCAAGAAACTCTCCCATCAGATGTTAAGGTTAATGGTGGGAACTCTTTTGCTCGTGCCTCTGGAGATATACTTGTAGCCACTAACACCTTGGTTGCTCCGTTGGAGTATGTTGGTACTACCCCTGTAGGTAGACGTGTAACAGCTAACACAGCTACACAAATTTTTGTCAACAACGCCTTAACAAGTGCAAGCCCGTGGGTAAAGACCAACTTAACTGTTGCAGCTTCATCTGATAACTCTCCGGCTGGAACTACTGCCAATGTATTCAAATTAACTCCGACTACAACCTCTGGTAGTCATATCTTAACTGCAACATATACTAACGCGTACAACATAAATGCCGGACGTAACTGGTCTGCCTCTGTTTTCTTGAAAGCGAACGGGATTACTAAGGCTAAACTAAGATTAAAAGCAGGAACTGAAGTTAATGAGGGTACTTTTGATTTAGCAGCAGGTACATTCACAGGAAGTGAAGCTAATATTATATCTATGGGCAACGGTTGGTATCGTGCTATTCTGCATAAAACAGGGATAGCCAAACAGTCCTTCATAAGTTTTGAAATAATTGCCTTGGATGCAACTGGTGCGGAGATTTTCGCTGGAGATGGTACTAGTAACCTTGCAGTTTGGTTGCCACAGCTTGAAGGTGCTTCTACAGGAGAAACATCAAAAGCTGGATCGCCTTATGTCTGCACATATCCTGGAAATTTAGGAGGAGTATCCTTCACTATACCAAGGAACGGACATACTGGTGTGGATGTTTACTATTCCAACGGAGACGTTGTTCGTGACGTATTCTCTGGTACGGCATCTACTTGGACAATAAACTACTCCAGCTTGTACGATTGGGGATCAGTCTTTATTACAGGTTTGAAATATTACGACTAA

Genome Context

Tertiary structure

XNS37842.1
ESMFold2 structure
Source ESMFold2
pLDDT 76.8
Oligomeric state monomer