Genbank accession
ARM69920.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,98
Seq2Symm
C3 confidence 1,000
C3 1,000
D3 0,001
C1 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNEMFSQGGKGSTGILTNKQAVARYFGVKQSEVVYFSVGAVLSGYKVIYDKETQRAYSLPADIAPGTTAISLSTAAVLVHSAGSVDLGALAVSREEYVTLPGSFDSGSTLNVKNELLTYTDGKYRWDGALPKIVPADSTPTTTGGVGDGAWVSVGDAALRSDLSSSSSGRGASLVNLTSGNSVQEEIDFLAYAYGVRLSNYMADPDPLTAALADSRNKKLPLIIDCDATYKTFLVYSNDRIIGCGDHTLTKIGNDKPSIPSAQQPERPSGTTTDFSSIDAGIVIVHPDNGSATNIIISGFNLANTSHCDYAIHCTFMSFTKIEDMKFNGYKRGIKWYNAYGNQLSRIFSLYYYSTSDVFSDFICYDFSDGNYSSGTSNTITNVTCTNYKKCYYVANLNYSTFTNCGGEGVESPTPVSTGNIPQTFEFVNCPNIVLNTPYTENLRGGFIRAVSDASGVYQGASTIVINGPEAVVGITGTTTNVGAKLLDIQGGVNCVVNGGYMTGAASGYFLEFGGADGDATLLINGMEMRNVLEQIRSHFGYNGINSIKGLRPMQLLRKGIGDATGTGIVNWKTASEDQYFMGGGNFTKTALGGYYQVDVEVPIGTNATGGEVTLLLSDTDTDSGVAIAQCYVPAVSTGRYSARLRYEGRLPGGKFLYVKTTVGWSSVYDTDAVFNVILK
Physico‐chemical
properties
protein length:680 AA
molecular weight: 72477,16730 Da
isoelectric point:5,07614
aromaticity:0,10294
hydropathy:-0,09794

Domains

View on InterPro
ARM69920.1
1 680 aa
ATT 1–166 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

ARM69920.1
1 680 aa
Domain Start End Length (AA) Confidence
N-terminal 1 201 201 0,9948
Central domain 202 554 354 0,9945
C-terminal 555 680 125 0,9849
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
ARM69920.1 [NCBI]
Genbank nucleotide accession
KY787213.1 [NCBI]
CDS location
range 60615 -> 62657
strand +
CDS
ATGAACGAAATGTTTAGTCAAGGTGGTAAAGGTTCAACTGGAATCTTAACCAATAAACAAGCAGTAGCCCGTTACTTTGGGGTTAAGCAGAGTGAGGTAGTTTACTTCTCCGTCGGTGCTGTACTAAGTGGATATAAAGTTATCTATGACAAGGAAACGCAGAGAGCTTATTCCTTACCTGCTGATATTGCCCCAGGTACTACAGCTATTAGTCTAAGTACTGCTGCTGTACTTGTACATTCAGCTGGTTCTGTAGACTTAGGTGCATTAGCCGTATCTAGGGAAGAATACGTAACCCTACCTGGTTCATTTGATTCTGGTTCTACGCTTAATGTTAAAAATGAATTACTTACGTATACTGATGGTAAGTATCGTTGGGACGGTGCATTACCTAAAATTGTTCCTGCTGACTCAACCCCTACAACAACCGGTGGAGTTGGTGATGGTGCTTGGGTTAGCGTTGGTGATGCTGCATTGAGGAGTGATTTATCATCATCTTCTTCTGGTCGTGGGGCATCACTTGTTAATTTAACAAGCGGAAATTCAGTACAAGAAGAAATTGATTTTCTTGCTTATGCCTATGGGGTAAGGCTAAGTAATTACATGGCAGACCCAGACCCACTGACTGCTGCGCTTGCCGACTCAAGAAATAAAAAACTGCCATTAATCATTGACTGTGATGCAACGTACAAAACATTTCTTGTTTATAGTAACGACAGGATAATCGGTTGTGGCGACCACACCTTAACAAAAATTGGGAACGACAAGCCATCAATACCATCAGCACAGCAACCAGAACGTCCATCTGGAACAACGACAGATTTTAGTTCAATAGATGCAGGTATTGTTATCGTTCACCCTGACAATGGATCTGCTACTAATATCATTATTTCAGGGTTCAATCTTGCAAATACTTCTCATTGTGATTATGCAATCCACTGTACTTTCATGTCTTTTACAAAAATAGAAGACATGAAGTTTAACGGGTACAAGCGTGGGATTAAATGGTACAACGCCTATGGAAACCAACTATCAAGAATATTTTCACTTTACTATTATTCTACCTCTGATGTTTTTTCTGACTTCATTTGCTACGACTTTTCTGACGGGAACTATTCATCAGGAACATCAAATACAATAACTAACGTAACATGCACTAACTATAAGAAATGTTATTACGTGGCAAATCTAAACTACTCTACATTCACCAATTGTGGTGGTGAAGGAGTCGAGTCACCAACACCAGTATCCACAGGAAACATTCCACAGACCTTCGAGTTTGTTAATTGCCCCAATATTGTCCTGAATACCCCCTATACTGAGAATTTAAGGGGCGGGTTTATAAGGGCGGTTAGTGATGCATCTGGGGTGTATCAGGGGGCCTCAACTATAGTCATCAATGGGCCTGAGGCGGTTGTGGGTATCACAGGCACCACTACTAATGTCGGCGCTAAGCTTCTAGACATTCAGGGGGGAGTTAACTGTGTAGTCAATGGTGGGTACATGACCGGGGCCGCAAGCGGTTACTTCTTAGAGTTTGGGGGGGCTGATGGTGATGCCACCCTCCTGATAAACGGTATGGAGATGCGTAATGTGTTAGAGCAGATACGTAGCCACTTTGGTTATAACGGAATTAACTCAATAAAAGGTTTGCGCCCAATGCAGTTACTCCGCAAAGGGATTGGAGATGCTACTGGTACTGGGATAGTAAACTGGAAAACAGCTTCCGAAGACCAGTATTTTATGGGTGGCGGTAATTTCACCAAGACGGCTCTCGGTGGATACTATCAAGTTGATGTTGAGGTACCAATTGGAACAAATGCCACTGGTGGGGAGGTAACTCTTTTACTCTCAGATACCGATACGGATTCCGGAGTTGCTATAGCTCAATGTTATGTTCCAGCGGTATCTACCGGTAGGTATTCAGCAAGATTGCGGTACGAAGGTAGATTGCCGGGTGGAAAGTTCCTTTATGTAAAAACAACTGTAGGTTGGTCTTCTGTTTATGATACCGATGCGGTATTTAATGTAATTCTAAAATAA

Genome Context

Tertiary structure

ARM69920.1
ESMFold structure
Source ESMFold
pLDDT 75.6
Oligomeric state monomer

Literature

Title Authors Date PMID Source
Complete Genome Sequence of Salmonella Typhimurium baceriophage BSP101 Bai,J. and Ryu,S. 2011-08-15 — GenBank