Genbank accession
YP_224261.1 [GenBank]
Protein name
putative hemagglutinin protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Seq2Symm
C3 confidence 0,943
C3 0,943
C1 0,731
D3 0,019
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MTIPKLTPYTGQVANPDGSQTQTEFTTNMFNQLSYEANLATELDATIDGINNAVDEVSQNTAIAESSANAAEAAASSAGYKGLWPDTGGSANKGDTYQTQVGGTPTGEYFTALQNTTVDPVGDNVNWKVNVSVSSLIQPRYEADSVELALDSITSSGKVIEAKIGDKWNVKGVDFIRVAVGTDRSALLIDSNETVTNALRVSNRRTVKEFSTEEIKSKAESSHLLTIAGPSSKLQFSRLTVPVDSANDLEFYIDANLSTPLNNSTSSTNFYLVGVACDDVLRSGAVNKPIGTIETTDRGYKLTVPSSDLTSTHFSLDLRLNTGADASGEITSIVAKQQGVKVGDTLYNLIRQSDEWTADNRNTSFAEPSGSFLSGQDIDRGMSSITSNNVLSVSKSGLNSYLSKRTSLEFYNDVIQNESSPVLVKALAMDSGDYYPYRQQFALNVLGDVALIAQGGAVNIMCGDEIAPTFVSSSGGVDYYTAPWDDDRHYNDDVRSGAAQPRLSAEMVNSTESVYKYQLTPTTSIVSVQSTPNTSYYDSGTGTVHLSYPAGYIPPKIYVTCTSNGVNEYNPGGSTPSFDIFGFNINIYAAESNNWFIRPSNYAPYPTVSSKFVSLHSCSGIASGAGEGIFIGNVDYDLVDCTFNSNGNDGFNHHFSGLGYVEGGRGWNNSQDGMSHHEQQIAYCKGVSLNYSGAANCVPAFGCDVYMYRCESVTASDGLTTKVYAGTFCALSSQSQGNAKAVYDSCYTDNTLNRSIGGYLSSSLDATSVSTVVVKNPISNLDGAKLTDKTGNADNVMLIIP
Physico‐chemical
properties
protein length:801 AA
molecular weight: 85564,00490 Da
isoelectric point:4,56124
aromaticity:0,08864
hydropathy:-0,28614

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_224261.1
1 801 aa
Domain Start End Length (AA) Confidence
N-terminal 1 380 380 0,5510
Central domain 381 785 406 0,9179
C-terminal 786 801 15 0,6042
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Listonella phage phiHSIC [NCBI] · taxon 310539

Coding sequence (CDS)

Genbank protein accession
YP_224261.1 [NCBI]
Genbank nucleotide accession
NC_006953 [NCBI]
CDS location
range 21870 -> 24275
strand +
CDS
ATGACCATTCCAAAGTTAACACCATACACCGGACAAGTAGCAAATCCAGACGGTAGCCAAACTCAAACAGAGTTTACTACCAATATGTTTAATCAGCTCAGTTATGAAGCAAATTTAGCAACAGAGTTAGACGCTACAATTGACGGAATCAATAACGCTGTCGATGAGGTAAGCCAGAATACCGCTATCGCTGAAAGCTCAGCCAATGCAGCGGAAGCGGCTGCATCGTCGGCGGGCTACAAAGGCTTATGGCCCGACACAGGCGGCAGTGCTAATAAGGGCGATACATATCAAACTCAAGTTGGTGGAACACCGACTGGTGAATATTTCACCGCCTTGCAAAATACGACCGTTGACCCTGTAGGGGATAACGTTAATTGGAAGGTTAATGTTAGTGTAAGCAGTTTAATACAGCCAAGATATGAAGCGGACAGTGTAGAGCTTGCGCTGGATTCTATCACGTCATCTGGAAAGGTTATTGAAGCAAAAATTGGAGATAAGTGGAATGTAAAGGGTGTTGATTTTATCCGCGTTGCCGTCGGCACAGATAGATCTGCGCTTTTGATTGACTCTAATGAGACTGTTACAAATGCGCTCAGAGTTTCAAATAGACGCACGGTTAAGGAGTTTTCAACCGAAGAGATTAAATCAAAAGCAGAAAGTAGTCACTTACTGACGATTGCAGGCCCATCGTCTAAGTTGCAATTCTCTCGACTTACTGTACCAGTAGACTCAGCAAATGATTTGGAGTTTTACATTGACGCAAATCTAAGTACACCACTTAATAACTCAACAAGTTCAACAAACTTCTACCTAGTAGGCGTTGCTTGTGATGATGTATTGCGTAGCGGCGCGGTAAATAAACCTATAGGTACAATCGAGACAACCGACCGTGGTTACAAACTGACAGTCCCATCCTCAGACCTAACTAGTACGCACTTTTCTCTGGATTTAAGATTAAACACTGGCGCAGACGCTAGCGGTGAGATTACTTCAATTGTAGCAAAGCAGCAAGGTGTGAAAGTCGGTGATACTCTTTACAATTTGATTCGTCAATCAGATGAGTGGACAGCTGACAATAGAAATACATCTTTCGCAGAGCCTTCTGGGTCATTCCTCAGCGGACAAGATATTGACAGAGGGATGTCATCCATAACCTCTAACAATGTGCTAAGCGTAAGCAAAAGCGGTCTTAACTCTTACTTATCAAAGCGAACTAGCCTAGAGTTTTACAATGATGTAATTCAAAACGAATCATCTCCGGTTCTTGTTAAAGCACTCGCAATGGATAGTGGCGATTACTACCCTTACCGCCAACAGTTTGCTTTAAACGTCCTTGGTGATGTTGCGCTAATCGCTCAAGGCGGAGCGGTAAACATCATGTGTGGAGATGAGATAGCACCTACGTTTGTATCCAGCTCTGGCGGTGTAGATTACTACACAGCGCCTTGGGATGATGACAGACATTATAATGATGACGTAAGAAGCGGAGCAGCTCAGCCTCGCTTGTCTGCCGAGATGGTAAACTCTACTGAGTCTGTTTATAAGTACCAGCTAACACCTACCACGTCGATAGTTAGCGTACAAAGCACGCCTAACACTAGTTATTATGATAGTGGGACTGGCACAGTGCACTTGAGCTATCCAGCAGGATACATTCCGCCTAAAATCTACGTGACTTGCACAAGTAACGGTGTTAACGAATACAATCCGGGAGGTTCTACACCATCTTTTGATATCTTCGGCTTTAACATCAATATCTATGCAGCGGAGAGTAACAACTGGTTTATACGCCCATCAAATTACGCTCCATACCCTACGGTATCATCAAAGTTTGTATCTCTTCATTCGTGCTCAGGGATTGCGTCTGGTGCTGGGGAAGGGATTTTCATAGGCAACGTTGATTACGATCTTGTGGATTGCACTTTTAACAGTAATGGTAATGACGGATTTAACCATCACTTTAGCGGACTTGGCTACGTTGAAGGGGGTAGAGGTTGGAATAACTCACAGGATGGGATGAGTCACCATGAGCAACAAATAGCCTACTGTAAGGGAGTTTCACTAAACTACAGCGGTGCAGCGAACTGCGTACCTGCTTTTGGGTGTGATGTGTACATGTACAGATGTGAAAGCGTTACAGCTTCAGACGGATTAACAACTAAAGTTTACGCTGGTACATTCTGCGCTTTATCAAGCCAGTCTCAAGGTAATGCAAAGGCTGTTTATGACAGTTGTTACACGGATAACACCTTAAACAGGTCTATTGGTGGGTATCTTAGCTCATCCCTTGATGCTACGAGCGTGTCAACGGTTGTTGTTAAAAATCCAATATCAAACCTTGATGGGGCCAAGCTAACCGACAAAACAGGCAATGCTGACAACGTAATGCTGATTATACCCTAG

Genome Context

Tertiary structure

YP_224261.1
ESMFold structure
Source ESMFold
pLDDT 65.9
Oligomeric state monomer