Genbank accession
AUS02994.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C3 confidence 0,995
C3 0,995
C1 0,767
D3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNTAYGVHRDGSGNLQNLQTFLNQSVVPQLPMKKPGDYGAIPGTSVNNTTAIRALLNDLSNGDVVDFGGNVYRVYADVDGIPSTGAGDTDSLSQNEVLWLDSKKNIKFQNGGLYNADQSVSPVKMYYPTILSLTNCENIHFDNFVLESKGENWGDSDASRTLTQDRRLSFLATNGGHALYAGLCNHIYINNCQFRLAGSVSPLYISMCANVHISDSFSNPASLGYASIGIDGWVGSVSDIPNNATTASTYLSNFVGHKETLVRREDGVPVGSSQYSAKGWVNTEDSVEVFVTGGQCSDMYGNATARTLGYAFGIGSGSRCTATAFEAHNVACLLHLFWSIDDLAYANLSNFYCESGLYGVVTDSVAFGDGDVILSNGVVNIDGSRVWDDGGESEESSHFICRRDSTNTVNFTLNNIEVNKGGYNLSHPFSLVWANDPDKYQRGKLVFNGGHYEPSGYISRVQAWGGSEQGEKDGLIMKNGCVIRDRNAIASDTPIYWGNQYTSGALYNYVDLDDALLQTHPSQFRNLANGSPDNANLVDGYWMPHSGLENCYTKDSKYHKRFLSTDLEFDSSQGLSGTDSRMRFKLRDNRYPHTTGGNENVFIGDDTGSIQVGEILTDSVSGSSLFVDFTLAGDVRVNFTPGVNYRLL
Physico‐chemical
properties
protein length:648 AA
molecular weight: 70518,79160 Da
isoelectric point:4,84322
aromaticity:0,10494
hydropathy:-0,34074

Domains

View on InterPro
AUS02994.1
1 648 aa
STR 30–428 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

AUS02994.1
1 648 aa
Domain Start End Length (AA) Confidence
N-terminal 1 45 45 0,9339
Central domain 46 511 467 0,9817
C-terminal 512 648 136 0,9269
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Vibrio phage 2.275.O._10N.286.54.E11 [NCBI] · taxon 1881285

Coding sequence (CDS)

Genbank protein accession
AUS02994.1 [NCBI]
Genbank nucleotide accession
MG592671.1 [NCBI]
CDS location
range 259790 -> 261736
strand -
CDS
ATGAATACAGCCTATGGTGTGCATAGGGATGGCTCTGGCAATCTACAGAACCTACAGACTTTTTTAAATCAATCAGTAGTCCCGCAACTCCCTATGAAAAAACCAGGAGATTACGGGGCTATCCCAGGAACATCCGTTAATAACACTACCGCTATTCGTGCGCTATTAAACGACCTCTCTAACGGAGATGTAGTAGATTTTGGCGGCAATGTCTATAGAGTATATGCTGATGTAGATGGTATCCCATCTACAGGTGCAGGCGATACAGACTCCCTTTCGCAGAATGAAGTGCTGTGGTTAGATAGTAAGAAGAATATCAAATTCCAAAACGGAGGATTGTACAATGCAGATCAAAGTGTTTCACCTGTCAAAATGTACTACCCTACCATATTAAGCTTAACTAACTGTGAGAACATCCACTTTGATAATTTTGTATTAGAGAGTAAGGGTGAGAACTGGGGAGACTCAGACGCGTCTCGAACATTAACACAGGATCGTAGGCTGTCCTTCCTAGCTACTAACGGAGGACATGCATTATACGCTGGGCTGTGCAACCATATCTATATCAACAACTGTCAATTCCGATTAGCAGGGTCAGTCAGCCCACTGTACATCTCAATGTGTGCTAATGTACATATCTCAGATAGTTTCTCCAACCCCGCATCTCTGGGTTATGCGTCAATAGGTATAGATGGTTGGGTGGGTTCTGTTTCCGACATTCCTAATAATGCAACAACAGCTTCTACATATCTATCCAACTTTGTAGGACACAAAGAAACCCTTGTTCGCAGAGAAGATGGAGTACCTGTGGGTTCGTCGCAGTATTCTGCAAAAGGTTGGGTCAATACAGAAGATTCTGTTGAAGTGTTTGTGACTGGGGGCCAATGTTCAGATATGTATGGGAACGCGACAGCTAGAACACTAGGTTATGCTTTCGGTATAGGATCTGGTTCAAGGTGCACCGCCACTGCGTTTGAAGCGCATAATGTTGCATGTCTGCTGCACTTGTTCTGGTCTATAGACGATCTAGCCTATGCGAACCTATCTAACTTCTACTGTGAATCCGGCTTGTATGGGGTTGTCACAGACAGTGTCGCCTTTGGGGATGGCGATGTGATCCTATCGAACGGGGTTGTTAATATAGACGGATCTCGTGTTTGGGATGACGGTGGTGAAAGTGAAGAGAGTAGTCATTTTATTTGCAGAAGAGATTCAACTAATACCGTAAACTTCACATTGAATAACATCGAAGTCAACAAAGGCGGCTATAACCTCAGCCACCCGTTTTCATTAGTATGGGCTAACGATCCTGATAAGTACCAAAGAGGAAAGCTCGTGTTTAACGGAGGGCACTACGAACCTTCTGGGTACATTTCACGAGTTCAAGCATGGGGCGGTAGTGAGCAGGGTGAGAAAGACGGGCTGATTATGAAAAACGGTTGTGTGATTAGGGATAGAAACGCTATCGCAAGCGACACGCCTATTTACTGGGGCAACCAATACACATCTGGTGCTTTATACAACTATGTTGATCTAGACGACGCATTACTCCAAACACACCCTTCTCAATTCAGAAATCTGGCAAACGGCAGCCCGGATAACGCCAACCTTGTTGATGGATATTGGATGCCGCATAGTGGCTTAGAAAACTGTTATACTAAAGATTCTAAGTACCACAAGAGATTCTTAAGCACAGACTTAGAGTTCGACTCATCTCAAGGACTTTCAGGAACTGATTCTCGTATGCGATTTAAACTGCGTGACAATAGATACCCACACACTACAGGTGGTAACGAGAATGTGTTCATTGGAGATGACACAGGAAGCATACAGGTTGGTGAAATACTCACTGATAGTGTTTCAGGATCATCTCTTTTTGTCGACTTTACATTGGCGGGGGATGTACGGGTTAACTTCACACCAGGCGTAAACTACCGTCTCCTGTAA

Genome Context

Tertiary structure

AUS02994.1
ESMFold structure
Source ESMFold
pLDDT 61.3
Oligomeric state monomer

Literature

Title Authors Date PMID Source
A major lineage of nontailed dsDNA viruses as unrecognized killers of marine bacteria Kauffman,K.M., Hussain,F.A., Yang,J., Arevalo,P., Brown,J.M., Chang,W.K., VanInsberghe,D., Elsherbini,J., Cutler,M.B., Kelly,L. and Polz,M.F. 2018-01-24 29364876 GenBank