Genbank accession
AUR91921.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect2
Probability 0,96
Seq2Symm
C3 confidence 1,000
C3 1,000
C1 0,001
C2 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MACSDYPTQQTAKTFKLDAETVNEVVTSSDDRTSPASDGETKLTLAGIENLAEEQRDQFDETFTAQFAYKRIGNISDYAGQSLAETDKLNAYQYPDDSGEWYGPIQSQVFPITIPVNPSTDNGWALVNAVTTDSIGLLTNYQSASVADMVAGNPVAIDIGDTCLVSGTVYIRRSTANSDIRDFEALTPIYASGFHPFDGTDATPSLLSMALISDDKNVIFPNGGSVILTQELNFAKAKSVDFGRIVVNCDFSDTDRPITIGATTVTEVGELTSELSKLSTTITLSDVTNVVRGSMLSIYNPVDYSFSGFRASYRQGEFQFVSSISGNDVTIDASTIETYPSGTKIYLIDTTTTKLTGELTVNNTGAYSVGYGLRVMSNVNADYAGLKVSLNNSTHALSLDRNVGCFGSSMIAWQRSVTTSGLDYGLVQGSCQSNTFEGSFHAERHGSATGGDGSAGSVVNRFLTVRGRITTTGEGSVQAADFHGNTEFCRYGGYLEGASLGGNASTIEEGSVVVSPKADLPSLAYSELKSTKHTAKNVTVICYGDPGSRGAIDVGGNSDVVTEFTTIGGAFDFRGCHIESPDKQSHLVAVRNRGATVDFDILLDGMTIDAQNAATLIACSAVSGSEPNLVSLYNTPQNLSISASGDKVLGWEKFGRVRFTLDTSTNRMNASVSYDYPFPLGRVPLVTSCCSRSVIGSELIQSVAVSPDTNSIDVRIATRDGSNFSSSVDVDVRWKAEMVESSTVVTVP
Physico‐chemical
properties
protein length:748 AA
molecular weight: 79589,06960 Da
isoelectric point:4,54856
aromaticity:0,08021
hydropathy:-0,14305

Domains

View on InterPro
AUR91921.1
1 748 aa
STR 261–346 · ENZ 420–611 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

AUR91921.1
1 748 aa
Domain Start End Length (AA) Confidence
N-terminal 1 204 204 0,9925
Central domain 205 636 433 0,9878
C-terminal 637 748 111 0,9663
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Vibrio phage 1.167.O._10N.261.51.F2 [NCBI] · taxon 1881211

Coding sequence (CDS)

Genbank protein accession
AUR91921.1 [NCBI]
Genbank nucleotide accession
MG592534 [NCBI]
CDS location
range 18370 -> 20616
strand +
CDS
ATGGCATGTTCAGACTACCCAACACAACAAACGGCAAAGACTTTCAAGCTCGATGCTGAAACAGTTAACGAGGTCGTTACTTCTAGTGATGATCGCACATCACCAGCCAGTGACGGCGAGACAAAGCTAACCCTTGCAGGCATTGAGAATCTAGCAGAGGAACAACGCGATCAATTTGACGAAACGTTCACGGCTCAGTTTGCGTATAAGCGCATTGGCAATATTTCAGACTATGCAGGCCAATCGCTTGCTGAGACTGACAAGCTGAACGCTTACCAATATCCTGACGACTCTGGAGAATGGTATGGACCTATTCAGTCGCAAGTATTCCCCATTACAATTCCTGTAAACCCATCAACTGATAATGGGTGGGCGTTAGTTAATGCCGTAACCACTGACTCAATTGGTCTCCTCACCAACTACCAGTCCGCCAGTGTTGCTGATATGGTTGCTGGCAATCCTGTTGCAATTGATATTGGTGACACCTGCCTAGTTTCAGGCACTGTGTACATTAGGCGATCTACAGCTAACAGCGATATAAGAGATTTTGAGGCATTGACGCCAATTTATGCCTCAGGCTTTCATCCATTCGATGGTACAGACGCGACACCATCACTGTTAAGTATGGCCCTTATCTCAGATGATAAAAACGTTATTTTTCCGAATGGCGGATCTGTGATCCTCACTCAAGAGCTTAATTTTGCAAAAGCAAAGAGTGTGGATTTTGGCAGGATTGTAGTGAATTGTGATTTTTCCGACACGGACAGACCCATTACTATTGGTGCAACAACAGTCACGGAAGTGGGGGAGTTAACGTCGGAACTCAGTAAGCTATCAACAACTATCACACTGAGCGATGTCACAAATGTAGTTCGCGGCTCTATGCTGTCTATCTACAACCCAGTCGATTATAGTTTTAGTGGGTTTCGTGCGTCATATCGCCAAGGTGAGTTTCAGTTTGTTTCTAGTATTTCCGGCAACGATGTCACCATTGATGCGTCAACTATTGAAACATACCCATCAGGCACAAAAATCTACCTTATAGACACGACCACAACCAAATTAACGGGAGAGCTTACTGTAAATAATACAGGTGCGTATTCTGTAGGTTACGGCCTCCGTGTCATGTCGAATGTTAATGCTGACTATGCTGGTTTGAAAGTAAGTTTAAATAACTCCACACACGCATTATCTCTTGACAGAAACGTAGGTTGCTTTGGTAGCTCAATGATTGCATGGCAGCGCTCAGTTACAACATCTGGGTTGGATTACGGGCTTGTGCAGGGAAGTTGTCAAAGCAATACTTTTGAGGGGTCATTTCACGCTGAGAGACACGGGAGCGCTACGGGTGGTGATGGTTCTGCTGGTAGTGTAGTTAACAGATTTCTGACGGTCAGAGGTAGGATTACCACTACAGGCGAGGGGTCGGTTCAAGCGGCCGATTTTCATGGCAACACTGAGTTTTGTAGGTATGGTGGATATCTGGAAGGAGCATCGCTGGGAGGGAACGCTTCAACCATTGAAGAGGGCAGTGTTGTTGTATCTCCTAAAGCAGATCTTCCTTCTTTAGCTTATTCTGAGCTAAAATCAACAAAGCATACCGCTAAAAACGTCACTGTTATATGTTACGGAGATCCTGGAAGTCGCGGAGCTATTGATGTAGGTGGCAACTCTGACGTGGTCACAGAGTTCACCACTATTGGAGGCGCGTTTGACTTTAGGGGTTGCCATATAGAATCCCCAGATAAGCAGAGCCACTTAGTCGCAGTTAGAAACAGAGGTGCAACTGTTGACTTTGACATCCTGCTTGATGGCATGACCATAGACGCACAAAATGCGGCAACGCTTATTGCCTGCTCGGCTGTTTCTGGTAGTGAGCCAAATTTAGTCTCACTGTACAACACACCACAAAACCTATCAATATCAGCCTCTGGAGACAAAGTACTTGGTTGGGAGAAGTTTGGTAGAGTCAGGTTTACGCTGGATACATCAACCAATAGGATGAATGCATCTGTAAGCTATGATTACCCGTTCCCACTAGGGAGGGTCCCGCTAGTGACGTCATGCTGTAGCAGGAGCGTCATTGGCTCGGAGCTGATACAAAGTGTGGCTGTAAGTCCAGATACTAACAGCATTGATGTTCGCATTGCCACGCGGGATGGGAGCAACTTTTCGTCATCTGTTGATGTTGATGTTCGATGGAAGGCGGAAATGGTAGAGTCCTCCACTGTAGTAACGGTGCCTTAA

Genome Context

Tertiary structure

AUR91921.1
ESMFold structure
Source ESMFold
pLDDT 78.6
Oligomeric state monomer

Literature

Title Authors Date PMID Source
A major lineage of nontailed dsDNA viruses as unrecognized killers of marine bacteria Kauffman,K.M., Hussain,F.A., Yang,J., Arevalo,P., Brown,J.M., Chang,W.K., VanInsberghe,D., Elsherbini,J., Cutler,M.B., Kelly,L. and Polz,M.F. 2018-01-24 29364876 GenBank