Genbank accession
QBQ71871.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,72
Seq2Symm
C6 confidence 0,126
C6 0,126
C3 0,010
C10-C17 0,009
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAYSLVQPSLAGGEISPSLYGRIDLEKYQTSLRRCRNFIVRQSGGIENRPGFRFLGSAKYADRYCRLIPFQFSVSQTYALELGDHYFRVWSNGALVTDGGSPVEVATPWPVSVISELKFTQSADVMTVCHNDYPPLEIRRYGEADWRTAAVTTTSGPFQDLNTDDSVTVYASGRTGSVTLTASSPIFKSQHVGKLFYMEQKAVDSVGRWETDKDIGIGDECRYQENFYRCVDGGSNGTTGTVAPTHTTGDSWDGWGLGGRNGVLWRYLHSGFGVCRITAVAGDGLTATADVVPRQDGEIELPAQVVGSTFATYKWAHYAWNDTDGYPGTVTYYQQRLIFGGSRAFPQTIWCSRTGDYHNFYRSNPKVDDDAITYNYAGRQLNKILHLLDVGQLIVLTSGGEFKVTGDSNGNLTGTGGFAMSGQSFNGSSDLAPINVGSVALYVQQKGSIIRDLFYSFDQDSYQSSDLTLLASHLFNGYSIRDWALSVQPFSVAWCARSDGMLLGLTYLREQQVYAWHPHPMTNGYVESICSISEGQEDAVYALIRRTVNGSTVRYVERLNTRQFTEQQDAFFVDSGLSYSGENTDSSRTMTISSAGGWTYQDEFTLTCSSAIFDSSNTDYEIHIPYTEGGVSKSMRLSIAGVISSTVATVLANRDVPTALRNTAQSTWSIARRTFAGLSHLEGQTVSILADGNVEPQQVVSGGEVTIENHSSVVHIGLPVAAVIETLDVNVAGQSTLLDKTKLINQLCVMLNSGRSVWAGTDDAHLLEYTQREWEFYDDPVGLKTGIIDMNLDANWERNGRVVISHSDPLPIGILAIIPRVTVGG
Physico‐chemical
properties
protein length:825 AA
molecular weight: 90472,63850 Da
isoelectric point:5,12389
aromaticity:0,10424
hydropathy:-0,22424

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QBQ71871.1
1 825 aa
Domain Start End Length (AA) Confidence
N-terminal 1 162 162 0,9950
Central domain 163 373 212 0,1929
C-terminal 374 825 451 0,1231
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QBQ71871.1 [NCBI]
Genbank nucleotide accession
MK422448 [NCBI]
CDS location
range 39733 -> 42210
strand +
CDS
ATGGCCTATTCACTGGTGCAGCCGTCGCTTGCCGGCGGCGAGATATCGCCTTCACTGTATGGTCGAATCGATCTTGAAAAATACCAGACGTCATTGCGCCGCTGCCGCAATTTCATCGTCCGGCAGTCAGGCGGCATTGAAAATCGTCCCGGTTTCCGGTTCCTGGGGAGCGCGAAATATGCAGACCGTTACTGCCGGCTAATACCGTTCCAGTTCAGTGTATCGCAAACCTATGCGCTCGAGCTCGGTGATCACTATTTCCGTGTCTGGTCTAACGGAGCGCTGGTTACGGACGGCGGCAGCCCTGTTGAAGTTGCTACCCCATGGCCGGTTAGCGTCATCTCTGAGCTGAAATTTACGCAGTCTGCCGATGTGATGACGGTGTGCCACAACGATTATCCGCCGCTTGAGATCCGCCGTTACGGAGAGGCTGACTGGCGCACCGCCGCAGTGACAACAACCAGCGGGCCATTCCAGGACCTGAACACAGACGACTCGGTAACGGTGTACGCCTCAGGCCGAACTGGATCCGTAACGTTGACTGCCAGCAGCCCGATTTTCAAAAGCCAGCACGTGGGAAAACTGTTCTACATGGAACAGAAAGCGGTAGATAGTGTTGGTCGGTGGGAAACCGATAAAGACATCGGGATCGGTGACGAGTGCCGATATCAGGAGAACTTTTATCGCTGTGTTGACGGCGGTTCTAATGGCACAACCGGCACTGTTGCTCCTACCCATACAACGGGAGATTCCTGGGATGGCTGGGGTCTTGGTGGCCGTAACGGTGTGCTGTGGCGTTATCTGCATAGTGGTTTTGGCGTGTGCCGTATTACCGCCGTCGCCGGAGATGGACTAACTGCAACGGCCGACGTTGTACCACGTCAGGATGGTGAGATCGAGCTGCCGGCGCAAGTGGTAGGTAGCACCTTCGCCACTTACAAATGGGCGCATTATGCCTGGAACGATACAGACGGCTACCCGGGTACAGTTACCTATTACCAGCAGAGGCTGATTTTCGGTGGCAGCCGGGCATTTCCTCAAACTATATGGTGTAGCCGTACCGGTGATTATCACAACTTCTATCGCAGCAACCCGAAGGTTGACGACGATGCGATAACCTATAACTACGCCGGTCGCCAGCTGAACAAAATCCTGCATCTTCTCGATGTCGGTCAGCTTATCGTGCTGACCAGCGGCGGAGAGTTCAAGGTGACAGGCGACAGCAACGGCAACCTGACGGGAACCGGTGGCTTTGCGATGTCCGGTCAGTCGTTCAACGGTAGCAGCGATCTGGCACCAATCAACGTTGGTAGCGTTGCACTGTACGTTCAGCAGAAGGGCTCCATCATCCGTGACCTGTTTTACTCATTCGACCAGGATAGCTATCAATCCAGTGATCTGACCCTTCTTGCCAGTCACCTGTTTAACGGTTACAGCATCAGAGACTGGGCTTTGTCTGTTCAGCCGTTCAGCGTTGCATGGTGTGCGAGGAGTGACGGCATGCTGCTTGGGCTGACTTATCTCCGTGAGCAGCAGGTATATGCCTGGCATCCGCACCCGATGACTAATGGCTATGTCGAATCGATCTGCAGTATTAGCGAAGGGCAGGAAGATGCGGTCTATGCGCTTATTCGCCGTACGGTGAATGGATCGACAGTTCGTTATGTTGAGCGACTGAATACCCGGCAGTTTACAGAGCAGCAGGATGCATTTTTCGTGGATTCTGGCCTGTCTTACAGCGGAGAAAACACCGACTCTTCACGCACAATGACGATCAGTTCCGCCGGGGGCTGGACCTACCAGGATGAATTCACGCTAACGTGCAGCTCTGCAATCTTCGACTCATCGAACACTGATTACGAGATCCATATTCCCTACACCGAAGGCGGTGTCAGCAAGTCGATGCGTTTGAGCATTGCTGGTGTTATCTCATCAACAGTGGCTACCGTATTAGCAAACCGTGATGTGCCGACAGCGCTGCGCAATACTGCGCAATCAACCTGGTCGATAGCACGTCGGACATTTGCGGGACTGTCTCACCTCGAGGGGCAGACGGTTAGCATTCTTGCCGACGGTAACGTTGAACCTCAGCAGGTTGTATCAGGCGGCGAAGTGACGATCGAAAACCACTCGTCAGTGGTACATATCGGTTTGCCGGTAGCCGCGGTTATCGAAACGCTGGACGTGAACGTTGCAGGGCAGTCTACGCTGCTGGATAAGACCAAACTCATCAATCAGCTTTGCGTAATGCTCAACAGCGGGCGCTCGGTTTGGGCCGGAACAGATGATGCTCACTTGCTGGAGTATACCCAGCGTGAGTGGGAATTCTACGACGACCCGGTAGGGCTAAAGACGGGCATCATCGATATGAACCTCGATGCAAACTGGGAGCGTAACGGGCGGGTTGTAATCAGCCATTCTGATCCGCTGCCGATTGGCATTCTGGCCATTATACCGCGCGTAACGGTAGGGGGCTGA

Genome Context

Tertiary structure

QBQ71871.1
ESMFold2 structure
Source ESMFold2
pLDDT 90.3
Oligomeric state monomer