Genbank accession
YP_009789504.1 [GenBank]
Protein name
putative large intein domain protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect2
Probability 0,37
Seq2Symm
C1 confidence 0,996
C1 0,996
C3 0,014
C2 0,004
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MARFRVRNKANNGWLDCVDTPMFVRTQEGDWAPLLPDKFSVRNLYGKRWHDIDDSYDPTYDDPCLNLETGECGGGPTSTTKGSGTGDGSGGPTYDQLIGYPPGFDLPDAGRVGFGLLNNYAPPTGRAINRPGIKTFESYDPVGASSRTGLGTYANPNVPYASVHGRGAVITETVFAMPAVEGYVELMFASYVASGMSVDVYHMGVRVASTCGKVAGRSRIKFQFDPDADDMRIMVRVRTEAGAHWSLQVFPPRLVVTSDRGNLALDSQLSYDVINFPDVVHPDYIGTPVFPAPCHASVYPIAARIQDANAFEYYHYIGTVAGWMYLDFTSWETYDFIEVYHSGRRIATTLDAQTANGYLYFLFDPRGSNCYDLMIRVVSKDFGSATSLQSNYYNLYCPSERGAREYRHPCESYTVSSMGHPVTEDCFALGAQTDIRAGLIQVNSGNFATKFEVFDQSMNLLDTEILGANSTGTLEFWKYPEHVLRQNIVVRVTAAIGCDWQYFVYCPVQPPKIDVSDFLVPYRCVVIEGGSAQPPIADDLPWFCYAFDQVDGRGVSGSVANLKAWDGSYMNFWGGSQGWFKFNNSFVKPIKQITFQWVFDGINGAWHDMSIYERYAGEAAAQRVYNSANVMQTITFDTNIPAGEEVWLYAFGGGDRGNSNDVTYLAISNIVFG
Physico‐chemical
properties
protein length:673 AA
molecular weight: 74588,61300 Da
isoelectric point:4,91870
aromaticity:0,13670
hydropathy:-0,21605

Domains

View on InterPro

No domain architecture available.

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_009789504.1
1 673 aa
Domain Start End Length (AA) Confidence
N-terminal 1 35 35 0,5398
Central domain 36 234 200 0,8538
C-terminal 235 673 438 0,4022
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009789504.1 [NCBI]
Genbank nucleotide accession
NC_047815 [NCBI]
CDS location
range 62657 -> 64678
strand -
CDS
ATGGCACGCTTTCGCGTAAGAAATAAAGCCAATAACGGCTGGCTCGATTGCGTCGATACTCCGATGTTTGTGCGCACGCAAGAGGGAGATTGGGCACCGCTGTTGCCTGACAAGTTCAGCGTGCGCAATCTGTACGGTAAACGTTGGCATGATATTGATGACAGCTATGACCCGACGTATGATGATCCGTGTCTCAACCTTGAAACAGGTGAGTGTGGCGGTGGCCCTACTTCAACAACTAAGGGTAGTGGTACTGGCGATGGTAGTGGTGGCCCTACGTATGACCAGCTTATCGGATATCCTCCTGGCTTTGACTTGCCTGATGCTGGACGTGTTGGCTTTGGTCTACTCAATAACTACGCGCCGCCGACTGGTCGTGCTATCAATCGTCCTGGTATTAAAACGTTCGAGTCATACGATCCCGTCGGAGCAAGCTCACGTACTGGACTTGGTACCTATGCTAACCCGAATGTACCGTATGCTAGTGTTCATGGCAGGGGCGCAGTAATCACAGAAACTGTGTTTGCTATGCCTGCTGTTGAGGGATATGTCGAGCTAATGTTCGCATCCTATGTAGCTAGCGGCATGAGCGTTGACGTGTATCATATGGGTGTGCGTGTTGCATCAACTTGCGGTAAGGTAGCTGGTCGTAGTCGTATCAAATTCCAGTTCGATCCAGATGCTGATGACATGCGTATCATGGTTCGTGTGCGTACAGAGGCTGGTGCTCACTGGTCGCTGCAAGTGTTCCCGCCGCGCCTTGTTGTAACCTCTGATCGTGGTAATTTAGCACTAGACAGTCAGCTTAGTTATGATGTTATCAACTTCCCAGATGTTGTGCATCCTGACTATATCGGTACTCCAGTATTCCCAGCACCGTGTCACGCATCTGTTTATCCTATTGCTGCTCGCATACAGGATGCTAATGCGTTTGAGTATTATCACTATATCGGTACGGTTGCTGGTTGGATGTATCTTGACTTCACATCGTGGGAGACCTATGACTTTATTGAGGTCTATCATAGTGGTCGTCGTATTGCTACAACGCTTGACGCACAAACAGCAAACGGTTATCTCTACTTCCTGTTTGACCCACGTGGCAGTAACTGCTATGACCTGATGATTCGTGTAGTCAGCAAGGATTTTGGTTCAGCAACTAGTTTACAGTCGAACTACTACAATCTGTACTGCCCGTCCGAACGTGGTGCGCGTGAGTACAGACACCCTTGTGAAAGCTATACAGTCAGCAGCATGGGTCATCCTGTTACAGAAGACTGCTTTGCACTTGGTGCGCAGACAGATATTCGTGCTGGTTTGATTCAGGTCAACAGTGGCAACTTCGCTACCAAGTTTGAAGTGTTTGATCAGAGCATGAACCTGCTTGACACAGAGATTCTTGGAGCTAACTCTACTGGTACGCTTGAGTTCTGGAAGTATCCCGAACATGTGCTGCGTCAGAACATCGTGGTGCGAGTGACGGCAGCTATTGGTTGTGACTGGCAATACTTTGTTTACTGTCCTGTGCAGCCGCCTAAGATTGACGTCAGCGACTTCCTTGTTCCTTATCGTTGCGTTGTTATTGAGGGAGGTTCAGCACAGCCGCCAATAGCTGATGATTTACCTTGGTTCTGTTACGCATTCGATCAAGTTGATGGTCGCGGTGTTAGTGGCAGTGTAGCGAATCTCAAAGCGTGGGATGGCAGCTACATGAACTTCTGGGGTGGCTCTCAAGGCTGGTTCAAGTTCAACAACAGCTTCGTCAAGCCTATCAAGCAGATCACATTCCAGTGGGTGTTTGATGGTATCAACGGAGCATGGCATGATATGTCTATCTATGAGCGTTATGCTGGTGAGGCTGCTGCACAGCGGGTATACAACAGCGCCAACGTCATGCAGACAATTACGTTTGATACCAACATTCCAGCAGGCGAAGAAGTTTGGCTGTACGCGTTTGGTGGTGGAGATCGCGGTAACTCGAATGATGTGACCTATCTTGCAATTTCAAACATCGTATTTGGTTAG

Genome Context

Tertiary structure

YP_009789504.1
ESMFold structure
Source ESMFold
pLDDT 45.9
Oligomeric state monomer