Genbank accession
YP_009837335.1 [GenBank]
Protein name
virion structural protein
RBP type
TF
Evidence RBPdetect2
Probability 0,50
Seq2Symm
C1 confidence 0,995 truncated
C1 0,995
C2 0,009
I 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNNKFKVGELLHKRSPFSKTWINFDGSYTMETFNEVVHYEDDGGQLRTVNPMLSREADTDDYQGIKVPFDARVPHLFASGYSISHDDEQLIFIPVGARKVKGKVNPDKINEVIYRSAWTSTDVKLEVTPTSLKETIILKTEKAPTTFQFIVDGDTDGNLQLAPAWLTDANGVYRDVEQVVKDGIVTLTVDTDGLAFPIEVDPTIFVGNLVGAKNDNTVYSNNSDGVYLNEQSVALLSNDIRRIYSKYPNMIKGIPTDAKITKATLTVYASGFDGTLKFRVHAVASDYNPDTLTWRSQPLISDNLVSPEVTLQVGSPSWNPIDITSIVQAKLDGTQVSALVMKSSNLSSGGDATIALSNNPYSGTRPFITVEFNAPPSKPTVVSPNGGETVAGSQAISWTASNDIRDYTEDPFIAKDAIIFSNKLAVGQSFTMNADNALIKRIYLRLGVSNSGLSYKMSLYHTNGSTGYWLADKSRLVAQGDVVFESGTSPVWCYADLPSVAVTKGNRYAIVIEAKDGSSVTYQMSRTDTYRSNANGCAMVQDSTSSTFTGFDMDFLYKIVYSSGEAASQLRYNVQLSSDSGSTWKDIIPLSFAGATSQSYNFGNELETSTAKVRVRAYDGVSYGPWDESDGVFTISQNDPPGAPDNLAPNGTSIDRSKVTRMSWRHNDPDGNDPQSKFEINWRMQGSSSWTVVTQNSVNQYYDAPTNTFPAGKIEWRVRTYDQGGLVGPYSTVTVFTAAGTPTTPIITSPANNSTLPDANPTITWSHPDQVQYRVRVFKTSDNSMVFEAIKISPNKALTITTALANSTAYYVNVAIADSSGLWSNDARVNITISYTQPNTPTLSATVDNINGTVSLSVLNPFATGNTPRTDFNEFFRKTGNGEWIKVQRLSNPNTGLVNWTDRMPTPNATEVYKVRAVGSNGAYVDSSSVTVVVSLRDTQLAVASNTLSYVTLRKREGSKEVTGRKSVSSDFVGRPYPMTEFGSNLNRTMDYRYKVENWDDVLQIREYAQLGEAFILRDNWGKKDFVTFDTVNIDEGRTFWYVSIHLTKVYYQEAIE
Physico‐chemical
properties
protein length:1057 AA
molecular weight: 116415,19670 Da
isoelectric point:5,22699
aromaticity:0,10123
hydropathy:-0,36282

Taxonomy

Phage
Bacillus phage Carmen17 [NCBI] · taxon 2072797

Coding sequence (CDS)

Genbank protein accession
YP_009837335.1 [NCBI]
Genbank nucleotide accession
NC_048698 [NCBI]
CDS location
range 27706 -> 30879
strand -
CDS
ATGAATAATAAGTTTAAAGTTGGAGAGTTGCTGCATAAGCGCTCTCCTTTCTCTAAAACATGGATAAACTTTGATGGCTCGTACACAATGGAAACCTTCAACGAGGTTGTACACTATGAAGACGACGGCGGACAACTTAGAACGGTTAACCCTATGCTTTCCAGGGAAGCAGATACAGACGACTACCAGGGAATTAAAGTACCGTTTGACGCACGAGTGCCGCACCTATTCGCTTCAGGGTATTCAATCAGTCACGACGACGAGCAATTAATTTTTATCCCTGTAGGAGCTAGAAAAGTAAAAGGTAAAGTCAATCCTGATAAGATTAACGAGGTTATTTATAGAAGTGCCTGGACAAGTACCGACGTTAAATTAGAAGTAACGCCAACTAGTTTAAAAGAAACTATCATTCTTAAAACTGAAAAAGCGCCTACTACTTTCCAGTTTATCGTTGATGGTGACACGGACGGAAATTTACAACTCGCTCCTGCCTGGTTAACAGATGCAAATGGAGTATACCGTGATGTGGAACAGGTAGTAAAAGACGGGATTGTAACGTTAACAGTCGATACCGACGGACTAGCTTTTCCAATTGAAGTCGATCCGACTATATTCGTTGGAAACTTGGTAGGCGCTAAGAATGATAACACTGTATACTCTAACAACTCGGACGGTGTTTATCTAAACGAGCAATCAGTAGCGCTATTAAGTAACGATATCCGCCGTATTTACTCTAAATATCCTAACATGATTAAAGGTATCCCGACGGATGCGAAAATAACTAAAGCAACGTTAACGGTTTATGCAAGTGGGTTTGACGGAACGCTTAAATTTAGAGTGCACGCCGTAGCATCGGACTACAACCCTGATACTCTTACATGGAGAAGCCAGCCGTTAATATCTGATAATCTAGTATCTCCTGAAGTAACTTTACAAGTCGGATCGCCTAGTTGGAATCCAATAGACATTACGAGCATTGTACAGGCTAAACTGGACGGTACACAAGTTAGCGCTCTTGTAATGAAATCGTCAAATTTAAGTTCAGGTGGTGACGCTACGATAGCGTTATCGAATAATCCATATTCAGGGACACGTCCTTTCATTACTGTAGAATTTAATGCACCACCTAGCAAGCCTACAGTCGTAAGTCCAAACGGTGGGGAAACAGTAGCAGGCAGTCAAGCGATCTCGTGGACAGCATCAAACGATATCAGGGATTACACGGAAGACCCGTTTATTGCTAAAGACGCTATCATATTCAGTAATAAACTAGCAGTTGGGCAATCCTTCACGATGAATGCTGATAATGCATTGATTAAACGTATCTATCTACGCCTAGGCGTGTCCAATTCAGGACTTTCATATAAAATGTCACTTTATCACACAAACGGCTCTACAGGCTACTGGCTCGCTGATAAGTCGCGTTTAGTTGCGCAGGGAGACGTAGTATTTGAAAGTGGTACCTCTCCAGTATGGTGCTATGCTGATCTGCCAAGTGTAGCAGTTACAAAAGGTAACAGGTACGCAATCGTAATTGAAGCAAAAGACGGATCGTCGGTTACTTACCAAATGTCGAGAACTGATACTTACCGGTCTAATGCGAATGGTTGTGCAATGGTACAAGATTCTACTAGTAGTACATTCACTGGTTTTGATATGGACTTTCTGTACAAGATTGTTTATTCTTCAGGTGAAGCGGCAAGTCAGCTAAGATACAACGTTCAGTTATCGTCTGATAGCGGCAGCACTTGGAAAGATATTATTCCTTTATCGTTTGCAGGCGCAACGAGTCAATCTTACAATTTTGGTAATGAACTTGAAACATCGACGGCTAAAGTCCGAGTACGTGCATATGACGGCGTATCATATGGCCCGTGGGATGAATCAGACGGCGTATTCACAATTAGCCAGAATGATCCTCCTGGAGCGCCTGATAACCTAGCACCAAACGGTACCTCTATTGATCGCTCTAAAGTTACTCGGATGTCCTGGAGGCACAACGATCCAGACGGGAACGATCCACAGTCAAAATTCGAGATAAATTGGAGGATGCAAGGCAGCTCATCCTGGACAGTTGTTACGCAAAATAGCGTAAACCAGTACTATGATGCACCGACCAATACATTCCCAGCAGGTAAGATCGAGTGGAGAGTTAGAACATATGACCAGGGCGGACTAGTTGGCCCGTACTCAACTGTTACAGTATTCACAGCAGCAGGAACGCCAACAACTCCTATTATCACGAGTCCTGCGAATAACTCGACGCTACCAGACGCCAATCCAACCATTACATGGTCACACCCAGATCAGGTGCAGTACAGAGTTAGAGTATTCAAGACTTCAGATAATTCTATGGTATTTGAGGCCATAAAGATCAGCCCTAATAAGGCATTAACAATAACTACAGCACTTGCCAATAGTACGGCTTATTATGTTAACGTTGCGATAGCGGATAGTTCAGGGCTATGGAGTAATGATGCTAGGGTTAACATTACAATCTCTTATACACAGCCTAACACACCTACCTTATCGGCTACAGTTGACAATATAAACGGGACTGTATCGCTAAGTGTACTCAATCCATTTGCTACAGGGAATACACCGAGAACGGACTTTAACGAATTCTTCAGAAAGACAGGTAACGGGGAATGGATCAAAGTGCAGAGGCTTTCAAACCCTAATACGGGCCTTGTGAACTGGACGGACAGAATGCCTACGCCAAATGCTACTGAAGTGTATAAAGTGCGTGCAGTGGGCTCGAACGGCGCTTATGTAGACAGTAGCTCGGTAACGGTAGTTGTTAGCCTGCGGGACACGCAATTAGCAGTTGCATCGAATACACTGTCATATGTTACACTTAGAAAAAGAGAAGGTAGTAAAGAGGTAACGGGCCGTAAATCAGTTTCAAGTGACTTTGTAGGCCGTCCGTATCCTATGACAGAGTTCGGCAGTAACTTAAATAGAACAATGGATTACCGGTACAAAGTAGAGAACTGGGATGACGTATTACAGATCAGAGAATATGCGCAACTAGGCGAGGCGTTCATTTTACGTGACAACTGGGGTAAAAAGGACTTTGTCACTTTTGATACAGTTAACATTGATGAGGGCCGCACATTCTGGTACGTGTCGATACATCTTACAAAAGTATATTACCAGGAGGCGATAGAATGA

Genome Context

Tertiary structure

YP_009837335.1
ESMFold2 structure
Source ESMFold2
pLDDT 80.7
Oligomeric state monomer