Genbank accession
XHB26124.1 [GenBank]
Protein name
endopeptidase
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,54
TF
Evidence RBPdetect2
Probability 0,89
Seq2Symm
C3 confidence 0,964 truncated
C3 0,964
C1 0,046
C2 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MTTFLDHKDNEFEAQAVVKTTNAVNGERSLSGTIYTNEEVLNKVDKGWKLEFDDEYYKIIYAKPTDTGNKIQVEFDAVHQFFYDFDKSSLHKQLNDGSHTFQAYLNFIFNGSGYTYSLEVVVKSFEKQSFGYKSRLDLFNDIIKSAGVEFFVRGKVVRILQKTGTDLSTIVRKNFNMNEIIIEKKINDFITYQKGFGAWTDQEDHSKGRLEVEYESPLAKEYGRIEGEPVVDERYTNADNLKSVLKQNVDSSYNIAVKIDIEDLTKAGYQYTQPIAGDYIMAINETLGFKEKIRIVSFESEYDVTGQLINHKVICNDIGTIKKQTVAVSQLSSKINNNQEILDNAVFKANQALASADGKNTNYYGTEMPVDDPKGTLRKGDLLFLTVGDTTRMYFWNGAEWIINSFSDDIDFVKKEITNKIIEVNAAMKLADEQLTEKYNAIVAKNVSQDELINQAKNLSDSAKKDATEALTNLISESKKLTDKMSALSKTEVEHYSTTNLQLTQLDGTVKGLQTSYEALLKKDGDITQTLANYKQTIDQNSTSITANKKTVDGTLSSLQTQVTQTANEITTRLSQTNIEALITSKSAVIADNKVKETADSFSREITRVNNTIDNLKIGTVNLLSGTKNWTKNWFNRNNWQSDDDNLTIGNFSLTVLKRKAMWSGISQLYAVKSGENYVFSAYAKSSMDNDVVNLYLLPNGQSPQAKISISFKSITLNTDWQRIVIKFNVTSDGYILPRFERFNENGWLYIAGYQLEHGNVASDYSEAPADQEDKMTVEFNKINDTVNSHSQLIGKQNESLTATIQKVDNIQSTVSNVDGRLSRVTQTADGIVTTVSQLDNNILPGTKNFTGWQIEGAVLEDVTQSSYPFVFKKWISGNKVSPLIEYDVKKNQEYTFTAYIAREQAGNLYFYLYDLWNHHITSATPRETIIRDVNSSVIRFRITFIPNRDGKIRPRFAMLASDQGWFMVGGFMLSKGTADLPWSESKQDIKDNVTAINTIVAQTANSWAIKNLTSNGTVLSQLNLTDGNVKLEGKLIHLSGQSIIDNGIITNAMIKDLTADKITAGTIDANRINVINLDASNITSGRMSADLIRSGVLISQNGAMLTDLNTGQIEFYTDNPAIKRITAGYPNQFVKFATGNVEGKGAAGVTVIGSNRWGSESSNDGGFVGIRAWNGKDIDTLDLVGDSIHLASSAYTNADGWEIITLPNQLSIDARNINHRVTSKVKVGDIWLWKNTSTYVSMKDTINMIIDNLQLLHNNKTTEKGYSYTIPGKI
Physico‐chemical
properties
protein length:1275 AA
molecular weight: 142455,07710 Da
isoelectric point:5,56507
aromaticity:0,09020
hydropathy:-0,40549

Domains

View on InterPro
XHB26124.1
1 1275 aa
STR 79–164 · ENZ 165–301 · STR 621–757 · RBD 1010–1196 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Phage
Streptococcus phage phiGBSVK-C_GBSInt4 [NCBI] · taxon 3345062
Host

Coding sequence (CDS)

Genbank protein accession
XHB26124.1 [NCBI]
Genbank nucleotide accession
PP758848 [NCBI]
CDS location
range 32174 -> 36001
strand +
CDS
TTGACAACTTTTTTAGATCATAAAGATAATGAGTTTGAAGCTCAAGCTGTTGTTAAAACAACTAATGCAGTTAACGGAGAAAGGTCTTTATCAGGAACAATTTATACTAACGAAGAGGTACTAAACAAGGTCGATAAAGGTTGGAAACTTGAGTTTGATGATGAGTATTACAAGATTATTTATGCTAAACCTACTGATACTGGTAACAAAATTCAAGTTGAATTTGATGCAGTTCATCAATTTTTTTATGATTTTGATAAATCATCACTACATAAGCAATTAAATGATGGTTCACATACTTTCCAAGCATATTTGAACTTTATTTTTAATGGCAGCGGGTATACTTACAGTTTAGAAGTAGTTGTCAAATCTTTCGAAAAGCAATCGTTTGGATATAAATCGCGACTTGATTTATTTAATGACATCATTAAGAGTGCAGGAGTTGAATTTTTTGTTCGTGGCAAGGTTGTTCGAATTCTACAAAAAACAGGAACAGATTTATCAACAATCGTACGTAAAAATTTCAATATGAATGAAATCATAATTGAAAAGAAAATCAATGATTTTATTACATATCAGAAGGGTTTTGGAGCGTGGACTGACCAAGAGGATCATTCCAAAGGAAGGCTCGAAGTAGAATATGAAAGTCCACTTGCAAAGGAATATGGACGAATTGAGGGTGAGCCTGTTGTTGATGAGCGGTACACTAACGCTGACAATTTAAAATCAGTACTAAAACAAAATGTAGATTCGTCTTACAATATCGCTGTAAAAATTGACATTGAAGATCTTACAAAAGCAGGTTATCAGTACACTCAACCTATTGCCGGTGATTATATTATGGCTATCAATGAGACACTAGGATTTAAGGAAAAAATCCGAATAGTATCGTTTGAAAGTGAGTATGATGTAACAGGTCAGCTGATTAACCATAAAGTCATTTGTAACGATATTGGTACAATCAAAAAACAAACTGTAGCTGTTAGCCAATTATCAAGTAAGATTAATAATAACCAAGAAATACTAGATAATGCAGTATTTAAAGCAAATCAAGCACTAGCATCAGCTGATGGTAAAAACACTAACTACTATGGTACGGAGATGCCAGTAGATGATCCAAAAGGCACGCTAAGAAAGGGTGATTTGCTTTTTTTAACTGTTGGCGATACTACCAGAATGTATTTCTGGAATGGTGCTGAATGGATTATCAATTCTTTTAGCGACGATATTGATTTTGTAAAGAAAGAAATTACTAATAAAATCATAGAGGTTAATGCAGCAATGAAACTTGCTGATGAACAGTTAACTGAAAAATATAATGCAATTGTTGCTAAAAATGTTAGCCAAGACGAATTAATTAATCAAGCAAAGAATTTGTCTGATTCTGCCAAAAAAGATGCTACAGAAGCATTGACAAACCTTATTAGTGAATCTAAAAAACTGACGGATAAAATGTCTGCGTTATCTAAAACAGAAGTTGAGCATTATTCAACAACTAATCTGCAACTGACACAACTTGATGGTACAGTCAAAGGATTACAAACTAGCTACGAGGCATTGTTAAAAAAAGATGGAGATATCACTCAAACACTCGCTAATTATAAGCAGACGATTGATCAAAATAGTACAAGTATTACTGCTAACAAAAAGACTGTTGATGGTACGCTTAGCAGTCTACAGACCCAAGTCACACAAACGGCTAATGAAATTACAACGAGATTATCTCAAACAAATATTGAAGCGTTGATTACAAGTAAGTCTGCTGTTATCGCTGATAATAAAGTCAAGGAAACTGCAGATAGTTTTAGCAGAGAAATAACTCGTGTTAATAATACTATTGATAATTTAAAGATAGGTACAGTTAATCTACTATCTGGTACTAAAAATTGGACTAAAAATTGGTTTAATCGTAATAACTGGCAATCTGATGACGATAACTTGACTATTGGTAATTTTAGCTTAACAGTGCTAAAGCGCAAAGCAATGTGGAGTGGTATATCACAATTGTATGCTGTAAAAAGCGGAGAGAATTACGTTTTTAGTGCATACGCTAAATCGAGCATGGATAATGACGTTGTGAATTTATATTTATTACCAAACGGTCAATCGCCGCAAGCAAAGATAAGTATTAGTTTCAAGTCAATCACTCTAAACACGGATTGGCAACGTATCGTTATTAAATTTAATGTAACTTCTGATGGCTATATCTTACCGCGTTTTGAACGTTTTAACGAAAACGGATGGTTGTATATTGCAGGCTATCAGCTAGAACATGGAAACGTTGCAAGTGACTATTCAGAGGCACCAGCCGATCAAGAAGACAAAATGACTGTTGAATTTAATAAAATCAACGATACAGTTAACAGCCATAGTCAATTGATTGGTAAACAGAACGAGAGTCTGACGGCTACAATACAAAAAGTTGATAATATACAATCAACAGTATCTAATGTTGATGGACGTTTGTCACGAGTTACACAAACTGCCGACGGTATAGTCACAACAGTTAGTCAGCTTGATAATAATATTTTACCTGGCACAAAAAATTTTACAGGATGGCAAATAGAAGGTGCAGTACTAGAAGATGTAACACAATCATCTTATCCATTTGTCTTTAAAAAATGGATAAGCGGCAACAAGGTATCGCCCTTAATCGAATATGATGTTAAAAAAAATCAAGAGTACACATTTACTGCATACATTGCTAGAGAACAAGCAGGTAATCTATATTTCTACTTGTACGATCTTTGGAATCATCATATCACAAGTGCAACCCCTCGCGAAACCATTATAAGAGACGTTAATTCTAGTGTAATACGATTTAGAATAACATTTATTCCAAATAGAGACGGTAAAATCAGACCACGGTTCGCAATGTTGGCCAGTGATCAAGGCTGGTTTATGGTTGGTGGTTTTATGTTATCTAAAGGTACCGCTGATCTACCCTGGTCTGAATCCAAGCAAGATATCAAAGATAATGTTACTGCGATTAATACAATAGTCGCACAAACAGCGAACAGTTGGGCTATTAAAAATTTGACTTCTAACGGTACTGTATTGAGTCAGCTTAATTTGACTGATGGTAACGTAAAACTGGAAGGTAAGTTAATACATTTGTCAGGTCAATCTATTATTGATAATGGCATTATTACTAATGCGATGATAAAAGATTTAACTGCAGATAAGATTACAGCAGGAACAATTGATGCTAATCGTATAAATGTCATTAATTTAGATGCTAGTAATATTACCAGTGGAAGAATGTCAGCGGACCTGATACGTAGCGGCGTTTTAATATCGCAAAACGGTGCAATGTTAACCGATCTTAATACAGGACAAATTGAATTTTACACAGATAATCCAGCTATCAAACGTATTACTGCAGGTTATCCTAACCAATTCGTTAAATTTGCAACAGGTAATGTTGAAGGAAAGGGCGCGGCTGGCGTAACGGTTATAGGTTCTAATCGATGGGGAAGTGAATCGTCAAACGACGGTGGCTTCGTTGGTATTCGCGCTTGGAATGGTAAAGACATCGATACTCTTGATTTAGTTGGCGATAGTATTCACTTAGCAAGCTCTGCGTACACTAACGCTGATGGTTGGGAAATCATTACTTTGCCAAATCAGCTATCAATAGATGCACGTAACATAAATCATCGTGTAACGTCTAAGGTAAAAGTAGGAGATATTTGGCTATGGAAAAATACATCAACTTATGTAAGCATGAAAGATACAATTAATATGATTATTGATAACTTGCAGCTACTACACAATAATAAAACCACTGAAAAAGGCTACAGTTATACTATTCCAGGAAAGATTTAG

Genome Context

Tertiary structure

XHB26124.1
ESMFold structure
Source ESMFold
pLDDT 60.7
Oligomeric state monomer