Genbank accession
YP_009910765.1 [GenBank]
Protein name
hydrolase
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,61
Seq2Symm
C1 confidence 0,971
C1 0,971
C3 0,447
C2 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MDRIQLRRDTSTRWKELNPVLLEGEPAFETDTRLRKIGDGVNPYNDLDYLAAENVVQGLGDSTTGAISQNTIAKLAKKQLVLFEGFVNIPTSSVINERYEGLDGTVVYNNTSRHFVYSVNGSYYSSWSDCELYGTPYSYGRVPYINKLYSYSGRTYHVTGFGFAIIEDPVVIPVADELKTSDYLYNIFYNPTTGIETFEPSRLTTDFIAVDEGFIFDYTLTGYSSNIAVAAFDANKNILIDKSVIVNVPSASAPNTGRYIVDSTVRFIRVTRLNNANGLVQTFIHNKADYSSLAKESFNGIKTLMNADFTVEGVYINPSTGLESPNPTYSATPFISIVPKETIYYSGLNGTNGAAIIGIYDKNKTPINLIRGESTYEGRVYVAPEGAAYIRFSYLVTDNPVVIKLISETSKANMTTKNKNNLIINGFDEFVVSGTWSRNGKNLKVTGGGFTAARLFSETFEDEFVMSCKLRTNSAGYFECGIGKGSNAGNYVGVWVTICSNASGSFLKLYYNINGSYVEQTNLRQTIAKGLQGSNWYVLQLSKTTDAASTLSAKVYDNTTGELLASLSTSPNATYAWGYPTCVNINNTNEFSGFTMYYPKNVYPSVAVYGDSFVEGDTVRTTKNVRWSALLQAQLGKKNCLLYGHGGASSKSDTTRILFQINRISSQYAIIALGQNDASFEAWYQYIDYMLNLCKMCDTVPILVTTCPQVNQSESYITKMTSINTWIRNSGYNYIDANMAVAINGVTWKDGYVLSDGIHPSALGHQAIYDRIAFDCPFLFNN
Physico‐chemical
properties
protein length:782 AA
molecular weight: 86499,03460 Da
isoelectric point:5,64050
aromaticity:0,12404
hydropathy:-0,18146

Domains

View on InterPro
YP_009910765.1
1 782 aa
ATT 3–45 · STR 46–74 · STR 593–774 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_009910765.1
1 782 aa
Domain Start End Length (AA) Confidence
N-terminal 1 173 173 0,8963
Central domain 174 381 209 0,8873
C-terminal 382 782 400 0,3961
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009910765.1 [NCBI]
Genbank nucleotide accession
NC_049977 [NCBI]
CDS location
range 20095 -> 22443
strand +
CDS
ATGGATAGAATACAATTAAGAAGAGACACATCAACAAGATGGAAAGAATTAAACCCTGTATTACTTGAGGGAGAACCAGCTTTTGAAACTGATACAAGACTAAGAAAGATTGGGGATGGTGTTAATCCTTATAATGACTTAGACTATTTAGCAGCAGAGAATGTTGTTCAAGGTTTAGGAGATAGTACTACAGGAGCTATATCACAAAATACTATAGCTAAATTAGCTAAGAAACAATTAGTTTTATTTGAAGGATTTGTGAATATTCCTACTTCCTCAGTTATAAATGAAAGATATGAAGGTCTTGATGGAACTGTTGTTTACAATAATACTTCCAGACACTTTGTTTACTCAGTAAATGGTAGCTACTATAGTAGTTGGAGTGATTGTGAACTATATGGTACTCCTTACTCTTATGGTAGAGTACCCTATATTAATAAACTTTATAGTTATTCAGGTAGAACATACCATGTTACAGGTTTTGGTTTTGCAATTATAGAAGACCCTGTAGTTATTCCTGTTGCAGATGAACTTAAGACATCTGATTATTTATATAATATATTTTATAATCCAACAACAGGTATTGAAACTTTTGAACCTTCAAGATTAACTACAGATTTTATAGCAGTTGATGAAGGTTTTATATTTGATTACACTTTAACAGGGTATAGTTCAAATATTGCAGTTGCAGCATTTGATGCTAATAAGAATATCCTAATAGATAAGAGTGTTATAGTAAATGTCCCATCAGCATCAGCTCCTAATACAGGAAGGTATATAGTAGATAGTACTGTTAGGTTTATTAGAGTTACAAGATTGAATAATGCTAATGGATTAGTTCAAACCTTTATTCATAATAAAGCAGATTACTCTTCTTTGGCAAAAGAATCATTCAATGGTATTAAAACACTTATGAATGCTGACTTCACTGTAGAAGGTGTATATATTAATCCAAGTACAGGGTTGGAATCTCCTAATCCAACTTATTCAGCTACTCCTTTTATATCTATAGTACCTAAAGAAACTATATACTATAGTGGGCTTAATGGTACAAATGGTGCAGCTATTATAGGAATATATGATAAGAATAAGACACCAATTAATCTAATTAGAGGAGAAAGTACTTATGAAGGAAGGGTTTATGTAGCTCCAGAAGGAGCAGCTTATATTAGATTTAGTTATTTAGTAACCGATAATCCTGTGGTTATTAAACTTATAAGTGAAACTTCTAAGGCTAATATGACTACTAAAAACAAGAATAATCTTATTATTAATGGATTTGATGAGTTTGTAGTTAGTGGAACATGGTCAAGGAATGGTAAGAACCTTAAAGTAACTGGAGGTGGATTTACTGCTGCAAGATTGTTCTCAGAAACATTTGAGGATGAATTTGTTATGAGTTGTAAGCTAAGAACAAATAGTGCAGGCTATTTTGAATGTGGTATTGGTAAAGGTTCTAATGCAGGTAATTATGTAGGTGTTTGGGTTACTATATGTAGTAATGCAAGTGGTTCATTCTTGAAGCTATATTATAATATAAATGGTTCTTATGTAGAACAGACTAATTTAAGACAAACTATTGCAAAGGGTTTACAAGGTAGCAACTGGTATGTACTACAACTAAGTAAAACTACTGATGCAGCTTCTACATTATCAGCTAAGGTTTATGATAATACAACTGGTGAACTGTTAGCAAGTTTATCTACTTCTCCTAATGCTACTTATGCTTGGGGTTATCCAACTTGTGTTAATATTAATAATACAAATGAATTCTCAGGATTCACTATGTATTATCCTAAGAATGTTTATCCATCAGTAGCAGTATATGGAGATAGCTTTGTTGAAGGAGATACAGTAAGAACTACTAAGAATGTAAGATGGAGTGCTCTACTACAAGCTCAACTTGGAAAGAAAAACTGTTTATTGTATGGTCATGGAGGTGCTTCTTCTAAGAGTGATACTACAAGAATACTGTTTCAGATAAATAGAATAAGCAGTCAGTATGCTATAATAGCACTTGGTCAGAATGATGCTTCCTTTGAAGCATGGTATCAATATATAGATTATATGCTTAATCTATGTAAGATGTGTGATACTGTGCCAATACTTGTAACAACTTGTCCTCAAGTTAATCAGAGTGAAAGTTATATTACAAAAATGACTTCAATCAACACATGGATTAGAAATTCAGGGTATAATTATATTGATGCAAACATGGCTGTAGCAATAAATGGGGTAACATGGAAAGATGGGTATGTATTATCTGATGGTATTCATCCTTCTGCATTAGGACATCAAGCTATCTATGATAGAATAGCTTTTGATTGTCCATTCTTGTTTAACAATTAA

Genome Context

Tertiary structure

YP_009910765.1
ESMFold structure
Source ESMFold
pLDDT 69.2
Oligomeric state monomer

Literature

Title Authors Date PMID Source
PhiCrAss001, a member of the most abundant bacteriophage family in the human gut, infects Bacteroides Shkoporov,A.N., Khokhlova,E.V., Fitzgerald,C.B., Stockdale,S.R., Draper,L.A., Ross,R.P. and Hill,C. 2018-06-26 — GenBank