Genbank accession
UVD42807.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,73
TF
Evidence RBPdetect2
Probability 0,42
Seq2Symm
C3 confidence 0,961 truncated
C3 0,961
C1 0,243
C2 0,002
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MANKILRLDISKIPDLTPIIYGRVADGLVQTVDVYVTNNGEPFDLTGWVINFEGNTSGNRTYVKDLEGIVMVDRTKGHFTYTFPLIAFSTAGKYERAYFSFVKGDQRESTSDFNIQVFENADITVEEAHTVITEYEELVDELNRIFLEAQTELQQDFDEFKKNYDTRYNNYITDLTNKINAAQNKIDILNSNYEKTNAKLTDLEERMNDLVNDGLLKMEDVLSFLAGKNVKIKVPIDFAGKISGSTAENPNVMKFGTIPAANINSVGTVNDGTELISDDVAATMWKNYKNVSALDGKLAQAQQTLNGQVTFHLARIDAVSEISRRFPNLFINVGATTRSQQKEQLIKKATFVSATAYGFGSVGDVYKYTIGRSNWTTTGTTWQGWTGWGIDNNSHSSSKPDPVTAGVGSVDTIMDQNGVMAFIMGVPTPSDGTKMLRTNLDYFVCEITLNLNINDLIPKPDLSKYYTKDEMNEAFTEHSLYSNSLDFGNYDYSGNANLMTPLKASDFYKVTGGTIEDIGNALKVTFTKTDGATFLETMKSVPALLPNKQYTLSADVTVTEGYSGKLENLRLGYRKSPNGTIILPLTAKDAQVGKKTKIFITANSSSATDPSIFDRMYFTINTTSTEPFVGTVLIENIKVEEGSTATPYQPNLLDEPYYLSKAVWGENLIDPAVKFPITSSVETLYSGRTPEDFVEGETYTVTIGATKPSAQSFGVYLALKNHTIFKPVEGLHNTWTATLKIDILGEKKNAVYIYQSPASSVGACQIDWLKIEKGDTRTPNLNAPFKYKGIGFTKSSNPKDYNWNSAPENVDFIEKNAASNEAKIDEIDKNVVKTSGNQNITGLKNFTGTLQSSGVEVAKKGDSYTKTETYTKTEVDSKYIPKTQENTFVKTIGNQNVVGTKNFSDPRKNDALMYALTDEAMRPSDFNFAGDFTKVMTARSMRVMQRRLPWMKTFGWFGTGEGSANDIDEGFKQYIQTNSTTDADITNYQFIRKGRKVQFFARIKFTSATGTDVATFAQVPTGFRLSNAAKYTYWNVPLTCVQFNAPERINYKGFVERLGTNNIKIGTATYTGNTYWYGEWETSDPYPTSFTDEVTERMMAHRGATVSYPENTLEAFKAAIDLGYGGVELDPRLTSDGKLYLMHDDTVDRTTNGTGNFADLTEAQVKALNIKIDPVKYPNLVGQTLKVPSLSSVLLALRGTDLTINFDGSKIDLSVASTAKMIHDMIVSYGLEKRVFFVINNKTQRDAFHKLYPQYPVSWLWNSPGSRAAGTVNEIYAYGKHGGALLSIPMAVLNDDTSMRDIQASGVYYQVYGVQTEADYETCRLMRVPMIETDQLYPNLDFL
Physico‐chemical
properties
protein length:1343 AA
molecular weight: 149376,09590 Da
isoelectric point:5,30856
aromaticity:0,10648
hydropathy:-0,38325

Domains

View on InterPro
UVD42807.1
1 1343 aa
ATT 1–143 · STR 815–854 · STR 1082–1343

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

UVD42807.1
1 1343 aa
Domain Start End Length (AA) Confidence
N-terminal 1 326 326 0,9969
Central domain 327 749 424 0,7398
C-terminal 750 1343 593 0,2112
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Enterococcus phage TJE4 [NCBI] · taxon 2951264

Coding sequence (CDS)

Genbank protein accession
UVD42807.1 [NCBI]
Genbank nucleotide accession
ON506926.1 [NCBI]
CDS location
range 70413 -> 74444
strand +
CDS
ATGGCAAATAAGATATTACGTCTTGACATTTCAAAAATTCCAGATTTGACTCCTATCATCTATGGGCGGGTCGCTGATGGACTCGTCCAAACTGTTGATGTATATGTCACGAATAATGGAGAGCCTTTTGACCTAACAGGTTGGGTCATTAACTTTGAAGGTAACACAAGTGGGAACCGAACATATGTAAAAGATCTTGAAGGAATCGTTATGGTTGATCGCACAAAAGGTCATTTTACTTACACATTTCCACTGATCGCTTTTTCAACAGCTGGAAAATATGAACGAGCATATTTTTCATTTGTGAAAGGAGATCAAAGAGAATCGACTTCAGACTTTAACATTCAAGTATTCGAAAATGCAGACATCACTGTTGAGGAAGCTCATACAGTCATTACAGAATATGAAGAATTGGTTGATGAATTAAATCGTATTTTCTTGGAAGCACAAACTGAATTACAACAAGACTTCGATGAGTTCAAGAAAAATTACGATACGAGGTACAATAACTACATTACTGATCTTACGAATAAGATTAATGCGGCTCAGAATAAAATCGATATTTTAAACAGTAATTACGAGAAAACTAACGCAAAACTCACTGATCTAGAAGAAAGAATGAACGATTTAGTGAATGATGGGTTACTAAAAATGGAAGATGTGCTTTCATTTTTAGCTGGTAAAAATGTTAAAATTAAGGTTCCTATCGATTTCGCTGGAAAAATTTCAGGTTCAACTGCAGAAAATCCTAACGTAATGAAGTTTGGCACAATACCCGCAGCGAATATAAACTCTGTAGGAACAGTGAACGATGGAACGGAATTAATTTCTGATGATGTAGCAGCAACAATGTGGAAGAACTATAAAAATGTTTCTGCATTAGATGGAAAACTTGCTCAAGCACAACAAACGCTAAATGGTCAAGTCACTTTTCATTTAGCAAGAATTGATGCAGTGTCAGAAATAAGTCGTCGTTTTCCAAACTTATTCATCAATGTAGGAGCGACTACTCGTTCACAACAAAAAGAACAATTAATAAAGAAAGCTACTTTTGTTAGTGCAACTGCTTATGGCTTCGGATCAGTAGGAGATGTATATAAATATACAATTGGCCGATCTAACTGGACGACAACTGGAACGACTTGGCAAGGTTGGACTGGTTGGGGCATTGATAATAATAGTCACAGTTCTTCCAAACCCGATCCTGTAACAGCAGGTGTTGGATCCGTTGACACAATAATGGATCAAAATGGTGTAATGGCTTTTATTATGGGCGTACCTACCCCATCAGATGGAACAAAAATGTTAAGAACTAATTTAGATTATTTCGTTTGTGAAATAACTTTAAATTTAAACATTAACGACCTAATTCCTAAGCCTGACTTAAGTAAGTATTACACTAAGGATGAAATGAATGAAGCATTCACTGAACATTCATTATATTCTAACTCATTGGATTTTGGCAATTATGATTATTCAGGAAATGCTAACTTAATGACTCCTCTAAAAGCTAGTGATTTTTATAAAGTTACTGGTGGTACTATAGAAGATATAGGAAATGCATTAAAAGTAACTTTCACAAAAACTGATGGTGCTACTTTTTTAGAAACTATGAAGAGTGTTCCAGCTTTACTTCCTAACAAACAATACACGTTAAGTGCAGATGTTACGGTTACGGAAGGTTATTCTGGGAAGTTAGAAAATTTAAGGTTAGGATATAGAAAAAGCCCTAACGGGACAATCATATTGCCATTGACGGCTAAAGATGCGCAAGTCGGAAAGAAGACGAAAATATTCATCACGGCAAATTCGAGTTCGGCAACCGATCCATCGATTTTCGATAGAATGTATTTCACGATCAATACAACATCAACAGAGCCTTTTGTCGGAACTGTTTTAATCGAAAATATCAAAGTCGAAGAAGGTTCGACAGCAACGCCTTATCAGCCTAATTTACTAGATGAGCCATATTATTTGAGTAAGGCGGTGTGGGGTGAGAATCTTATTGACCCTGCAGTGAAGTTTCCTATAACATCAAGTGTTGAAACGTTATACTCAGGTAGAACTCCTGAAGATTTCGTTGAAGGGGAGACGTACACTGTGACCATAGGTGCAACAAAACCTTCCGCTCAATCTTTTGGAGTATATTTAGCGTTAAAAAATCACACCATATTCAAACCGGTTGAGGGTCTGCATAATACATGGACGGCTACCCTAAAAATAGATATTTTAGGAGAAAAGAAAAATGCTGTGTACATTTACCAATCTCCAGCGTCAAGTGTTGGTGCATGCCAAATTGACTGGCTCAAAATCGAAAAAGGTGACACACGAACTCCTAATTTAAATGCCCCTTTTAAATATAAAGGAATTGGTTTTACTAAGTCATCTAATCCTAAAGATTATAATTGGAACAGTGCTCCCGAAAATGTAGATTTCATTGAAAAAAATGCAGCTTCAAATGAAGCAAAAATTGATGAAATTGATAAGAATGTAGTGAAAACTTCAGGTAATCAAAATATTACCGGCCTTAAAAACTTTACAGGTACGCTCCAAAGCAGCGGAGTAGAAGTTGCCAAAAAAGGTGATTCATATACGAAAACTGAAACGTATACGAAAACTGAAGTCGATTCAAAATACATTCCAAAAACACAAGAAAATACATTCGTAAAAACTATTGGAAATCAAAATGTTGTAGGAACAAAAAATTTCAGTGATCCAAGAAAAAATGATGCTTTAATGTATGCTCTTACTGATGAAGCAATGCGCCCATCAGATTTTAACTTCGCTGGTGATTTTACTAAAGTTATGACAGCGCGCTCAATGAGAGTTATGCAAAGACGTTTACCTTGGATGAAAACATTTGGTTGGTTTGGAACGGGTGAAGGATCAGCGAATGATATTGACGAAGGATTTAAGCAATACATTCAAACGAACTCAACAACAGATGCTGACATCACTAATTATCAATTCATTAGAAAAGGACGGAAAGTACAATTCTTTGCCAGAATTAAATTTACTAGTGCCACAGGAACAGATGTTGCTACTTTTGCGCAAGTTCCTACTGGTTTTCGCTTAAGCAATGCAGCAAAATATACTTATTGGAATGTTCCTTTAACATGTGTTCAATTTAATGCTCCAGAACGCATTAATTATAAAGGTTTCGTTGAACGACTGGGTACAAACAATATTAAAATTGGTACAGCAACTTACACAGGAAATACTTATTGGTATGGAGAATGGGAAACATCTGATCCTTACCCAACAAGTTTTACTGATGAAGTAACTGAGCGAATGATGGCTCATCGAGGAGCTACGGTGTCATATCCTGAAAATACTCTTGAGGCATTTAAAGCTGCGATTGACTTAGGTTATGGCGGAGTAGAATTGGATCCTCGTTTAACTAGCGATGGAAAATTATATTTAATGCATGATGACACTGTTGATCGAACAACTAATGGAACAGGCAATTTTGCCGATTTAACAGAAGCTCAAGTTAAAGCGTTAAATATTAAAATCGATCCAGTAAAATATCCTAACCTTGTTGGTCAAACACTTAAAGTTCCTTCATTATCATCTGTTCTTTTAGCATTGAGAGGAACAGATTTAACAATTAATTTCGATGGAAGTAAAATTGACTTAAGCGTTGCATCAACTGCAAAAATGATTCATGATATGATTGTAAGTTATGGTTTAGAAAAACGAGTATTCTTCGTTATCAATAATAAAACACAACGAGATGCTTTTCATAAGCTTTATCCTCAATATCCTGTTTCATGGCTTTGGAATAGCCCAGGATCTAGAGCTGCTGGAACAGTAAATGAAATTTATGCATATGGAAAACATGGAGGAGCACTCCTTTCAATTCCTATGGCTGTCTTAAATGATGATACATCTATGAGAGACATTCAAGCATCAGGTGTTTATTATCAGGTTTATGGTGTTCAGACTGAAGCTGATTATGAAACATGTAGATTAATGCGTGTTCCTATGATCGAAACTGATCAACTATATCCTAATTTAGATTTTTTATAA

Genome Context

Tertiary structure

UVD42807.1
ESMFold structure
Source ESMFold
pLDDT 63.1
Oligomeric state monomer