Genbank accession
QHR70449.1 [GenBank]
Protein name
putative tail fiber protein
RBP type
TSP
Evidence RBPdetect
Probability 0,87
TF
Evidence RBPdetect2
Probability 0,93
Seq2Symm
C3 confidence 0,698 truncated
C3 0,698
C1 0,004
C10-C17 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAENMITGSKGGSSKPYVPKEMEDNLISINKIKILLAVSDGECDPSFTLRDLYLDDVPVIADDGTVNYQGVKAEFRPGTQTQDYIQGFTDTSSEVTLARDITTSNPYVISVTNKTLSAIRIKMLMPTGIKQEDNGDLVGVKVTYAVDMAVDGDSYKEVLLDTIEGKTRSGYDRSRRIDLPAFNDRVLLRVRRVTADSASSRVTDLIKLQSYAEVIDAKFRYPLTGLVYVEFDSELFPNQIPNISIKKKWKLINVPSNYDPVMREYHGSWDGTFKKAWSNNPAWVLYDIITNQRYGLDQRELGVQVDKWSLYEAAQYCDQKVPDGKGGTEPRYLCDVVIQSQIEAYQLIRDICSIFRGMSFWNGESLSIVIDKPRDPSYIFTNDNVVDGDFQYTTASEKSMYTQCNVTFDDEQNMYQQDVEGVFDTEAALRFGYNPTSITAIGCTRRSEANRRGRWILKTNLRSTTVNFATGLEGMIPSIGDVIAIADNFHSSNLKLNLSGRVMEVSGLQVFAPFKIDARPGDFIIINKPDGKPVKRTISKVSGDGKTIELNIGFGFEVKPDTVFAIDRTDIALQQYVVTSIGKGDDDDEFTYSITAVEYDPNKYDEIDYGVNIDDRPTSIVQPDTMAAPENVQISSYSRIVQGASVETMVVSWDKVPYASLYEMQWRKGDGNWLNTPQTANKEIEVEGIYSGNYQVRVRSVSASGSTSPWSRIVTASLTGKVGEPGAPVNLTASDNEVFGIRVKWGMPEGSGDTAYIELHQSPDGTAENSSLLTLIPYPQYEYWHGTLPAGHVVWYRIRSVDRIGNVSGWTDFVRGMASDDVEAVLGNILDKIFDTEAGKDLKENAIDSANKIKDQAQSIIQNALANDADVRIMRKENGKRKAEFRQSIQLIADETEARVTAMTQLKAEFDEEITSEVTRLDQAIATESETRATAIEELKSQIGDDIQGQLTRVEEAIASETEARVSADTALTAKFGDVESALTEKLDSWAGVNGVGAQYAMKLGLTYNGQKYSAGMVMQLSQGSSGLISQILFDANRFAIMTSSTGGSYTLPFVVENNQVFINSLLVKNGSITNAMIGNFIQSNNYVWNQTGWRLDKNGTFENYGSTPGEGAMKMTNETISVRDANGVLRVQIGRLTGTW
Physico‐chemical
properties
protein length:1141 AA
molecular weight: 126473,23250 Da
isoelectric point:4,77865
aromaticity:0,08764
hydropathy:-0,36188

Domains

View on InterPro
QHR70449.1
1 1141 aa
ATT 92–217 · ATT 341–488 · STR 627–722 · STR 724–821 · RBD 983–1118 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QHR70449.1
1 1141 aa
Domain Start End Length (AA) Confidence
N-terminal 1 508 508 0,9113
Central domain 509 1081 574 0,0483
C-terminal 1082 1141 59 0,8966
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QHR70449.1 [NCBI]
Genbank nucleotide accession
MN850607 [NCBI]
CDS location
range 24375 -> 27800
strand -
CDS
ATGGCTGAAAATATGATAACGGGCAGTAAGGGTGGATCATCAAAACCTTATGTTCCGAAAGAGATGGAAGATAACCTGATCTCAATCAACAAAATCAAAATACTTCTTGCCGTTTCCGATGGTGAGTGCGATCCAAGTTTTACACTTCGCGATCTGTATCTTGATGATGTTCCGGTAATTGCAGACGACGGAACTGTTAACTACCAGGGTGTGAAAGCTGAATTTCGCCCTGGAACGCAGACGCAAGATTACATCCAGGGATTTACTGACACATCAAGCGAAGTGACGCTGGCGCGTGACATTACTACATCAAATCCTTATGTAATTTCTGTAACAAACAAAACATTATCGGCTATCAGAATCAAAATGCTAATGCCAACAGGCATTAAGCAAGAGGATAACGGCGATCTTGTCGGCGTTAAGGTTACTTATGCTGTTGATATGGCTGTTGACGGAGACTCTTACAAAGAAGTATTGCTAGACACCATCGAAGGTAAAACGCGTTCCGGTTACGACAGAAGCCGAAGGATTGACCTTCCGGCATTTAATGATCGCGTATTGCTTAGGGTTAGAAGGGTTACGGCAGACAGCGCATCCTCTCGCGTTACTGATCTGATTAAGCTACAAAGTTACGCTGAGGTTATTGATGCAAAATTCCGTTATCCTCTGACTGGTCTTGTATACGTTGAATTTGACAGTGAGTTGTTCCCTAACCAGATCCCTAACATTTCAATCAAGAAGAAATGGAAGTTAATTAATGTTCCGAGCAATTACGATCCGGTAATGCGAGAGTATCACGGTTCATGGGATGGTACTTTCAAGAAAGCGTGGTCGAACAATCCGGCGTGGGTTCTTTATGACATTATCACAAACCAGCGATACGGATTAGATCAGCGAGAACTTGGCGTGCAGGTTGACAAATGGAGTCTTTACGAAGCGGCGCAATACTGCGATCAGAAAGTGCCGGATGGAAAAGGCGGTACAGAGCCGCGTTATCTATGCGACGTTGTGATTCAAAGCCAGATTGAGGCTTATCAGCTTATTCGTGATATTTGCTCAATCTTCCGAGGCATGAGCTTTTGGAATGGCGAGAGCTTGTCAATCGTCATTGATAAGCCGCGCGATCCGTCGTACATCTTCACCAATGACAACGTTGTTGATGGTGATTTTCAGTACACAACAGCAAGCGAAAAGAGCATGTACACGCAGTGCAACGTGACGTTCGACGACGAACAAAACATGTACCAACAGGACGTAGAGGGCGTATTCGACACCGAGGCAGCATTGCGATTTGGATACAATCCTACAAGCATAACAGCGATTGGATGTACACGCAGGAGTGAGGCTAATCGGCGCGGTCGATGGATACTAAAAACTAACTTGCGCAGCACTACGGTAAACTTTGCTACTGGACTGGAAGGCATGATCCCATCAATAGGTGATGTGATTGCTATTGCTGACAACTTTCACAGCAGCAACCTTAAGTTAAACCTATCAGGGCGCGTGATGGAAGTTTCAGGCTTGCAGGTGTTCGCTCCGTTTAAGATTGACGCGCGACCAGGTGATTTCATTATCATCAACAAGCCAGACGGGAAGCCAGTTAAGCGCACAATCTCAAAAGTAAGCGGTGACGGAAAAACCATTGAGCTAAATATTGGGTTTGGATTTGAGGTTAAACCTGACACGGTTTTTGCAATCGACCGCACTGATATTGCATTGCAGCAATACGTTGTAACGAGTATCGGCAAAGGTGATGATGATGATGAATTTACATACTCCATCACGGCTGTTGAATATGACCCGAACAAATACGACGAGATTGATTATGGAGTAAACATTGACGACAGGCCAACTTCAATTGTCCAGCCTGACACAATGGCAGCGCCTGAAAATGTGCAAATATCCTCCTACTCGCGAATTGTCCAGGGTGCAAGCGTTGAAACAATGGTTGTGTCGTGGGATAAAGTACCTTACGCATCGCTGTATGAAATGCAGTGGCGAAAAGGTGATGGCAACTGGCTGAATACACCACAGACTGCAAACAAAGAAATTGAGGTTGAAGGTATTTATTCAGGAAACTACCAGGTAAGGGTTAGATCTGTTTCTGCTTCAGGTTCGACGTCGCCGTGGTCCAGAATTGTAACAGCTTCACTGACTGGTAAGGTAGGAGAGCCAGGCGCGCCAGTTAACTTAACTGCATCCGACAATGAGGTGTTTGGCATTCGTGTTAAGTGGGGGATGCCAGAAGGCAGCGGAGACACGGCATACATTGAGCTTCATCAGTCGCCGGATGGAACGGCTGAAAACTCAAGCCTGTTAACTCTGATCCCATATCCACAATATGAATACTGGCACGGTACGCTTCCGGCTGGTCATGTTGTATGGTATAGAATCCGCAGTGTTGACAGAATCGGCAACGTTTCCGGATGGACTGATTTTGTTAGAGGCATGGCTTCAGATGATGTGGAGGCTGTTTTAGGCAATATTCTTGATAAGATTTTTGATACCGAAGCAGGGAAGGATCTGAAAGAGAATGCCATTGATAGCGCAAACAAAATCAAGGATCAGGCGCAAAGCATCATTCAAAACGCATTGGCGAATGATGCAGACGTTAGGATTATGAGGAAGGAAAACGGAAAACGCAAAGCCGAATTCAGGCAATCAATACAGTTGATCGCAGATGAAACTGAGGCGCGCGTTACCGCAATGACGCAACTCAAGGCTGAATTTGACGAGGAAATAACTAGCGAAGTAACGAGGCTTGATCAGGCAATTGCAACAGAATCGGAAACGAGAGCAACAGCCATTGAGGAATTGAAATCACAGATTGGAGATGATATTCAGGGGCAGTTAACGAGAGTTGAGGAGGCGATTGCAAGCGAAACAGAGGCGCGCGTTTCTGCTGACACAGCATTAACAGCGAAGTTTGGAGATGTTGAATCAGCGCTGACGGAAAAACTTGATTCATGGGCTGGCGTTAATGGAGTTGGCGCACAGTACGCAATGAAACTTGGATTGACATACAACGGTCAGAAGTACAGTGCTGGTATGGTGATGCAGCTTTCGCAGGGTTCATCCGGCCTTATTTCGCAGATTTTGTTTGATGCGAACAGGTTCGCTATCATGACAAGTTCGACCGGAGGGTCGTATACATTGCCTTTTGTGGTTGAAAATAACCAAGTTTTCATTAACAGCCTGTTAGTGAAAAACGGATCAATCACAAACGCCATGATCGGTAACTTCATCCAATCAAATAATTACGTTTGGAATCAAACAGGATGGAGGCTGGATAAAAACGGAACGTTTGAAAATTATGGTTCTACTCCTGGAGAGGGGGCCATGAAAATGACAAACGAAACGATCAGCGTTAGGGATGCAAACGGCGTTTTGCGTGTTCAGATCGGTAGGCTTACTGGTACGTGGTAA

Genome Context

Tertiary structure

QHR70449.1
ESMFold2 structure
Source ESMFold2
pLDDT 76.4
Oligomeric state monomer

Literature

Title Authors Date PMID Source
Exploring the Remarkable Diversity of Culturable Escherichia coli Phages in the Danish Wastewater Environment Olsen,N.S., Forero-Junco,L., Kot,W. and Hansen,L.H. 2020 32899836 GenBank