Genbank accession
QUL77270.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,87
TF
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C1 confidence 0,997 truncated
C1 0,997
C3 0,017
C2 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MAEYNDKVVEAFVTAPDPVVTTTGGGVIFNGIETEDTVSTLLVGNGTASSPLQAQVKLSRRAGNALTLVQTDNEEGLFASAGDAKVSTSQANVAKYVTAEEAAAQGDASLEGVLVEPVHATTTAVGDALEITADPLVAKNSRISLKVSTSSTNALSVDPDGLAVKVSPAIDNSLQVREGALYVAPVGADISQDAGNKLEQRSDGLFVETIKGDKGDQGEQGPAGPQGPAGETGPAGPQGEKGDKGDTGEVGPAGATGPIGLTGATGPRGVEGPRGPAGIGINILDTLASEDQLPSVVDLANGDTYVIGQSFFTVITEGGIKQWRNVGNFAGPEGLSAFEVAETAGFVGTVDDWLATLRGADGIGLQLLGSFQRIEDLPQEENKPGDAYIIQEKMYVWTGDTDGWQPVGQIGPEGRSAYQVWLANGNVGSQREFLESLKGEKGDTGDQGPQGIPGADGKNANAINILGSVADQASLPEGADAGDAYLIGTNVFVSDGAGNWQDLGSFQGPQGPTGAKGDKGDKGDKGDKGDKGDDNYAIAVANGFQGSVNEYLASIKGEKGDVGATGPRGLAGPQGEQGPVGAGLNILGSVASEDQLPQTGISEGDAYLIEADLYIFTGGQWTNVGNIKGPQGDIGPVGPQGPIGLTGAQGPQGATGAQGPAGPQGETGPQGGIGPQGETGEKGDKGDKGDKGDIGTGIVARGVVATQSALPSGAAPGDFYVVEDEGNGYAWDGTAWVLTGLARGPQGLKGDTGETGAKGDKGDKGDAGDALKLRGLVATSAELPSTAELGDFYVAEDTGIGYAWDGVAFVSAGTVRGPQGEVGPQGEVGPQGPQGEKGDAGEQGPQGLVGETGAKGDKGDKGDVGSGLIPRGTLPSQADLPQTGEVGDFYVANDTGIGYAFDGTAFVEAGVARGPQGEQGPQGEQGPQGLKGDTGETGAQGPQGVQGEKGDTGERGEVGPQGDQGPQGEQGPQGDIGPGVEIIGRFDTSDELPSTGTLGQGYLIQGDFWGWTGAAYENLGRIQGPVGPVGPTGDQGPQGPVGNKGDKGDQGTLWVVFARAPMVSDGRVNDLYLNSSTLEYYRKTSATNWALLGFLGGGNVYDAPGDGKLYVRTDGGWVELPTAEVLEAPRDGNQYVRKDGAWTTVTVPVTEAPLEGGFYVRENGAWVKLDQYDLRVVASTGAIDASSGNAWTLDGTTNKSLTITGLPAGRAKTIVLRFTGNGGQINWDSQIAWSNGTAPTLGATRTILTLFWDGEFLTGTQAMTVG
Physico‐chemical
properties
protein length:1266 AA
molecular weight: 128268,51440 Da
isoelectric point:4,22458
aromaticity:0,06161
hydropathy:-0,39652

Domains

View on InterPro
QUL77270.1
1 1266 aa
STR 215–272 · STR 506–553 · STR 630–687 · STR 817–865 · STR 914–972 · STR 1022–1076 · ATT 1095–1122 · ATT 1125–1146 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QUL77270.1 [NCBI]
Genbank nucleotide accession
MW250786.1 [NCBI]
CDS location
range 61947 -> 65747
strand +
CDS
ATGGCTGAATATAATGATAAGGTCGTGGAAGCATTCGTTACTGCTCCTGATCCTGTCGTAACTACCACTGGTGGTGGAGTTATTTTTAACGGTATTGAAACGGAAGATACTGTATCTACCCTGTTAGTTGGTAATGGTACTGCCTCTTCCCCTCTGCAAGCTCAAGTTAAGCTATCTCGCCGTGCAGGTAACGCCCTGACTCTGGTTCAGACTGATAACGAGGAAGGCTTGTTTGCTTCCGCTGGAGATGCTAAAGTATCTACCTCTCAGGCGAACGTTGCAAAATACGTCACTGCGGAAGAAGCTGCTGCTCAAGGTGATGCCAGTTTGGAAGGTGTTCTGGTTGAGCCAGTTCATGCTACCACTACCGCTGTTGGTGACGCACTGGAAATTACCGCAGATCCTCTGGTTGCTAAAAACTCCCGTATATCCCTGAAAGTTTCCACCTCTTCAACTAACGCTTTGTCTGTAGACCCTGATGGTTTGGCAGTTAAAGTTTCCCCCGCTATCGACAACAGCTTGCAAGTTCGTGAAGGTGCACTGTATGTAGCTCCAGTTGGTGCTGACATTTCTCAAGATGCAGGTAACAAACTGGAACAACGTTCAGATGGTCTGTTTGTAGAAACCATCAAAGGTGACAAAGGCGATCAGGGTGAACAAGGACCAGCAGGTCCACAAGGCCCAGCCGGAGAAACTGGACCTGCTGGCCCGCAGGGTGAAAAAGGGGATAAAGGGGATACTGGAGAAGTCGGTCCTGCTGGCGCAACTGGACCTATCGGTCTGACTGGCGCAACTGGCCCTCGTGGTGTAGAAGGTCCTCGTGGCCCTGCTGGTATTGGTATCAACATCCTCGACACCTTGGCATCTGAAGATCAATTGCCTTCTGTTGTTGATCTTGCGAATGGTGATACATACGTAATCGGACAGAGTTTCTTTACCGTTATCACTGAAGGTGGTATCAAACAATGGAGAAACGTAGGTAACTTCGCTGGACCTGAAGGTCTTTCTGCATTTGAAGTTGCTGAAACCGCAGGCTTTGTTGGAACAGTCGATGACTGGTTGGCTACCCTTCGTGGTGCTGACGGTATAGGTCTGCAACTCCTTGGTTCTTTCCAGCGTATCGAAGATCTTCCTCAAGAAGAGAACAAACCTGGTGATGCCTACATCATTCAAGAAAAGATGTATGTTTGGACTGGTGATACAGATGGCTGGCAACCTGTAGGACAGATCGGTCCTGAAGGTCGTTCTGCTTATCAGGTCTGGCTGGCTAACGGGAACGTAGGTTCTCAGCGTGAATTCCTTGAATCACTGAAAGGTGAGAAAGGTGATACTGGCGATCAGGGTCCTCAGGGTATCCCAGGTGCAGATGGTAAAAATGCTAACGCCATTAATATCTTAGGTTCCGTTGCAGATCAGGCGAGTTTGCCAGAAGGTGCAGATGCAGGTGATGCTTACCTGATCGGTACTAACGTATTCGTTTCTGATGGTGCTGGCAACTGGCAAGACTTGGGATCTTTCCAAGGTCCGCAAGGTCCTACTGGTGCTAAAGGCGACAAGGGTGACAAAGGGGACAAAGGGGACAAAGGCGATAAAGGTGATGACAACTATGCCATCGCAGTTGCTAACGGTTTCCAAGGATCAGTAAATGAATACCTTGCATCTATCAAGGGTGAGAAAGGTGACGTTGGTGCAACTGGCCCTCGTGGATTGGCTGGTCCACAAGGTGAACAAGGTCCTGTTGGTGCGGGTCTGAATATCCTTGGCTCAGTAGCTTCCGAAGATCAATTACCTCAGACTGGTATTAGTGAAGGTGACGCTTATCTGATTGAAGCTGATCTTTATATCTTCACTGGCGGTCAGTGGACTAACGTTGGTAACATCAAAGGTCCTCAGGGTGATATTGGTCCTGTAGGTCCACAAGGTCCTATCGGCTTGACTGGTGCACAGGGACCGCAGGGTGCAACAGGAGCACAAGGCCCTGCTGGCCCACAAGGTGAGACGGGTCCACAAGGTGGTATCGGTCCACAGGGAGAAACTGGAGAGAAAGGCGATAAGGGCGATAAAGGCGACAAGGGTGATATCGGAACGGGTATCGTAGCTCGTGGCGTTGTTGCAACCCAAAGTGCACTTCCTTCCGGCGCAGCACCTGGTGATTTCTACGTTGTAGAAGATGAAGGTAACGGTTACGCTTGGGACGGTACAGCTTGGGTTTTAACTGGATTAGCTCGTGGACCTCAAGGTCTTAAAGGCGATACCGGAGAAACCGGAGCCAAAGGTGATAAGGGCGATAAAGGTGATGCAGGCGATGCACTTAAGCTGAGAGGCTTGGTTGCAACTTCCGCTGAACTGCCTTCCACTGCTGAACTTGGTGACTTCTATGTCGCTGAAGACACCGGAATTGGTTACGCTTGGGATGGTGTTGCTTTCGTTTCTGCCGGAACCGTTAGAGGACCGCAAGGTGAAGTAGGGCCGCAGGGTGAAGTTGGTCCTCAAGGACCTCAAGGCGAGAAGGGAGATGCTGGCGAGCAAGGTCCTCAAGGATTGGTCGGTGAAACAGGTGCAAAAGGTGATAAAGGAGATAAGGGTGACGTTGGCTCTGGTCTGATTCCGAGAGGAACTTTACCATCTCAAGCAGATCTTCCTCAAACTGGTGAAGTTGGTGACTTCTACGTAGCTAACGATACTGGTATTGGCTATGCTTTTGATGGAACTGCATTCGTAGAAGCTGGAGTTGCCCGTGGTCCACAGGGTGAACAAGGACCCCAGGGTGAACAGGGACCACAAGGACTTAAAGGTGATACTGGTGAAACAGGTGCTCAGGGACCTCAAGGTGTTCAAGGTGAGAAAGGTGATACCGGAGAACGTGGAGAGGTAGGTCCGCAAGGTGATCAGGGTCCGCAAGGTGAGCAAGGTCCTCAGGGTGATATCGGACCAGGTGTAGAGATCATTGGACGATTTGATACCTCTGATGAATTACCTTCCACGGGTACTTTGGGTCAAGGTTACCTTATCCAAGGCGACTTCTGGGGTTGGACTGGTGCAGCATACGAGAACTTGGGTCGTATTCAAGGTCCGGTTGGACCAGTAGGTCCTACGGGTGACCAAGGACCACAAGGCCCTGTCGGTAACAAAGGCGATAAAGGCGACCAAGGGACCCTTTGGGTAGTTTTTGCTCGTGCACCAATGGTGAGCGATGGTCGTGTTAACGATCTGTACCTCAACTCTTCCACTCTGGAATATTACCGTAAAACTTCCGCAACGAACTGGGCACTGCTCGGATTCTTAGGTGGTGGTAACGTGTATGACGCACCAGGGGACGGAAAGCTGTATGTCCGTACTGATGGTGGTTGGGTTGAATTACCTACCGCAGAAGTTCTGGAAGCACCTCGTGATGGTAACCAATACGTCCGTAAAGACGGCGCTTGGACAACTGTTACAGTTCCTGTAACGGAAGCACCACTTGAAGGTGGATTCTACGTCCGTGAAAATGGTGCGTGGGTTAAACTGGATCAGTACGATTTACGTGTTGTTGCTTCAACTGGTGCAATTGATGCAAGCTCTGGTAATGCTTGGACTTTAGATGGTACAACCAACAAGTCCTTGACTATCACCGGATTGCCAGCAGGAAGGGCTAAAACCATAGTTTTACGATTCACTGGTAACGGTGGTCAGATTAACTGGGATAGCCAGATCGCTTGGTCTAACGGAACAGCACCGACCCTCGGAGCTACCCGCACTATCCTGACCCTGTTCTGGGATGGTGAATTCCTGACTGGTACTCAGGCAATGACTGTAGGTTAA

Genome Context

Tertiary structure

QUL77270.1
ESMFold2 structure
Source ESMFold2
pLDDT 61.6
Oligomeric state monomer

Literature

Title Authors Date PMID Source
Genome sequences of avian pathogenic Escherichia coli bacteriophages UPEC01, UPEC03, UPEC06 and UPEC07 Kazibwe,G., Hinkley,T.C., Le Ny,A.-L.M. and Nakavuma,J.L. 2022-03-17 — GenBank