Genbank accession
ULG01611.1 [GenBank]
Protein name
putative tail fiber protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C3 confidence 0,999
C3 0,999
C1 0,007
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MTTYSEAVEQTITAGEQIHQIVNGTSTTEVTVEDGSKVPSIRKALLDNFYFKDPITWQVGQTENVFNQLRQFTDGSWWYAPSATASNPISMGVTPVGNPLWKIYDFDAIGKLEPRVDEALRRSYAEAGYNVVGTFKAGFTYVNANDVGIDLATGKGYAGPSGTVAAGTNPASGGFVDVSNSLRHVLFSSAFGLAPSNSASKNSKALRDLAAAAMALGTAKIIFEKGDYTVGVQYLTGAVGLGGAWRPLECFKVTGMKRIDIEFDGCKFKWADGMRFGAFDPVTGFPVTTDASNVTNGSLRSDKGFVFDLRDNDQVNISGNIEFDGNTEQTILGGWWAVLNERQNWDYGIYAKNNRQYNDTAVKYFHSSSCDGYAFTGSLAYNASFDISNLVAVYCGRNGLSFTGGINGSFNNIVAGYSGYKNLSSLPAAAIDVEPQESSRISGVSMNNVICLPCKGQSLQGAYYVTPSNTSIIEDITFNNLKAYGIRGEQSPMLWYAQNTRFNKCQFFGAVHGINAVAGFDGNVGKIIFDDCDFNSRFDNADRSYGYRDIATIIQMGDQQDNVIFRNCRGRADISTTNPTAIRSHKGVFDGFNLTLDGYFTDATAPSVFWAAYLNFATLNRFNVINNLLTEFTSATTGRFGIAAFDAKVDNSYISLGQFGFESVVWNTNYNAGRSGKLVQKVDPAVPVMALTYRSDLSNFKESSLNIYAVKLNDPAYINKLDVGINRGDLLTVADFVTGGKPWLKCVTAGTATTRTTTALGTTTLGSNVATLTTLSGLKVGDYIKIGAAYPGTPPKILSMNTTALTVKLSYNPNAAVTGGAVTLPAPVFE
Physico‐chemical
properties
protein length:830 AA
molecular weight: 89488,09580 Da
isoelectric point:5,65687
aromaticity:0,11566
hydropathy:-0,12867

Domains

View on InterPro
ULG01611.1
1 830 aa
ATT 2–104 · STR 169–571 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

ULG01611.1
1 830 aa
Domain Start End Length (AA) Confidence
N-terminal 1 199 199 0,9931
Central domain 200 703 505 0,9778
C-terminal 704 830 126 0,9735
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
ULG01611.1 [NCBI]
Genbank nucleotide accession
OM033135 [NCBI]
CDS location
range 38202 -> 40694
strand -
CDS
ATGACAACTTACAGCGAAGCAGTAGAACAAACTATTACAGCAGGTGAACAAATCCATCAGATTGTCAACGGAACATCAACAACTGAAGTTACTGTAGAAGATGGTAGCAAAGTACCTAGTATTCGTAAAGCACTTCTTGACAATTTTTATTTTAAAGACCCAATTACATGGCAAGTAGGCCAGACTGAAAATGTGTTTAATCAACTCCGTCAATTTACAGATGGGAGTTGGTGGTATGCTCCGAGTGCAACAGCAAGCAACCCTATTTCTATGGGAGTTACTCCTGTTGGGAACCCCTTGTGGAAGATTTACGATTTTGATGCAATCGGGAAGTTAGAACCTAGAGTTGATGAAGCATTGCGCCGCAGTTATGCGGAAGCTGGTTACAACGTGGTGGGGACGTTCAAGGCTGGTTTCACTTACGTCAATGCAAATGATGTTGGGATCGACTTGGCGACAGGGAAGGGGTATGCAGGCCCTTCTGGCACCGTTGCTGCTGGTACGAATCCGGCGAGTGGCGGGTTTGTTGATGTGAGCAACTCCTTGCGCCACGTCCTTTTCTCATCGGCATTCGGCCTAGCTCCAAGCAACTCAGCCAGCAAAAACTCTAAGGCACTGCGTGATCTGGCTGCGGCGGCCATGGCACTCGGCACCGCAAAAATCATCTTCGAGAAAGGTGACTACACGGTTGGTGTGCAGTACCTAACTGGCGCTGTCGGATTGGGAGGGGCGTGGCGCCCTCTGGAGTGCTTCAAAGTTACAGGAATGAAGCGGATAGACATTGAATTTGATGGCTGCAAATTCAAATGGGCTGACGGAATGCGGTTTGGTGCGTTTGACCCAGTTACCGGGTTCCCAGTTACCACAGATGCGTCTAACGTAACTAACGGCTCGCTAAGGTCTGACAAAGGTTTCGTGTTCGACCTGCGAGACAATGACCAGGTTAATATTTCAGGCAATATTGAGTTCGACGGCAACACAGAGCAAACAATACTCGGCGGTTGGTGGGCGGTACTGAACGAACGCCAAAACTGGGATTACGGCATTTATGCCAAAAATAATCGTCAGTACAATGACACCGCCGTTAAATATTTCCACTCTTCTTCCTGCGATGGGTACGCTTTTACCGGATCACTCGCATATAACGCATCATTCGATATCTCCAACCTAGTCGCAGTTTACTGCGGGCGGAATGGACTTAGCTTCACTGGCGGTATTAACGGTTCGTTTAACAATATTGTCGCTGGTTACTCTGGTTATAAAAACCTGTCATCACTCCCTGCGGCGGCTATCGACGTGGAGCCCCAAGAGTCCTCACGGATTTCAGGGGTGTCGATGAATAATGTTATCTGTCTGCCATGCAAGGGGCAATCGCTACAGGGTGCATACTATGTGACCCCGAGCAATACAAGCATCATCGAGGACATCACATTTAACAACCTCAAAGCCTACGGTATTCGAGGTGAACAGTCCCCAATGTTGTGGTATGCACAAAACACTCGGTTCAATAAGTGCCAGTTTTTCGGTGCGGTTCACGGTATTAATGCCGTTGCCGGATTTGATGGTAATGTTGGCAAGATTATCTTTGATGACTGTGATTTCAATTCGCGGTTTGACAATGCTGACAGAAGCTACGGATACCGAGACATAGCCACAATCATCCAAATGGGTGACCAGCAGGATAATGTCATTTTCAGAAACTGCCGAGGCAGGGCTGACATTTCCACGACAAACCCTACTGCAATTCGGTCGCACAAGGGGGTGTTTGACGGGTTTAACTTAACGCTGGATGGGTACTTTACTGACGCCACTGCGCCGAGTGTTTTCTGGGCGGCGTATTTAAACTTCGCAACGTTGAACAGATTCAACGTAATCAATAACCTGCTGACAGAGTTCACGTCTGCAACAACAGGTAGGTTTGGTATTGCTGCTTTTGATGCGAAAGTTGATAACTCCTACATATCGCTGGGGCAGTTTGGTTTTGAGTCGGTAGTTTGGAATACCAACTATAACGCCGGAAGGTCTGGAAAGCTGGTCCAAAAGGTAGACCCAGCAGTACCAGTAATGGCGCTGACTTACAGGTCCGACCTATCGAACTTCAAAGAAAGTTCTTTAAATATTTATGCTGTAAAACTAAACGACCCAGCTTATATAAATAAACTGGATGTAGGCATAAACAGGGGTGACTTGCTGACGGTGGCTGATTTCGTCACTGGCGGAAAGCCGTGGTTGAAGTGTGTTACTGCTGGTACGGCAACAACAAGAACAACAACCGCCCTAGGAACCACAACACTAGGGAGTAACGTTGCCACATTGACAACACTGAGTGGGTTGAAGGTGGGGGACTACATCAAGATAGGGGCCGCGTACCCAGGAACACCACCAAAAATACTGTCAATGAACACTACCGCGCTAACAGTAAAACTCAGCTACAACCCAAATGCCGCTGTAACTGGTGGAGCAGTAACACTCCCTGCCCCAGTTTTTGAGTAA

Genome Context

Tertiary structure

ULG01611.1
ESMFold2 structure
Source ESMFold2
pLDDT 74.5
Oligomeric state monomer