UniProt accession
A0A291LE99 [UniProt]
Protein name
Hinge connector of long tail fiber distal connector
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,71
TF
Evidence RBPdetect2
Probability 0,59
Seq2Symm
C3 confidence 0,998 truncated
C3 0,998
C1 0,018
C6 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MADLKSSSTAGGGLVWTQTNLPFSPQDVKLFYNGNEVIDSVSNQSIGGAKTFTGTLTYKTPVNSNEVAIKGYVDNLDSTSVKSVTGTLPIVVTTGVSPRVSINNATQSAHGAMSKEDKTKLDGLPVRAVNRDGDTMTGNLMVNGQVEANRIKSNGQVEVYDSATNTYAQRMVASGSLLYFQGGKVDRDVTDQRIAFSGWYGTPLTQVRFNMAAGVNPQVSYGNTNYDIFHKGNLPSAEEVKAMAVYDRPPEDDCDKAIMPGNYGVFANTKNTPVAGGIGPSGSTLLVTRWGNGANAQIFFSYTENRVWVRRQYIGVWQPWAEMYTSLNKQPVGGMGLGVGDSPNAITVTGGVRDFNLIKTNGVFTVDGNWANGTDNTATTTTHTGIVEVKQRSFDNLTVQKFSNWVTVGGFVEPREFTRVWINAVEGWQPWLPTGVWEQVNTYRTGILRHNNSTNDDSVYPYVSYTKEKYRDGVAAGIPYTIGEVSFRVGATNRYDPHSGDQLSRIIGQATNTTTTGEYEGTLFLASRYRKGSDGSTADTSTLRISRDVGAEFTHAGKKVQIETGNVNAEKFIVTTTGYALQYSGNANQGIYLDNRTIIGGGSSGVVIRPNGSGTVTGETVFNANGTISNNQVPTLAMHLTNKAYVDGVALGGFSSIITLRDTDNLNDIKTAGIYSQVANAKALTSLNYPVEKAGNLIVTTSAGVIQKYWVYNSSEVWSRAQYSSGAWKPWYRDYNEEFKPTSADVGALSLTGGTVTGDVRFNSGNTTRLTLGSGSDYYVERSPSGLTLASGTINPKVKVNNTDYDIYHTGNKPSAADVGTLTTTQINTELNKKLNLSGGIMTGAIRWDATDEYINAASNNIYLAAKTGTVYLESKNNPMVRIGSNDYTIYHTGNKPSAGDFNAYTKTETDNLLNTKLNLSGGTLTGAVTTATIKNAVMINNGASISFQDGANARFHILTEGNTFKLKHGDNADNQLLYVSPTVMELQTQLSARTAMFVSGADGTRVFGIGAQESNGINPYVYVRRSGDTGNIRVLTFDQGEIIANQDRIAAPTFRVINNAGLQFSPNSNRSGVTWGMGMDLSNGNLGIHRYQDGVWNLQPFMIGSNGVVTMSTGFNTTSGTMSGSLSVNGNIEVGGSVGVNSGYASIISNNNNRLEFHRPGFWATMIYMNTDGQLRFTSSNGAGGETKLRMSIDNNGNTGIAGSVNANGGVHDVGQRVYSPSNPIPDGVILRSVVNGGGNMDIGSYAMVTVKSNLGPQGPGTVLQGTQIAFSNAEGTNMVACNYGTWRLMGVSRANSQNGDGWGSWNVTLAQRIT
Physico‐chemical
properties
protein length:1316 AA
molecular weight: 140950,66480 Da
isoelectric point:7,23705
aromaticity:0,08739
hydropathy:-0,34704

Domains

View on InterPro
A0A291LE99
1 1316 aa
STR 260–324 · STR 658–735 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

A0A291LE99
1 1316 aa
Domain Start End Length (AA) Confidence
N-terminal 1 572 572 0,2383
Central domain 573 771 200 0,2141
C-terminal 772 1316 544 0,7419
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
ATI17728.1 [NCBI]
Genbank nucleotide accession
MF498774 [NCBI]
CDS location
range 81311 -> 85261
strand -
CDS
ATGGCAGACCTTAAGAGTTCGTCTACCGCTGGGGGTGGATTAGTTTGGACACAGACTAACCTACCATTTTCCCCGCAAGACGTTAAGCTGTTTTATAATGGTAATGAGGTTATTGATAGTGTTAGTAATCAATCTATTGGTGGGGCTAAAACCTTTACCGGAACATTGACATATAAAACTCCTGTCAATTCTAATGAAGTTGCCATTAAAGGTTATGTTGATAACCTAGATAGTACATCGGTGAAATCTGTAACCGGGACTCTCCCAATCGTCGTTACTACTGGTGTAAGTCCGCGAGTTTCAATTAATAACGCAACGCAATCCGCTCATGGGGCAATGAGCAAAGAAGATAAGACAAAGCTAGACGGTTTACCTGTTCGAGCTGTTAATAGAGATGGCGATACTATGACTGGAAACCTAATGGTTAATGGTCAGGTTGAGGCGAATAGAATCAAATCCAACGGTCAAGTTGAAGTTTATGATTCTGCTACCAATACATACGCACAGCGTATGGTTGCATCTGGTTCATTACTTTATTTCCAAGGTGGTAAAGTAGATAGAGACGTTACGGATCAACGAATTGCTTTTAGTGGTTGGTATGGTACACCACTAACTCAAGTAAGATTTAATATGGCTGCCGGGGTTAATCCTCAAGTATCTTATGGAAATACAAACTATGATATTTTCCATAAAGGTAATTTGCCTAGTGCGGAAGAAGTAAAGGCAATGGCGGTATATGATCGTCCACCAGAAGATGATTGCGATAAAGCAATTATGCCCGGTAACTATGGTGTTTTCGCCAACACAAAAAATACTCCCGTTGCTGGTGGTATAGGACCTAGTGGTTCAACCCTCCTTGTTACTCGTTGGGGTAATGGGGCAAACGCACAAATATTCTTTTCTTATACTGAAAACCGTGTATGGGTGCGCAGACAATATATCGGTGTTTGGCAGCCATGGGCTGAAATGTATACCTCTCTGAACAAACAGCCGGTGGGTGGTATGGGTCTTGGTGTTGGTGATAGCCCCAACGCGATCACAGTAACCGGTGGTGTTCGTGACTTCAACCTAATTAAGACCAACGGTGTTTTTACAGTTGATGGTAACTGGGCTAATGGAACTGACAATACCGCAACTACAACTACTCATACGGGTATTGTTGAGGTTAAACAACGATCTTTCGATAACTTGACTGTTCAGAAATTCAGTAACTGGGTAACAGTCGGTGGATTTGTAGAACCAAGAGAGTTTACAAGGGTATGGATTAATGCAGTTGAAGGTTGGCAACCATGGTTACCGACTGGTGTGTGGGAACAGGTAAACACATATAGAACTGGTATTCTAAGACACAATAACTCTACTAATGACGATTCTGTTTATCCTTACGTATCTTATACCAAGGAAAAATATCGTGATGGTGTTGCTGCTGGTATTCCATACACAATAGGTGAGGTTAGTTTTAGAGTTGGTGCTACAAACCGATATGATCCCCATAGTGGCGATCAGTTGTCTAGAATTATAGGTCAAGCAACAAACACAACCACAACCGGTGAATATGAAGGTACTTTGTTCTTAGCTTCTAGATATCGCAAAGGGTCTGATGGTTCGACTGCTGACACTAGTACACTAAGAATAAGTAGAGATGTTGGTGCTGAATTTACCCATGCAGGTAAGAAAGTACAGATCGAAACCGGTAATGTGAATGCAGAGAAATTTATTGTAACCACAACTGGTTATGCACTTCAATATTCCGGTAATGCAAACCAAGGAATCTATTTAGATAATAGAACAATTATTGGTGGTGGTTCATCTGGTGTTGTGATTCGTCCAAATGGTTCGGGAACTGTAACTGGGGAAACTGTCTTTAATGCAAACGGTACTATATCAAATAACCAAGTTCCGACGTTGGCAATGCATTTAACAAACAAGGCATATGTTGATGGTGTTGCTCTTGGTGGTTTTAGTTCTATTATCACACTGAGAGATACAGATAACCTCAACGATATTAAAACCGCTGGTATATATAGCCAAGTTGCTAACGCTAAAGCATTAACTAGTTTGAACTATCCAGTTGAGAAAGCTGGTAACCTTATTGTTACTACTTCCGCTGGCGTTATTCAAAAATATTGGGTATATAACTCGTCCGAAGTTTGGTCTAGAGCACAATATTCAAGTGGTGCGTGGAAGCCTTGGTATCGTGACTATAACGAAGAGTTTAAACCTACTTCCGCTGATGTTGGGGCGTTGTCTTTAACTGGTGGTACTGTAACTGGGGATGTTAGATTTAACTCTGGCAACACCACTAGATTGACTCTTGGTAGTGGTTCTGATTATTACGTCGAACGCTCACCATCTGGATTGACATTAGCTTCTGGAACTATCAATCCGAAGGTTAAAGTTAATAACACAGATTATGACATATATCATACCGGCAATAAACCATCAGCCGCCGACGTTGGTACATTAACAACTACACAGATAAACACAGAGCTTAACAAAAAGCTTAATCTGTCTGGTGGTATCATGACTGGCGCAATTCGTTGGGATGCAACAGATGAATATATCAACGCCGCGAGCAACAATATATATCTGGCTGCTAAGACTGGTACTGTATATCTTGAAAGCAAAAATAACCCAATGGTAAGGATTGGAAGTAACGATTACACCATATATCACACTGGTAATAAACCTTCTGCTGGTGATTTTAATGCATACACAAAAACTGAAACAGATAATTTACTTAATACTAAATTAAATCTGTCTGGTGGCACTCTAACTGGAGCGGTAACTACTGCAACCATAAAGAATGCTGTTATGATTAATAATGGTGCATCGATTAGTTTCCAAGACGGAGCTAATGCTAGATTCCATATACTGACAGAAGGTAACACCTTTAAACTAAAACATGGAGACAATGCCGATAATCAGCTACTATACGTTAGCCCCACAGTAATGGAATTACAAACACAATTAAGTGCAAGAACTGCAATGTTTGTGAGTGGAGCTGATGGAACTCGGGTGTTTGGGATTGGTGCTCAAGAATCCAACGGAATAAACCCATACGTGTATGTACGAAGATCTGGTGATACTGGAAACATACGTGTTCTGACATTTGATCAGGGTGAGATTATTGCTAACCAAGATCGAATCGCTGCTCCAACTTTCCGAGTTATTAACAACGCAGGATTACAGTTCTCCCCAAATAGTAACCGGAGTGGTGTGACTTGGGGGATGGGTATGGATCTATCTAATGGTAACCTTGGTATCCATCGTTATCAAGATGGTGTATGGAATCTCCAACCATTTATGATAGGTTCGAACGGTGTGGTTACTATGAGTACGGGTTTCAACACAACCAGCGGAACAATGTCTGGTTCCCTAAGTGTTAATGGAAACATTGAGGTTGGTGGATCTGTAGGTGTTAATAGTGGTTATGCCTCTATCATTAGCAATAATAATAACAGACTAGAATTTCATCGTCCCGGATTTTGGGCAACAATGATTTACATGAACACAGACGGTCAACTTCGATTTACATCAAGTAATGGTGCCGGTGGTGAAACTAAACTCAGAATGTCTATTGATAACAATGGTAATACCGGAATAGCAGGTTCTGTTAACGCTAATGGTGGTGTTCACGACGTAGGTCAACGAGTTTATTCACCAAGTAACCCAATTCCAGATGGTGTAATACTGAGATCAGTCGTCAACGGCGGCGGCAATATGGATATTGGTTCATATGCGATGGTCACAGTCAAATCCAACCTTGGTCCACAAGGTCCGGGGACTGTTCTCCAAGGTACTCAGATTGCATTCTCGAACGCGGAAGGTACTAATATGGTTGCCTGTAACTATGGTACATGGCGTCTGATGGGTGTTTCTAGAGCAAATTCCCAAAACGGCGACGGTTGGGGTTCTTGGAACGTAACATTGGCACAGCGGATAACTTAA

Genome Context

Tertiary structure

A0A291LE99
ESMFold structure
Source ESMFold
pLDDT 54.2
Oligomeric state monomer