Genbank accession
QGT54247.1 [GenBank]
Protein name
long tail fiber proximal subunit
RBP type
TF
Evidence RBPdetect
Probability 0,59
TF
Evidence RBPdetect2
Probability 0,66
Seq2Symm
C3 confidence 0,950 truncated
C3 0,950
C1 0,216
C6 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSEVKTSFRASYGLDAAGEKVINVAKADKTVMTDGVNVEYLIQENTTQQYDPERAYEKGFIIEFNDRLWIAEQDIPKPAGSFNEGYWRPVRTDPKWKPIDSGKYQLHVGDYISVDTRAGLDVELTLPTNPIPQEGDTIVVKDIGGQPGYTSVLVFAPVQSIIDKGVSIPQKRMTIPFSEWTFVYTKSQWSLYDGVEAPVARTVTTSGPTRIQSGDTILRNYDKVAPIVLTFPKFANNGDIIHFVGMNENTVPYYHLELNAFDSNTSIGSPGKSSQIFYRSLSGYFIFNSLTSTWYLYDSDMTNRLRTVSTDTEIFPNETVAVVGKDNTTTQTIKLTLPQNVQPGDQVTISLNYIRKGQTVNIVPKGADMILTNQNLTQFPKRSSYPPNANWVNTNLLSYNGSNDYPPVLTFAYIDMGPIKQWLMVSCLPVLERVDPTTDDTRTRLGVIALANQSQANLDKENISVTANPLAREVAITPETLANRTALDNRRGIARIAKQEEVNLTTDNAALAYDTIVTPKTLNGKKATETMVGLAEIATQAETNSNTDDSRIITSKKLDGRRATPALAGVAKLVATGGTAPVKGGTNTRDTAGTGIYNHADFENIVTPKTLREYYSTEMALGTVYLANSAEVISGAATLAKYPLAVTPETLHTKTATDGRIGFSQVAKQAEVDAGTDYFKFVTPKTLAGRIAREDLTGIAKLATQGEFDAGTVGLISGPDKIKTFFSRAERTIVNNAEGLTQSGSIWTGLKLNILAPSETQRGTARYATQDETDKGVDATTIVTPAKLHAKKATTVAEGIVRMANTAETVAGTAYNLAVSPGNLKYVVQTELSWEATPERRGFVKLSTGSTTWQGNTVVGNANINIETQFNKNGMAVSPYEFNRVLRNYLPIGAKAVDSDKLDGLDSSQFIRRDIGQIVNGALTLTQPTTATYITASNDVSVQALLSANQINVRKSGTPDDASVTKNAGINLYGAPQIATGRPTYGIHFSSTGGTDPNGIHGYGTGTWGTYFAQSISSAAEQRAWYFQQIFNGAVKNVGSITAQGDVWFDGVINSDKTFRLKNNVIAEKDAGGNLIFGTPDQQMYLRSKAADIKVQEVVGGTSYQVITSKNFVNEGNKTYVRKTGDSMTGRLNISQPITATINQSAATPNAVPNASNFGTWTIDITDPAIYNTMRPYVVGVNAINKETGEVLPWFDKYEEFNGPGTLSQFGSSASNGSGTYQIWAPRPPADKANLPGHIAGTMWTRQWNPITNKWDGWGRVFTNNHPPLPTDIGAMSNNGSVFDSMRIRDWIQVGNLRIYADPSTKTVRFDWIE
Physico‐chemical
properties
protein length:1314 AA
molecular weight: 143103,63060 Da
isoelectric point:6,21116
aromaticity:0,08676
hydropathy:-0,34726

Domains

View on InterPro
QGT54247.1
1 1314 aa
ATT 1153–1262 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QGT54247.1 [NCBI]
Genbank nucleotide accession
MN662249 [NCBI]
CDS location
range 148225 -> 152169
strand +
CDS
ATGTCTGAAGTAAAAACAAGTTTCCGTGCGTCATACGGTCTAGACGCGGCTGGTGAGAAAGTAATTAATGTTGCAAAGGCTGACAAAACTGTCATGACCGATGGTGTCAACGTCGAATATCTCATTCAGGAAAATACGACCCAACAATATGACCCAGAGCGTGCCTATGAAAAAGGATTCATTATAGAATTTAATGATCGTCTCTGGATTGCAGAACAAGACATCCCTAAACCTGCAGGTAGCTTCAATGAAGGGTACTGGCGCCCAGTACGTACAGACCCAAAGTGGAAGCCTATCGATTCTGGTAAATATCAGTTACATGTTGGTGATTATATTTCTGTAGATACGCGTGCAGGTTTAGATGTAGAACTAACATTACCTACTAATCCTATACCACAGGAAGGCGATACAATTGTTGTAAAGGATATCGGCGGGCAACCAGGTTACACATCGGTGTTAGTCTTTGCACCTGTGCAGTCAATTATTGACAAAGGCGTAAGTATTCCACAAAAACGAATGACTATTCCATTTTCTGAATGGACATTTGTATACACAAAGAGCCAATGGTCATTATACGATGGCGTTGAAGCCCCAGTAGCAAGAACTGTTACTACATCTGGTCCTACTCGAATCCAATCAGGTGATACGATTCTTAGAAACTATGATAAAGTAGCTCCTATTGTATTGACTTTTCCTAAATTTGCCAACAATGGTGACATTATTCATTTTGTAGGCATGAATGAAAATACAGTGCCTTATTATCACTTGGAGCTTAATGCATTTGATAGTAATACAAGTATCGGTTCTCCGGGTAAGTCATCGCAAATTTTCTATCGTTCGCTAAGTGGGTATTTCATTTTTAATAGCTTGACTTCAACCTGGTATTTGTACGATTCAGATATGACAAATCGTCTTAGAACTGTTAGTACTGATACTGAGATTTTTCCGAATGAAACCGTAGCAGTAGTAGGCAAAGATAATACCACTACACAGACTATTAAATTGACATTGCCACAAAATGTGCAACCTGGCGACCAGGTAACAATTTCATTAAATTATATTAGAAAGGGGCAAACTGTTAACATCGTGCCTAAAGGCGCCGATATGATTTTAACAAATCAAAATCTAACTCAGTTCCCTAAACGCTCAAGTTATCCACCTAATGCTAATTGGGTTAACACTAATTTATTGTCATATAACGGTTCAAATGACTACCCGCCAGTATTAACATTTGCATACATTGATATGGGACCTATCAAACAATGGCTGATGGTAAGTTGTTTGCCTGTATTAGAGCGTGTTGATCCGACAACAGATGATACTCGTACTCGTTTAGGTGTTATTGCTTTAGCAAATCAATCTCAAGCAAACTTAGACAAAGAAAATATTTCGGTTACTGCAAATCCATTAGCACGAGAAGTCGCTATCACGCCGGAAACTCTTGCCAATAGGACCGCTTTGGACAACCGTCGTGGAATCGCAAGAATCGCCAAACAAGAAGAAGTAAACTTAACTACAGATAATGCTGCATTAGCATATGATACTATCGTTACGCCTAAGACTCTTAATGGCAAAAAGGCTACAGAAACGATGGTAGGTTTGGCAGAAATTGCTACTCAAGCCGAAACCAATAGCAACACTGACGATTCTCGTATCATCACTTCTAAGAAATTAGATGGACGACGCGCAACACCTGCTTTAGCCGGAGTCGCTAAACTTGTTGCTACAGGTGGCACTGCGCCTGTTAAAGGAGGTACAAATACCCGTGATACTGCTGGAACTGGCATTTATAATCATGCAGACTTTGAGAACATTGTTACACCTAAAACATTGAGAGAATATTATTCTACAGAAATGGCATTAGGTACAGTGTATCTTGCAAATTCTGCTGAAGTTATTTCTGGTGCAGCTACATTAGCTAAATATCCATTAGCAGTAACTCCTGAAACTTTGCACACTAAGACCGCTACCGATGGGCGTATAGGCTTTTCACAAGTGGCTAAACAAGCCGAAGTTGATGCTGGAACAGATTATTTTAAATTTGTTACACCAAAAACTTTAGCAGGAAGAATTGCACGAGAAGACTTAACAGGTATCGCAAAATTAGCAACCCAAGGCGAATTTGACGCTGGTACAGTTGGATTAATTTCAGGCCCAGATAAAATTAAGACATTTTTCTCTCGCGCTGAAAGAACTATTGTCAATAATGCTGAAGGTTTAACACAATCTGGTAGCATTTGGACCGGGTTAAAGTTGAATATTCTTGCACCATCAGAGACCCAACGTGGTACAGCAAGATATGCTACGCAAGATGAAACAGATAAAGGTGTTGATGCCACAACAATTGTGACTCCTGCAAAATTACATGCTAAGAAAGCCACTACAGTTGCAGAAGGTATTGTCAGAATGGCAAATACTGCTGAGACGGTAGCTGGTACCGCATATAATTTAGCAGTATCGCCTGGCAATCTAAAATATGTTGTACAAACAGAATTGTCATGGGAGGCCACACCTGAACGTAGAGGTTTCGTTAAACTTTCTACAGGTTCAACAACATGGCAAGGCAACACAGTTGTTGGTAATGCAAATATCAACATTGAAACTCAATTCAACAAAAATGGTATGGCTGTTTCGCCGTATGAGTTCAACCGTGTTTTAAGGAACTATTTACCTATTGGCGCCAAAGCAGTTGATTCTGATAAATTAGATGGATTGGATTCATCACAGTTTATTCGTAGAGACATTGGCCAAATTGTTAATGGCGCATTAACGCTGACACAGCCTACAACTGCAACATACATTACTGCTTCTAATGATGTATCAGTCCAAGCTCTTTTATCTGCTAATCAGATTAACGTACGAAAATCTGGAACTCCTGATGATGCGTCTGTTACAAAGAACGCTGGTATAAATTTGTATGGCGCTCCACAAATTGCTACAGGGCGTCCGACCTACGGTATTCATTTTTCTAGTACCGGTGGCACAGACCCTAATGGGATACATGGCTATGGCACTGGGACTTGGGGTACATATTTTGCTCAAAGCATCTCTAGCGCAGCTGAACAACGCGCATGGTACTTCCAGCAAATTTTTAACGGTGCAGTTAAAAACGTTGGCTCTATCACAGCACAAGGCGATGTTTGGTTTGATGGTGTTATTAACAGTGATAAAACATTCAGACTTAAAAATAACGTCATAGCTGAAAAGGATGCAGGTGGTAATCTAATTTTCGGTACACCTGATCAGCAAATGTACCTTCGTTCTAAAGCAGCAGATATAAAGGTTCAAGAAGTAGTTGGTGGAACTTCTTATCAAGTTATTACATCTAAAAACTTTGTTAATGAAGGTAACAAAACATATGTGAGAAAGACCGGCGATTCAATGACTGGGCGCCTCAATATTTCTCAACCTATAACTGCTACTATCAACCAATCTGCTGCGACACCAAATGCAGTTCCAAATGCCAGCAATTTTGGTACATGGACTATTGATATAACTGATCCTGCAATATATAATACTATGCGCCCATATGTTGTTGGAGTAAATGCAATCAATAAAGAGACAGGTGAAGTCTTGCCATGGTTTGATAAGTACGAGGAGTTTAATGGGCCTGGTACATTGTCACAATTTGGATCTTCTGCTAGTAATGGTTCTGGTACATACCAAATCTGGGCGCCACGTCCGCCAGCAGATAAAGCAAATTTACCTGGGCATATTGCTGGCACAATGTGGACAAGACAGTGGAATCCTATTACAAATAAATGGGATGGCTGGGGCAGAGTATTCACAAATAACCATCCACCATTGCCTACAGACATTGGCGCTATGAGCAATAATGGTTCAGTTTTTGATTCTATGAGAATTAGGGATTGGATTCAAGTAGGTAATTTGAGAATTTATGCAGACCCATCTACAAAAACTGTTCGTTTTGATTGGATTGAATAA

Genome Context

Tertiary structure

QGT54247.1
ESMFold structure
Source ESMFold
pLDDT 52.3
Oligomeric state monomer