Genbank accession
QYC96847.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,82
TF
Evidence RBPdetect2
Probability 0,97
Seq2Symm
C3 confidence 0,969 truncated
C3 0,969
C1 0,004
C6 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNNIKARKGGSSKPRTPVEMPDNLISKDKIKLLLAVSDGEVVNDFSLKQLHFGGVPVQNEDGTFNYEGVIAEFRPGTQTQDYIQGFSESSAEFQVAREVTHNTPYTLTVSNKNLSAIRFRLLWPRVLKQKDNGDMVGSVVEYKIEMAVDGASYQTYLTGKIDGKNTTGGYDRSIRVNLPQNFTSQVLIRVSRVTPDADGVKVVDAFKVESYAEVIDAKFRYPLTAMLYVEFDSDLFQNQIPTISLKKKWKIIQVPSNYDPINRTYSGTWDGVFKWAWSNNPAWVLYDLIMNQRYGLDQRELGIPVDKWSLYEVAQYCDELVPDNRGGMEPRYLMDVVVQSQVEAFQLVRDICSAFRGMTFYNGESLSIIVDKPRDPVYLFTADNVVDGVFVRTFPSEKTMYTSCNVMFDDEENQYEQDIEPVFNPDAAMRFGHNPTSITAIGCTRRTEANRRGRWILQTNLSATTVSFSTGLEGMIPSCGDVIYVADPHWQSAFNLVLSGRVMEVSGVQVFLAYRCDAKAGDTLILNTDDGKPVRRTIASVSADGKTITLNVGYNFDVAPDSVFLIESDQLAAEQYVVTRIEKGSDDDEFTFAITATQYNPNKYDAIDNGVITDDRPTSVVDPDSLGAPKDLTISSFSRIVQGMSVETMVIGWSAVQYAKLYEVQWRKDGGNWNNVPRTATTQVDIEGIYAGEYQARVRCISGGNVASPWSALASATLTGKVGAPKGPINLFASDNEIFGIRVKWAMPEGAEDTAYIELYQSQSGTDQDASLLTLIPYPASEYWHSILPAGYVNFYKARSVDRIGNVSAWTDYARGMSSTDVNAITDTILDEILDSDAMKELQVSAQDSAAKLNDYANSIIQNALANDGDVRIMRKENGKRKAEIKRAEVLIANETEARVQQVNQISAEFNENLNSGLTQVNEALANETEARVTSEEALSARIGQNSAALDQKLDSWANVNGVGSMYTMKLGLTYNGQEYNSGMALQLTSQGGNVVSQVLFIADRFAIIRNAESGAYTLPFVVQNDQVFMNNALIQDGSITNAKIGNVIQSNNYIAGQQGWMINKNGGSEFQNTTVRGTIYATDGVFKGTVQAESFIGDIAVAKRYDSMTLRRNQTVQRNGHYQNRGYGMTVVLACTLVCETYGNGNSQLGYTVDVTFNIGGQQVVRRIYIDAGNIVYGTTAVELRFAADLAADNNNVSFFIKATGRDAVTDYTVTVDNITATAFRTNSNSFT
Physico‐chemical
properties
protein length:1233 AA
molecular weight: 136294,94990 Da
isoelectric point:4,84009
aromaticity:0,09570
hydropathy:-0,28491

Domains

View on InterPro
QYC96847.1
1 1233 aa
ATT 90–217 · ATT 341–489 · STR 627–721 · RBD 950–1085 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QYC96847.1
1 1233 aa
Domain Start End Length (AA) Confidence
N-terminal 1 504 504 0,8678
Central domain 505 1052 549 0,0566
C-terminal 1053 1233 180 0,7480
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QYC96847.1 [NCBI]
Genbank nucleotide accession
MZ398242.1 [NCBI]
CDS location
range 24541 -> 28242
strand +
CDS
ATGAATAATATCAAGGCCCGCAAGGGTGGCTCCAGCAAGCCGCGAACCCCGGTAGAAATGCCAGATAACCTGATCTCAAAAGATAAGATCAAGTTGTTGCTTGCTGTTTCAGATGGCGAGGTGGTTAACGACTTCAGCCTGAAGCAGTTGCATTTTGGCGGCGTCCCGGTTCAGAACGAGGATGGAACATTCAACTATGAGGGCGTGATTGCAGAGTTCCGCCCCGGCACGCAAACGCAGGACTACATCCAGGGCTTCAGCGAGTCAAGCGCTGAATTCCAGGTTGCTCGTGAAGTCACTCACAACACGCCTTATACGCTTACCGTATCGAACAAGAATCTTTCTGCCATTCGCTTTCGCCTGTTATGGCCCCGCGTTCTGAAGCAAAAAGATAACGGCGATATGGTCGGATCGGTTGTTGAGTACAAGATCGAGATGGCGGTAGACGGCGCAAGTTATCAGACCTACCTAACGGGCAAAATTGACGGCAAGAACACGACTGGCGGTTACGATCGGAGCATTCGCGTTAACCTGCCGCAAAACTTCACGTCGCAGGTGCTTATCCGCGTTAGTCGAGTAACGCCTGACGCTGACGGGGTGAAGGTTGTCGATGCTTTCAAGGTTGAATCATACGCTGAAGTTATTGATGCCAAATTCCGCTACCCGTTAACGGCCATGCTTTACGTTGAGTTCGATAGCGATCTGTTCCAGAACCAGATCCCCACTATCTCACTCAAAAAGAAATGGAAGATTATCCAGGTTCCGAGCAACTACGATCCGATTAATCGCACGTACTCCGGAACGTGGGACGGTGTTTTCAAGTGGGCGTGGAGCAATAACCCGGCTTGGGTTCTTTATGATCTGATCATGAATCAGCGCTATGGTTTAGACCAGCGTGAGTTAGGAATCCCGGTTGATAAGTGGTCGCTGTACGAGGTGGCGCAATACTGTGATGAGCTTGTGCCGGACAATCGCGGCGGGATGGAGCCGCGCTATTTGATGGATGTAGTTGTTCAGTCGCAGGTTGAGGCGTTCCAGTTGGTAAGGGATATTTGTTCCGCGTTCCGTGGAATGACGTTCTACAACGGGGAAAGCCTTTCGATTATCGTCGATAAGCCGCGCGATCCGGTGTACCTGTTTACGGCTGATAACGTCGTTGACGGCGTTTTCGTTCGGACGTTCCCAAGCGAAAAGACGATGTATACGTCGTGCAACGTCATGTTCGACGACGAAGAAAACCAGTACGAACAGGATATTGAACCAGTATTCAACCCGGATGCAGCCATGCGATTTGGCCATAACCCAACGAGCATTACAGCGATCGGGTGTACCAGAAGGACTGAGGCGAACCGCCGTGGGCGTTGGATTCTGCAAACGAACCTAAGCGCCACAACCGTTTCGTTTTCGACTGGCCTAGAAGGCATGATCCCTTCTTGCGGCGATGTGATTTACGTTGCAGATCCGCACTGGCAATCAGCCTTTAACCTGGTGCTATCAGGACGCGTTATGGAAGTATCAGGCGTGCAGGTCTTTCTGGCCTACCGTTGCGACGCGAAAGCTGGAGACACTCTGATCCTGAATACTGACGACGGCAAGCCAGTGCGTCGCACCATTGCCAGCGTTTCGGCAGATGGCAAAACCATCACGCTAAACGTCGGATATAACTTTGACGTTGCGCCTGACAGCGTGTTCCTGATCGAAAGTGATCAGCTTGCTGCGGAACAGTATGTAGTAACCAGGATCGAAAAGGGGAGCGATGACGACGAATTTACCTTCGCCATCACGGCCACCCAATACAACCCGAACAAGTACGACGCGATCGACAACGGCGTAATCACTGACGACCGCCCAACGTCGGTTGTTGACCCGGATTCATTGGGTGCTCCGAAAGACTTAACGATTAGCTCGTTTTCTCGCATTGTTCAGGGAATGAGCGTCGAAACGATGGTGATCGGATGGTCTGCCGTGCAGTATGCAAAACTGTACGAGGTGCAATGGCGTAAGGATGGCGGGAACTGGAATAACGTTCCGCGCACTGCGACAACGCAGGTTGATATCGAAGGCATCTATGCTGGCGAGTATCAGGCCCGCGTAAGGTGCATCAGCGGCGGGAATGTGGCGTCTCCGTGGTCTGCATTGGCAAGCGCTACGCTGACCGGAAAAGTCGGAGCGCCAAAAGGCCCGATTAACCTTTTTGCGTCGGACAATGAGATCTTCGGCATTCGCGTTAAGTGGGCCATGCCGGAAGGAGCGGAAGATACGGCATACATTGAACTTTACCAGTCACAAAGCGGAACCGATCAGGATGCAAGCCTGCTTACCCTGATTCCCTACCCGGCTTCTGAATACTGGCATTCAATTCTTCCCGCTGGCTACGTGAACTTCTACAAAGCCAGAAGCGTAGACCGTATCGGCAACGTTTCAGCGTGGACTGATTACGCTCGCGGCATGTCGTCGACTGACGTTAACGCCATCACGGATACGATCCTGGATGAGATCCTCGACAGCGACGCGATGAAAGAACTTCAGGTGAGTGCGCAGGATAGCGCGGCAAAACTCAATGACTACGCTAACAGCATCATCCAAAACGCATTAGCGAATGATGGTGATGTTAGAATCATGAGAAAGGAGAATGGAAAGAGGAAGGCTGAGATTAAACGCGCAGAAGTTCTCATAGCAAATGAGACGGAAGCCAGGGTGCAGCAGGTTAACCAGATATCGGCAGAGTTCAACGAAAACCTCAATTCTGGATTAACTCAAGTTAACGAGGCGTTGGCGAATGAAACTGAGGCTCGCGTTACGTCGGAGGAGGCGCTATCAGCAAGGATTGGCCAGAACTCCGCAGCGCTAGATCAGAAACTTGATTCGTGGGCAAACGTTAATGGAGTTGGTTCCATGTATACAATGAAGCTAGGGCTGACTTACAACGGCCAGGAATACAATTCCGGGATGGCCCTACAGCTTACATCACAGGGTGGAAACGTTGTTTCGCAAGTTCTGTTTATTGCTGATAGATTCGCCATCATCCGAAATGCGGAGTCTGGAGCGTACACGTTGCCTTTTGTTGTGCAGAATGACCAGGTTTTCATGAATAACGCGCTTATTCAGGACGGTTCGATTACCAACGCGAAGATCGGTAACGTCATTCAGTCAAACAACTACATCGCTGGGCAGCAAGGGTGGATGATTAATAAGAATGGCGGTTCTGAATTCCAGAACACTACTGTTCGAGGGACTATCTACGCTACCGATGGCGTATTTAAAGGTACTGTACAGGCGGAATCGTTTATAGGAGATATCGCCGTAGCAAAACGCTATGACAGCATGACGCTACGCCGAAACCAGACTGTTCAGCGTAACGGGCACTACCAAAACAGGGGCTATGGAATGACCGTAGTTCTTGCCTGTACGTTGGTATGTGAGACTTACGGAAACGGAAACTCGCAGCTTGGTTATACCGTTGATGTTACGTTTAATATCGGTGGTCAGCAGGTGGTACGCCGAATTTACATTGATGCTGGCAACATTGTTTATGGCACAACAGCGGTAGAACTTCGATTCGCTGCCGACCTTGCCGCTGACAACAACAATGTTAGCTTCTTCATCAAGGCTACCGGGCGCGATGCCGTCACCGACTATACCGTTACTGTCGACAACATCACAGCAACCGCATTCCGCACAAACTCAAATAGCTTTACATAA

Genome Context

Tertiary structure

QYC96847.1
ESMFold structure
Source ESMFold
pLDDT 77.0
Oligomeric state monomer