Genbank accession
QOC57883.1 [GenBank]
Protein name
putative tail protein
RBP type
TSP
Evidence RBPdetect
Probability 0,79
TF
Evidence RBPdetect2
Probability 0,64
Seq2Symm
C1 confidence 0,587 truncated
C1 0,587
I 0,094
C6 0,005
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNMPVEKKPQVLFVYVTNPLVPADSKIAVHNEYDAGRSLGDYLGPIEGRWAVSVSGKIIEQEDWDTTFLQAADCVVIAPLIEGGGGEGGGGKTILRMVALIAVTYFSAGAGTALMGAGTIGATAVTVGLTVAGTMAINALLPPATPKTPSSGSDYDSSPTYGIDGPKNMSTRSIPVPVVYGECWFAGNFIQSYVDNVGDDQYLNLLINVGEGPIEGISDVQLNSQPISNFTNVETWFRDGSENQTMIPYFGDIITPVNRSVEITQGLYVIHSVNEPVDRLRVDVVYPGGLSQVDDEDGLEGFTVNWSLEIREAGGLWRPFVEGAGNNVIAEHAKKMSAIRRSFWSSTLDRTKRYEVRAIHNQDTTNSNVNNKVTLTDVNYITFDDLNYKHTALFGMRIKMSDQLNGIPAVSYRVKGRKVPVYSPLTGNFVETWTANPAWIVLDVLMNKRYGGQIGASRIKMEYFRQWATYCDQNGLVFNGAIDQRTNLWDAIAPISKIGRGQIIRAGTRFQVSMVRKSKPVQMFSMGNIKKGSLALDWLSDEERANECHVTYFDKNDQGKQKTVIVPNLAARERGEEAKPTEMTLYGVDNVTQATREGTLAMNMQQLLKTISFEAPISAIACTLGDVIAIQHDVPAWGQGGLTDVGSTKNVLVVDKPVTQPLGGTYAVRVRHDKVLQGTWEIEELIGNIVVPTGPFNIQMFERYRRLFAPGTGKDYEVTEPIIDQYGRHGLRLGSTAGLSVGDTIQLFDTNVVETRFVGAVSADGLRITPTQGFSAIPATESPWAFGLNGSEIMHMTVMDISGKDDLWKKISGLEYSDSAYDDTVIDYKPDPTNTNPNIQNVNFNGFVERRYLVGASYTSDVEMTWSSSDITYAYAEVHINIDGEGWKFMDANATFYQLTAINSGTIQLKLVPVTIEGFKPNFSNVPTYTYTVVGGVPRNPDPPLNFRVGTITNDIIELLWGDLNAWSAAQNVYAYEIWHAEGENAVLESAQLIAVTKNNHYPHVGLLKNSWHTYWIRTINVTAKNAKSAFIPAAGLSVQCKDNDPYGLIDLTDLAPSLRESINAPKVIEDLSTIIANAATKLEEAEDAQKQEVYNREQAVGDVKASVNEQVAAIADETEAMAARISQMEASTSPATQAKIDELAQVVANGDSALAQKISLMQVKFADDLSAAITEEQTVRASAVEAIASQVTTLTTTVGENTASLQQVSKVVDGVKASWTLRVDINGIVSGFGLATGEGGVSEFAIMASRFKIFGPGPGDTVVKTAVFNVDSETGIAYLRNAVVGNLQSDNYVSGVSGWCLKK
Physico‐chemical
properties
protein length:1304 AA
molecular weight: 141891,30180 Da
isoelectric point:4,91904
aromaticity:0,08436
hydropathy:-0,15146

Domains

View on InterPro
QOC57883.1
1 1304 aa
ATT 255–382 · ATT 483–636 · STR 941–1233 · RBD 1234–1304

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QOC57883.1
1 1304 aa
Domain Start End Length (AA) Confidence
N-terminal 1 681 681 0,7867
Central domain 682 1231 551 0,0846
C-terminal 1232 1304 72 0,2215
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Pseudomonas phage phiK7B1 [NCBI] · taxon 2755401

Coding sequence (CDS)

Genbank protein accession
QOC57883.1 [NCBI]
Genbank nucleotide accession
MT354569 [NCBI]
CDS location
range 22592 -> 26506
strand +
CDS
ATGAATATGCCGGTTGAGAAAAAGCCGCAGGTGCTGTTCGTCTATGTGACGAACCCGCTGGTCCCTGCTGACAGCAAGATCGCTGTCCACAATGAGTACGACGCCGGCCGGTCGCTCGGTGACTACCTGGGTCCGATTGAAGGTCGCTGGGCTGTCTCTGTCTCGGGCAAGATCATCGAGCAAGAAGACTGGGACACCACCTTTCTTCAGGCCGCTGACTGCGTGGTCATCGCGCCCCTGATCGAAGGTGGTGGCGGTGAAGGTGGTGGCGGTAAGACGATCCTGCGTATGGTCGCTCTGATCGCAGTCACCTACTTCTCCGCTGGTGCTGGTACTGCGCTGATGGGTGCCGGTACGATCGGTGCCACCGCAGTGACTGTGGGTCTGACTGTCGCCGGTACAATGGCGATCAACGCCCTGCTGCCGCCAGCCACTCCGAAGACTCCTTCAAGCGGTTCTGACTACGACTCCAGCCCAACCTACGGCATCGACGGCCCGAAGAACATGAGTACCCGGTCTATCCCGGTGCCTGTGGTCTACGGTGAGTGCTGGTTCGCGGGCAACTTCATCCAGTCCTATGTCGATAACGTGGGTGACGATCAGTACCTCAACCTGCTGATCAACGTTGGTGAAGGTCCGATCGAAGGCATCAGTGACGTTCAACTGAACTCTCAGCCGATCAGCAACTTCACCAACGTCGAAACCTGGTTCCGCGACGGCTCCGAAAACCAGACGATGATCCCGTACTTCGGCGACATCATCACGCCGGTGAACCGCTCTGTCGAAATCACCCAGGGTCTGTACGTCATCCACTCTGTCAATGAGCCTGTGGATCGTCTGCGTGTGGACGTCGTTTACCCAGGTGGTCTGAGCCAGGTCGATGACGAAGACGGCTTGGAAGGCTTCACCGTCAACTGGTCCTTGGAGATTCGAGAAGCCGGTGGTCTGTGGCGTCCATTCGTTGAGGGTGCCGGCAACAACGTGATCGCTGAGCATGCCAAGAAGATGTCGGCGATCCGTCGCAGCTTCTGGTCTAGCACCCTCGACCGCACCAAGCGTTACGAAGTCCGTGCGATTCACAACCAGGACACCACGAACTCCAACGTCAACAACAAGGTGACGCTGACCGACGTCAACTACATCACCTTCGACGACCTGAACTACAAGCACACCGCTCTGTTCGGTATGCGCATCAAGATGTCCGATCAACTGAACGGCATCCCAGCGGTATCGTATCGAGTCAAAGGCCGGAAGGTTCCGGTCTACAGCCCGCTCACCGGTAACTTCGTTGAGACCTGGACTGCGAACCCGGCCTGGATCGTTCTCGACGTCCTGATGAACAAGCGCTACGGCGGCCAGATCGGTGCGAGCCGAATCAAGATGGAATACTTCCGTCAGTGGGCGACCTACTGCGACCAGAACGGTCTGGTGTTCAACGGCGCTATCGACCAGCGCACCAACCTGTGGGATGCAATCGCGCCAATCTCCAAGATCGGTCGCGGCCAGATCATTCGAGCAGGCACCCGGTTCCAGGTCTCGATGGTTCGCAAGTCGAAGCCGGTTCAGATGTTCTCGATGGGCAACATCAAGAAGGGCTCCCTCGCACTCGACTGGTTGTCGGATGAAGAGCGCGCCAACGAATGTCACGTCACCTACTTCGACAAGAACGACCAGGGCAAGCAAAAGACCGTCATCGTTCCAAACCTGGCTGCGCGTGAGCGTGGAGAGGAAGCCAAGCCGACCGAAATGACTCTGTACGGCGTGGACAACGTTACCCAAGCGACTCGCGAAGGTACTTTGGCCATGAACATGCAGCAGCTCCTGAAGACCATCAGCTTCGAGGCTCCAATCTCTGCAATCGCTTGCACACTGGGCGACGTGATCGCGATTCAGCATGACGTCCCGGCGTGGGGTCAGGGTGGTCTGACTGACGTGGGCAGCACCAAGAACGTTCTGGTGGTCGACAAGCCCGTCACTCAGCCTCTGGGTGGGACTTACGCTGTGCGCGTGCGTCACGACAAGGTTCTGCAAGGCACCTGGGAAATCGAAGAGCTGATCGGGAACATCGTCGTCCCTACCGGCCCGTTCAACATCCAGATGTTCGAGCGCTACCGTCGTCTGTTCGCACCCGGCACCGGTAAAGACTACGAGGTCACTGAGCCAATCATCGACCAATACGGTCGTCATGGTCTGCGCCTGGGTAGCACTGCGGGCTTGAGCGTGGGTGACACCATTCAGCTCTTCGACACAAACGTCGTTGAGACCCGCTTCGTGGGCGCTGTGAGCGCTGATGGGCTGCGAATCACACCGACGCAGGGGTTCAGCGCGATCCCCGCTACAGAGAGCCCCTGGGCGTTCGGTCTGAACGGCTCTGAAATCATGCACATGACCGTCATGGACATCAGCGGCAAGGATGACCTGTGGAAGAAGATCAGCGGTCTTGAGTACAGCGACAGCGCCTACGACGACACCGTGATCGACTACAAGCCCGATCCGACCAACACCAACCCGAACATCCAGAACGTCAACTTCAACGGGTTCGTGGAGCGCCGGTACTTGGTGGGCGCGAGCTACACCTCCGACGTCGAAATGACCTGGAGCAGCTCTGACATCACCTACGCCTACGCCGAAGTCCACATCAACATTGATGGGGAGGGCTGGAAGTTCATGGATGCGAACGCCACCTTCTACCAGTTGACTGCGATCAACAGTGGGACGATTCAGCTCAAGCTGGTGCCGGTGACTATCGAGGGCTTCAAGCCGAACTTCTCGAACGTGCCGACCTACACCTACACCGTTGTGGGTGGTGTGCCACGCAACCCTGATCCACCCTTGAACTTCCGGGTGGGCACAATCACCAACGACATCATTGAGCTGTTGTGGGGTGACTTGAACGCCTGGTCGGCCGCGCAGAACGTGTACGCCTACGAAATCTGGCACGCTGAGGGCGAGAACGCTGTTCTGGAATCCGCACAGCTCATTGCTGTGACCAAGAACAACCACTACCCGCACGTCGGTCTGCTGAAGAACTCCTGGCACACCTACTGGATTCGGACGATCAACGTAACCGCGAAGAACGCGAAGTCCGCATTCATCCCGGCCGCCGGTCTGTCGGTACAGTGCAAGGACAACGATCCATACGGTCTGATCGACCTGACTGACCTGGCCCCAAGCCTGCGTGAGAGCATCAACGCGCCGAAGGTGATCGAAGACCTGTCGACCATCATCGCGAACGCTGCGACCAAGCTGGAAGAGGCTGAAGACGCACAGAAGCAAGAGGTCTACAACCGCGAACAGGCAGTTGGTGACGTCAAGGCTTCCGTGAACGAGCAAGTGGCTGCGATCGCTGACGAAACCGAAGCGATGGCCGCGCGCATCAGCCAGATGGAAGCAAGCACGTCGCCGGCTACTCAAGCCAAGATCGACGAGCTGGCTCAGGTGGTTGCGAACGGTGACAGTGCGCTGGCGCAGAAAATCTCGCTGATGCAGGTGAAGTTCGCTGACGACCTCAGCGCTGCAATCACCGAAGAGCAGACTGTCCGTGCGAGCGCGGTAGAAGCGATTGCGAGCCAAGTGACCACGCTGACCACGACTGTCGGCGAGAACACTGCCAGCTTGCAGCAGGTGTCCAAAGTGGTCGACGGTGTGAAAGCATCCTGGACCCTGCGAGTGGACATCAACGGGATCGTGTCGGGCTTCGGTCTGGCTACCGGTGAAGGTGGTGTGTCCGAGTTCGCGATCATGGCCAGCCGGTTCAAGATTTTCGGACCTGGCCCGGGTGACACGGTTGTGAAGACTGCGGTGTTCAACGTGGACTCCGAAACCGGTATCGCTTACCTCCGCAACGCGGTCGTGGGCAACCTTCAGTCCGACAACTACGTGAGCGGCGTTTCGGGGTGGTGCCTAAAAAAGTAG

Genome Context

Tertiary structure

QOC57883.1
ColabFold structure
Source ColabFold
pLDDT 74.8
Oligomeric state monomer