Genbank accession
AGG54343.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,87
TSP
Evidence RBPdetect2
Probability 0,51
Seq2Symm
C1 confidence 0,539 truncated
C1 0,539
C3 0,072
I 0,029
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MALTRLKNIITSRTGRIIYVNPDDFDASDSIDNRGNSSLRPFKSLQRAFLEVARFSYRVGLSNDEFDAFSILLYPSEYIVDNRPGEVLYTNIPPLDANSNMDVTSPNNVLYKFNSVEGGMIVPRGCSLVGMDLRRTKIIPKYVPYPTTFPAKGINTEEQVPSKTAIFRVTGGCYFWQFSLFDGDPTGVYYKPDDSETIPPSYSHHKLTGFEFADGNNTLSQLINDLGTVENSAEITGSSIPNLLERTDLDIYYQKVSRGFATIPDTSGDPATDQIQARVEENRIVGPISDEFRVLQITRNGNTATAITVDEQNNPKNHGFSVGVNVNISGVTGSTGPQTDLDAQLYNGSFAVTSASGNVFTYQLAEEPSGNAVGSNIVVKVEIDTVDSASPYMFNLSLRSVWGMNGMHADGAKATGFKSMVVAQYTGLSLQKDDRAFVKYNATTGNYDEGGPGAHLDGFAEYKKGWRHTHVMCSNDSFIQVVSVFAVGYADHFAGFQGADMSITNSNSNFGNTALRSKGFKRAAFTKDKAGTLTHIIPPKSLADVDEISVNWTNIDIKRTLTINPALAGQGGVLGSRLYLYGYTNETAPPPNKVQGYVIGARQDGLGANAVPDKINCLLIPSPGSAPEIKTAEINPFGPDVSGTSAGGDGSPIQFDSSTYTIGGVANTVGGWYISVNATDNQIYQTLVNNSSSGNPPGTYANLNFTPTTFIKRVPDARNLTDRTYRVRYVIPKDQNPPLPRSPIAGFVLQPNNTDNTDYKLSKCYYIYDIQEVQKFERGISDGIFYLTLLCGSISPTTSNFDDMAFSQNVNEVYPAFDRDNPNADPAASVSVADNETIGLVYGTDGASPVPARDDQRSITKEAILFLLNDTGWVAGSSPGWNSINNTLSGIDLTARLGDEETRKIPILEDSANNDALVPINVELRRHSILRSGNHTFEYTGFGPGNYSTAFPQTQVETLSDEQIRLSQSLKEEAGVAFYSGLNSNGDLFIGNQVINPVTGQITSEDIAQLNVLGEENTTIETFSEVVITDKLTVIGGASNNLESIFSGPATFQGTITSQKDILAKKLTYNNQDGTVLKSTLLAPELKTGTPPVGQGTPDLSAVLNYNAPSDGDIVYNIDWEPGKNLGWMYYESVWYKFGLTNTDVFQFGEYDSSYPQHIGLGRAPSSTYRLEVEGSQRITGDLRVDGRGGVAPDKYITRRTQGDGSTLNYQITSYAGVVHNSKSVIVTINGVLQHPDVNYTVDSNGTNVVFASGDAPTSNDFVEIRELPI
Physico‐chemical
properties
protein length:1270 AA
molecular weight: 137791,13440 Da
isoelectric point:4,77575
aromaticity:0,09370
hydropathy:-0,33488

Domains

View on InterPro
AGG54343.1
1 1270 aa
STR 296–379 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

AGG54343.1
1 1270 aa
Domain Start End Length (AA) Confidence
N-terminal 1 91 91 0,9558
Central domain 92 301 211 0,9345
C-terminal 302 1270 968 0,1028
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AGG54343.1 [NCBI]
Genbank nucleotide accession
HQ316603.1 [NCBI]
CDS location
range 67156 -> 70968
strand -
CDS
ATGGCACTAACTCGTCTTAAGAATATTATCACGTCCCGTACGGGTCGTATCATTTACGTCAACCCTGACGACTTTGATGCCAGTGATAGTATTGACAACAGAGGTAACTCCTCACTCAGACCGTTCAAATCTCTGCAACGTGCATTCCTTGAGGTGGCACGTTTCTCATATCGTGTTGGATTAAGTAATGACGAGTTTGATGCCTTCAGTATTCTCTTATATCCTTCAGAGTATATTGTTGACAACAGACCTGGCGAAGTATTATATACAAATATTCCCCCATTAGACGCTAACTCCAACATGGATGTTACGTCTCCTAACAACGTATTATATAAATTTAATTCAGTTGAAGGTGGTATGATCGTACCTAGAGGTTGTTCTCTAGTTGGTATGGATCTTAGAAGGACTAAGATTATTCCTAAGTACGTTCCTTATCCTACAACATTCCCTGCTAAAGGTATCAACACCGAGGAACAGGTTCCTTCAAAAACTGCTATCTTCCGTGTTACAGGTGGTTGCTATTTCTGGCAGTTCAGTTTATTTGATGGTGATCCTACAGGTGTATATTACAAACCTGATGATTCAGAGACAATCCCACCATCTTATTCACACCACAAACTTACAGGTTTTGAATTCGCAGACGGAAACAATACATTAAGTCAATTAATTAACGACTTGGGAACTGTAGAAAACTCTGCAGAGATTACAGGTTCATCTATCCCGAACCTATTAGAAAGAACTGACCTAGATATCTATTATCAGAAAGTATCTCGTGGTTTTGCTACCATCCCTGATACATCTGGAGACCCTGCAACTGACCAAATTCAGGCAAGGGTAGAAGAAAACAGAATCGTTGGACCTATCTCAGATGAATTTAGAGTTCTCCAAATTACACGCAATGGCAACACTGCTACAGCAATTACAGTTGACGAGCAGAATAACCCTAAGAACCACGGATTTTCTGTTGGTGTTAACGTTAACATTTCTGGTGTCACTGGATCTACTGGACCCCAAACAGACTTAGATGCTCAATTATATAATGGTTCGTTCGCTGTTACTTCAGCATCTGGTAACGTATTCACTTATCAGTTAGCAGAAGAACCATCTGGTAATGCTGTTGGTTCTAACATTGTTGTTAAAGTTGAGATTGATACTGTTGACTCAGCATCACCATATATGTTTAACCTTTCACTAAGATCAGTGTGGGGTATGAACGGTATGCATGCTGATGGTGCCAAGGCAACTGGATTTAAGTCAATGGTTGTTGCCCAGTATACGGGACTATCATTGCAGAAAGACGACAGAGCATTTGTTAAATATAATGCTACGACAGGAAACTATGATGAGGGAGGACCTGGTGCTCACTTAGATGGTTTTGCTGAATATAAAAAAGGATGGCGACATACTCACGTTATGTGCAGTAATGACTCATTCATTCAGGTCGTTTCGGTGTTCGCTGTGGGATACGCAGATCACTTTGCTGGATTCCAAGGTGCTGACATGTCTATTACTAACAGTAATAGTAACTTTGGTAATACTGCATTGAGATCAAAAGGATTTAAGAGAGCAGCATTCACTAAAGATAAAGCAGGCACACTTACACATATCATTCCACCTAAGTCACTTGCTGATGTTGATGAGATCTCAGTCAACTGGACTAACATTGATATTAAGAGAACACTTACAATTAACCCTGCACTTGCTGGTCAGGGTGGTGTACTTGGTTCTAGATTATATCTCTATGGATATACTAACGAGACAGCACCGCCACCGAACAAAGTTCAGGGTTATGTGATTGGTGCTAGACAGGATGGTTTAGGTGCTAACGCAGTACCTGACAAGATTAATTGTTTACTTATTCCTTCACCAGGTTCTGCACCTGAGATTAAAACTGCAGAGATCAACCCATTTGGACCTGATGTATCTGGTACAAGTGCAGGTGGTGATGGATCTCCTATTCAATTTGATAGTAGCACATATACTATCGGTGGTGTCGCTAACACAGTCGGTGGTTGGTATATATCTGTTAATGCTACTGACAATCAAATCTATCAAACTCTAGTTAATAATAGTAGTTCTGGTAACCCACCAGGCACATATGCTAACCTGAACTTTACTCCTACAACGTTCATTAAGCGTGTACCTGACGCTAGAAACCTGACTGACAGAACTTATCGTGTTCGTTATGTCATTCCTAAAGATCAGAACCCACCTCTACCTAGATCACCTATTGCAGGTTTCGTATTACAACCGAACAATACTGACAACACAGACTATAAGTTATCTAAGTGTTATTATATCTACGACATTCAAGAAGTCCAGAAGTTTGAGCGTGGTATAAGTGATGGTATATTCTATCTCACATTATTGTGTGGTAGTATCTCACCAACAACATCAAACTTTGACGACATGGCATTCTCTCAGAATGTTAATGAAGTTTATCCTGCATTTGACAGAGACAATCCAAACGCAGACCCTGCAGCATCTGTATCTGTTGCTGACAATGAAACAATCGGTCTAGTATATGGTACTGACGGTGCATCACCTGTACCTGCAAGGGATGATCAAAGAAGTATTACTAAAGAAGCAATTCTATTCTTATTAAATGATACTGGATGGGTCGCTGGATCCTCACCAGGTTGGAATAGTATTAACAATACTCTATCTGGTATTGATTTGACTGCTAGATTAGGTGATGAAGAAACTAGAAAGATTCCTATTCTAGAAGATAGTGCAAACAATGATGCACTGGTTCCTATTAACGTAGAACTGAGACGACACTCCATTCTTAGATCTGGTAACCATACATTTGAATACACTGGTTTCGGACCAGGTAACTATTCAACTGCATTCCCACAGACACAGGTTGAAACTCTATCTGATGAACAGATTAGATTATCACAGTCTCTCAAAGAAGAGGCAGGCGTTGCATTCTACTCTGGACTTAACTCTAACGGTGACCTATTTATTGGTAACCAAGTTATCAACCCTGTTACTGGTCAGATCACATCTGAAGATATTGCACAGTTAAATGTATTAGGTGAAGAGAATACTACCATTGAAACATTCTCTGAAGTTGTTATTACTGACAAACTAACTGTTATCGGTGGTGCAAGTAACAACTTAGAATCTATCTTCTCAGGTCCTGCTACATTCCAAGGCACTATTACTTCTCAGAAAGATATTCTTGCTAAGAAGTTAACATATAACAACCAAGATGGTACGGTTCTTAAATCTACTCTCTTAGCACCTGAATTGAAAACTGGTACTCCCCCAGTTGGTCAAGGTACACCTGATTTAAGTGCAGTATTGAACTACAATGCTCCTAGTGATGGTGACATTGTATATAATATTGACTGGGAACCTGGTAAAAACCTAGGTTGGATGTACTATGAATCTGTATGGTACAAGTTTGGACTAACTAACACCGATGTATTCCAATTTGGAGAGTATGATTCATCCTACCCTCAACATATTGGTTTAGGTAGAGCGCCATCGTCCACATATAGATTAGAAGTAGAGGGATCGCAGCGTATTACTGGTGACCTTCGTGTTGATGGTCGTGGTGGTGTTGCTCCTGATAAATATATTACTAGACGTACTCAGGGTGATGGTTCTACCCTGAACTATCAGATTACATCATACGCTGGTGTTGTACACAATTCTAAGTCGGTGATTGTTACTATCAATGGTGTATTACAGCATCCTGATGTTAACTATACTGTTGATTCAAACGGTACTAACGTAGTGTTCGCATCTGGCGATGCTCCTACATCAAATGATTTTGTTGAAATTAGAGAACTACCTATCTAA

Genome Context

Tertiary structure

AGG54343.1
ESMFold structure
Source ESMFold
pLDDT 34.5
Oligomeric state monomer

Literature

Title Authors Date PMID Source
The Genome Sequence of Cyanophage S-SSM6b Henn,M.R., Sullivan,M.S., Osburne,M.S., Levin,J., Malboeuf,C., Casali,M., Russ,C., Lennon,N., Erlich,R., Young,S.K., Koehrsen,M., Yandava,C., Zeng,Q., Alvarado,L., Anderson,S., Berlin,A., Borenstein,D., Chen,Z., Engels,R., Freedman,E., Gellesch,M., Goldberg,J., Green,L., Griggs,A., Gujja,S., Heiman,D., Hepburn,T., Howarth,C., Jen,D., Larson,L., Lewis,B., Mehta,T., Park,D., Pearson,M., Roberts,A., Ryan,E., Saif,S., Shea,T., Shenoy,N., Sisk,P., Stolte,C., Sykes,S., Walk,T., White,J., Yu,Q., Coleman,M.L., Huang,K.H., Weigele,P.R., DeFrancesco,A.S., Kern,S.E., Thompson,L.R., Fu,R., Hombeck,B., Chisholm,S.W., Haas,B., Nusbaum,C., Galagan,J. and Birren,B. 2011-09-23 — GenBank