Phage RBP Database

Genbank accession

AIX45572.1 [GenBank]

Protein name

tail fiber protein

RBP type

TF

Evidence Phold

Probability 1,00

Protein sequence

MPLNKLENFIKNTDGRTLYVNPNDLNATDSITNQGTSLTEPFRTIQRALIESARFSYVRGDDNDLIERTTIMVYPGEHPIDNRPGFGIKTVGNSPVAVTPSGELIDPFQAFNLTDASNFDIESSNNVLYRFNSIYGGVVVPRGTSIVGMDLRKTKIRPIYVPNPTDDSVDYSAIFRITGTCYFWQFTIFDGNENGVVFTDPRDFSENNQSRPTFSHHKLTAFEYADGVNPAVESGFELTDLAMYYSKLSNAYNEASGRPIDEKYPSDPGGFSPQRPEFEIVGAFATDPINITRLISGDGFVPDAVITVDTQVPHELNTGTPIKIRGVAISDYNISTKVSAVLSPTRFTYNLSFVRPNLPAEPSVSSATVTVETDTVTGASPYIFNCSMRSVWGINGMHADGAKATGFRSMVVAQFTAISLQKDDRSFVTYNKQARRYDGINVNKTVRGAELSAQSSSTNSATVYHLDPDAIYRPDWGTTHIKMSNDAVIQIVSVFAIGFNQHFASIGGADASITNSNSNFGQFALKADGFKNDAFLKDDKGFLTSFVSPKSAYNPETDDIEIIDWINIDFDLTRSIAFANQLYLTGYTNAEDKPPVVNQGFRIGANYKESLIQRTTVGAGADVTSSVRMCDNILGPGNNQATGSSVARKVYQVLAGPINNTLSLGVHGLLNGESVRVFSSTGDLPENLERGALYYANVVDGENIRIATSESNALNNIFLNIYGGVELRVESRVNDKEAGERGHPVQYDYTNQNWFVHTDANSDIYQYIVANPTSTDGIDFVSIFKRFGDNRALEDKLYRLRYVIPKESRNAKPPTPGYVLQASATTGARNNDDFILQDIGINDYEYNRNPRYVVSCTVIANEVEVRSEIPHNLNVGDKIKIVNVASTNNTGASQIKGFNGEFLVTRVINSREFRYDITDVNGFSRNPGTFTNNINERNILLPRYERKDLQSNVFVYRIETITDFLEGERDGIYHLFLLNGSNPVTETFTDIQYNQPVEDLYPQMDPDNLIQNPPATTTFAKRAPLGDVTIDEQQNSITKESVDKIYKTLNVGIIETATDGTVGAGGTRTTTLTFQREHEFNSVYSYTTLVGGGGYTDGTFYDVKLLSEFGTVWGGASAVVTVTAGTVTAVTIMDPGSGYSAGQTLFIDGTTIGGGTNATISITQADLEDNKHSILQISGGALYNPDSYVVMTSVEDQSSVGVARTSGSPAIIPGMYAYPADSGTGISSTTYNSDTGLTTLVSTGSAGFGLQRGNTFVVFSSNYSYLGKFFVSNVPTPDTLEFYSYRDLGTVSIVGKTGLDVNDANTGSLGENVGVRATPLYDNGVFYLEQSSGTGTQLTVRAEDGGVAGSVDSKMYLGRYFQMGSEIIRVASKNFDGANNNIVTVIRGALGTVVSNLPINTKVKAIRPSALELRRPSILRASGHTFEYLGYGPGNYSTSLPQLQVKQLPDDEIYLVQAQELSCGQVVYTGMSDNGDFYIGNTKYSATSGTQSTFDVPIPTVAGQPGSSNNVVFDEVIINRRLFVSGGETNEVQSQFDGPVKFTQSVTIQNNLFVTGTTQLNRIEITSTENATSSANGGALTIRGGAAIGKDFYVGGEMYTNAYQIEDTSAVLEIGTNQSSKDISVGGSTDTDRVVFNTTKLATGEGAEEVVNADAGVVVEGGLVVRDVIIAKEFRGAGTGGGPGTILLWGGSTSALPDRYLLCNGATLNRTTYNKLFEAIGYIHGGSGSSFKLPDLRNRFIPGAGSSYAVAAKGGDDSVVLTQTQMPRHTHSTSAVNAPHTHPVSFTSGAANAPHKHPAGTGGGGNHNHPSGGTGGGGNHNHPSGGSNNTGNHGHPYSAPGQSKTDVANSNEKNVTSNVNASGAGTGGGGAHSHSVSVNSTSSAHNHPVSVNSGSSAHNHPVSVNSANAPHSHPISGNAGSANAPHVHPIGNTGGTDSFDNRPKYYALCYIIQSE

Physico‐chemical properties

protein length:	1955 AA
molecular weight:	209731,90230 Da
isoelectric point:	5,19084
aromaticity:	0,08900
hydropathy:	-0,31698

Domains [InterPro]

InterPro ID	Start	End	Source	Name
IPR037053	1682	1737	InterPro	Phage tail collar domain superfamily
SSF88874	1683	1823	SUPERFAMILY	None
IPR011083	1684	1741	InterPro	Phage tail collar domain

	Name	Taxonomy ID	Lineage
Phage	Synechococcus phage ACG-2014f [NCBI]	1493511	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	Synechococcus sp. WH 7803 [NCBI]	32051	Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Genbank protein accession

AIX45572.1 [NCBI]

Genbank nucleotide accession

KJ019159.1 [NCBI]

CDS location

range 19428 -> 25295
strand +

CDS

TTGCCCCTTAATAAGTTAGAGAATTTCATTAAGAATACGGATGGACGTACTCTGTATGTTAATCCAAACGATCTTAATGCTACTGATAGTATTACAAACCAAGGCACTTCCCTTACAGAACCCTTCAGAACTATTCAGAGGGCGTTAATTGAGAGTGCGCGTTTCTCATATGTGCGTGGTGATGATAATGATCTCATCGAGAGAACCACCATCATGGTGTATCCCGGTGAGCATCCTATCGATAACCGTCCTGGTTTCGGTATTAAGACAGTAGGTAATAGTCCGGTAGCGGTAACTCCTTCAGGTGAGTTGATTGATCCGTTCCAAGCATTTAACCTGACTGATGCTAGTAACTTTGATATTGAGTCTAGTAATAACGTTCTCTATAGATTTAACAGTATCTACGGTGGTGTTGTTGTTCCCCGTGGTACTTCTATCGTGGGTATGGACCTACGTAAGACAAAGATTCGTCCGATATATGTTCCCAACCCCACTGATGATTCAGTAGATTACTCAGCGATCTTCCGTATCACAGGTACTTGCTACTTCTGGCAGTTCACCATCTTTGATGGTAATGAGAATGGTGTAGTATTCACTGACCCAAGAGATTTCTCTGAGAATAACCAGTCCAGACCCACTTTCTCACACCACAAACTAACAGCATTTGAATACGCTGATGGTGTCAACCCAGCGGTAGAATCAGGGTTTGAACTCACTGACCTTGCTATGTATTATAGTAAGTTGTCTAACGCATATAATGAAGCATCTGGTCGTCCTATTGATGAGAAGTATCCATCAGATCCTGGTGGTTTTTCACCACAACGTCCTGAGTTTGAGATTGTTGGTGCATTCGCAACTGACCCAATCAATATCACTCGTTTAATCTCTGGTGATGGTTTTGTCCCTGATGCTGTCATCACAGTAGATACACAGGTCCCACATGAACTAAACACTGGAACACCAATTAAGATTCGTGGTGTTGCCATCAGTGACTATAATATCTCTACAAAAGTATCTGCAGTTCTTAGTCCTACTAGGTTTACGTATAACCTATCATTCGTAAGACCTAACCTACCAGCAGAACCTTCAGTATCCTCTGCAACTGTAACCGTTGAGACTGATACTGTAACAGGTGCTTCACCATACATCTTTAACTGTTCGATGAGATCAGTTTGGGGTATCAATGGAATGCACGCCGATGGTGCCAAAGCAACTGGATTCCGTTCCATGGTTGTTGCTCAGTTCACCGCGATCTCCCTTCAAAAAGATGATAGATCCTTCGTTACTTATAATAAACAGGCACGTAGATACGATGGTATCAACGTCAATAAGACTGTAAGGGGTGCTGAACTATCTGCACAGTCATCTTCTACTAACTCAGCAACTGTATACCACCTAGATCCTGACGCTATCTATCGTCCTGACTGGGGTACAACTCACATCAAGATGAGTAATGATGCAGTCATTCAGATTGTGTCTGTATTCGCTATTGGTTTCAATCAACACTTTGCTTCTATTGGTGGAGCTGATGCATCAATCACAAACTCTAACTCCAACTTTGGTCAGTTTGCACTGAAAGCTGATGGATTCAAGAATGATGCTTTCCTCAAAGATGATAAAGGTTTCCTAACATCATTTGTTTCTCCTAAGAGTGCGTATAACCCAGAAACTGATGATATTGAGATCATTGACTGGATCAACATTGACTTTGATCTAACTCGTAGTATTGCCTTTGCTAATCAACTCTATCTAACTGGTTATACTAACGCGGAAGATAAACCACCAGTAGTTAATCAGGGTTTCCGAATTGGTGCCAACTACAAAGAGAGTCTCATTCAGAGAACAACAGTTGGTGCTGGTGCAGATGTAACCTCATCAGTAAGAATGTGTGATAATATTCTCGGTCCTGGTAACAATCAAGCAACTGGTAGTAGTGTCGCTAGAAAGGTATATCAAGTTCTAGCTGGACCTATCAACAATACCCTTTCATTGGGTGTTCATGGACTACTTAATGGTGAGAGTGTAAGAGTATTCTCATCAACAGGTGACCTACCTGAGAACCTAGAAAGAGGTGCCCTATACTACGCAAATGTGGTTGATGGTGAGAATATTCGTATTGCTACTTCCGAGTCTAATGCACTCAACAACATCTTCCTCAACATCTATGGTGGTGTTGAACTTCGTGTTGAGTCTAGAGTTAATGATAAGGAAGCAGGTGAAAGAGGTCATCCCGTTCAGTATGACTACACTAACCAGAACTGGTTTGTTCATACTGATGCCAATAGTGATATCTATCAGTATATTGTAGCCAACCCAACCTCTACAGATGGTATTGACTTTGTATCCATATTCAAGAGATTTGGTGATAACAGGGCACTAGAAGACAAACTATATCGCCTCAGGTATGTTATTCCTAAGGAGTCAAGGAACGCAAAACCACCTACCCCTGGTTATGTTCTACAAGCATCAGCAACAACAGGTGCTAGGAATAACGATGACTTTATCCTACAGGATATTGGTATCAATGACTATGAATATAACAGAAACCCACGTTATGTTGTAAGTTGTACTGTTATTGCTAATGAAGTTGAGGTTCGTAGTGAGATTCCACACAACTTGAATGTTGGTGATAAGATTAAAATAGTGAATGTTGCCAGTACAAATAACACTGGCGCATCACAAATCAAAGGTTTTAATGGTGAGTTCCTAGTTACTAGAGTTATCAACTCTCGTGAGTTTAGGTATGATATTACTGATGTAAATGGTTTTAGTAGAAATCCTGGTACCTTCACCAACAACATCAATGAAAGAAACATTCTTCTACCTCGTTATGAGAGAAAGGATCTACAGAGTAATGTATTCGTATATCGTATTGAAACTATCACTGATTTCCTAGAAGGTGAGAGGGATGGTATCTACCACTTATTCCTTCTTAATGGTTCTAACCCAGTAACAGAGACATTCACTGATATCCAATACAATCAACCTGTGGAAGATTTATATCCACAGATGGATCCTGATAACCTTATTCAGAACCCCCCTGCAACCACAACGTTTGCTAAGAGGGCACCCCTAGGTGATGTTACTATTGATGAACAACAGAACTCCATTACTAAAGAGTCTGTTGATAAAATATACAAGACACTTAATGTTGGTATCATTGAGACTGCTACTGATGGCACTGTTGGTGCTGGTGGAACACGTACAACCACACTAACATTCCAAAGAGAGCACGAGTTCAACTCTGTGTATAGTTACACCACACTAGTTGGTGGTGGTGGATATACTGATGGTACTTTCTATGATGTTAAACTACTCAGTGAGTTTGGCACAGTATGGGGAGGTGCTTCTGCTGTTGTTACTGTTACTGCTGGTACAGTTACCGCAGTTACTATCATGGATCCTGGTTCAGGTTATTCTGCAGGTCAGACACTATTCATCGATGGAACTACAATTGGTGGTGGTACTAACGCTACTATTAGTATTACTCAGGCAGACTTAGAGGATAACAAGCATAGTATCCTACAGATTTCTGGTGGTGCTTTGTATAACCCAGATTCATATGTAGTGATGACCAGTGTTGAGGATCAGTCTTCAGTTGGTGTTGCTAGAACTTCTGGAAGTCCTGCTATTATTCCTGGTATGTACGCATATCCAGCAGATAGTGGAACAGGTATTTCTTCAACTACATATAACTCCGATACAGGTTTAACAACACTAGTATCTACAGGTAGTGCTGGTTTTGGTCTTCAGAGGGGTAACACTTTCGTTGTATTCAGTAGTAACTACAGCTATCTCGGTAAGTTCTTTGTATCTAATGTTCCAACTCCAGATACATTGGAGTTCTACTCATACCGAGATCTAGGAACTGTATCTATTGTAGGTAAGACAGGTTTAGATGTAAATGATGCTAACACTGGTTCCTTAGGTGAGAACGTGGGTGTTAGAGCTACACCACTATATGATAACGGTGTATTCTATCTTGAACAGTCTTCAGGTACTGGAACACAACTAACAGTTAGGGCTGAAGATGGTGGTGTGGCTGGTAGTGTAGACTCTAAGATGTACCTAGGAAGATACTTCCAAATGGGTTCTGAGATTATCAGAGTTGCTAGTAAGAACTTTGATGGAGCCAATAACAATATCGTAACTGTTATCCGTGGTGCTCTTGGTACCGTTGTTAGTAACCTTCCCATTAATACTAAGGTGAAGGCAATCAGACCTTCCGCACTAGAACTTAGAAGACCTTCTATTCTACGTGCCTCAGGTCACACCTTTGAATATCTTGGTTATGGTCCTGGTAACTATTCCACTTCATTACCACAACTACAGGTTAAGCAACTCCCAGATGATGAAATTTACCTAGTACAGGCTCAGGAACTATCCTGTGGTCAGGTTGTTTATACTGGTATGAGTGATAATGGTGACTTCTATATCGGTAATACCAAGTATTCCGCAACCTCAGGAACACAATCAACCTTTGATGTTCCCATCCCAACTGTTGCTGGTCAACCAGGTAGTTCTAATAATGTTGTGTTTGATGAAGTTATCATCAACCGTCGTCTATTCGTATCTGGTGGTGAAACTAATGAGGTTCAGTCACAGTTTGATGGTCCTGTTAAGTTTACCCAGTCTGTTACTATCCAGAACAATCTTTTCGTAACTGGTACAACTCAACTCAATAGAATTGAGATCACCAGTACAGAGAACGCAACCAGTTCTGCTAATGGTGGAGCACTAACTATCAGAGGTGGTGCTGCTATTGGTAAAGACTTCTATGTTGGTGGTGAAATGTACACCAACGCATATCAAATAGAAGATACAAGTGCAGTTCTTGAAATTGGTACTAACCAGTCATCTAAGGATATCTCTGTTGGTGGTTCAACTGATACAGATAGAGTTGTTTTTAATACAACTAAACTAGCAACAGGTGAAGGTGCTGAAGAGGTAGTTAACGCAGACGCTGGTGTTGTTGTTGAGGGTGGATTAGTTGTTCGTGATGTTATTATCGCGAAAGAGTTTAGAGGTGCTGGAACTGGTGGTGGTCCTGGTACTATCCTACTCTGGGGTGGTTCTACTAGTGCTCTCCCTGATAGGTATCTATTATGTAATGGAGCCACACTCAATAGAACAACATATAACAAACTATTCGAAGCCATTGGTTATATCCACGGTGGATCTGGTAGTAGTTTTAAGTTACCAGATTTGAGAAATAGGTTTATCCCTGGTGCTGGTAGTTCTTATGCGGTAGCCGCAAAAGGTGGGGATGATTCAGTTGTACTAACTCAAACGCAGATGCCACGCCACACGCACTCAACTTCAGCAGTCAACGCACCACATACTCACCCAGTATCGTTTACTAGTGGAGCGGCAAATGCACCACATAAACACCCAGCTGGCACAGGTGGCGGTGGAAATCATAACCACCCATCAGGTGGCACAGGTGGTGGTGGTAATCACAATCACCCATCAGGTGGCTCTAACAATACAGGCAACCATGGACACCCGTATAGTGCTCCGGGGCAATCCAAAACTGATGTTGCTAATTCTAACGAGAAGAATGTAACTAGCAACGTCAATGCCTCAGGTGCAGGAACCGGTGGTGGTGGAGCACACTCCCACTCTGTTTCAGTTAACAGTACATCCTCAGCTCATAATCACCCAGTAAGTGTCAACTCTGGATCTTCAGCTCATAATCACCCTGTTAGTGTTAATTCAGCTAATGCACCACATTCCCACCCAATTAGTGGTAATGCAGGTTCTGCAAACGCACCTCACGTTCACCCAATTGGTAATACTGGTGGTACTGATTCCTTTGACAATAGACCCAAATACTACGCTCTCTGCTATATTATCCAATCAGAGTGA

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence