Phage RBP Database

Genbank accession

AIX34219.1 [GenBank]

Protein name

tail fiber protein

RBP type

TF

Evidence Phold

Probability 1,00

Protein sequence

MPLNKLENFIKNTDGRTLYVNPNDLNATDSITNQGTSLTEPFRTIQRALIESARFSYVRGDDNDLIERTTIMVYPGEHPIDNRPGFGIKTVGNSPVAVTPSGELIDPFQAFNLTDASNFDIESSNNVLYRFNSIYGGVVVPRGTSIVGMDLRKTKIRPIYVPNPTDDSVDYSAIFRITGTCYFWQFTIFDGNENGVVFTDPRDFSENNQSRPTFSHHKLTAFEYADGVNPAVESGFELTDLAMYYSKLSNAYNEASGRPIDEKYPSDPGGFSPQRPEFEIVGAFATDPINITRLISGDGFVPDAVITVDTQVPHELNTGTPIKIRGVAISDYNISTKVSAVLSPTRFTYNLSFVRPNLPAEPSVSSATVTVETDTVTGASPYIFNCSMRSVWGINGMHADGAKATGFRSMVVAQFTAISLQKDDRSFVTYNKQARRYDGINVNKTVRGAELSAQSSSTNSATVYHLDPDAIYRPDWGTTHIKMSNDAVIQIVSVFAIGFNQHFASIGGADASITNSNSNFGQFALKADGFKNDAFLKDDKGFLTSFVSPKSAYNPETDDIEIIDWINIDFDLTRSIAFANQLYLTGYTNAEDKPPVVNQGFRIGANYKESLIQRTTVGAGADVTSSVRMCDNILGPGNNQATGSSVARKVYQVLAGPINNTLSLGVHGLLNGESVRVFSSTGDLPENLERGALYYANVVDGENIRIATSESNALNNIFLNIYGGVELRVESRVNDKEAGERGHPVQYDYTNQNWFVHTDANSDIYQYIVANPTSTDGIDFVSIFKRFGDNRALEDKLYRLRYVIPKESRNAKPPTPGYVLQASATTGARNNDDFILQDIGINDYEYNRNPRYIVSCTVIANEVEVRSEIPHNLNVGDKIKIVNVASTNNTGASQIKGFNGEFLVTRVINSREFRYDITDVNGFSRNPGTFTNNINERNILLPRYERKDLQSNVFVYRIETITDFLEGERDGIYHLFLLNGSNPVTETFTDIQYNQPVEDLYPQMDPDNLIQNPPATTTFAKRAPLGDVTIDEQQNSITKESVDKIYKTLNVGIIETATDGTVGAGGTRTTTLTFQREHEFNSVYSYTTLVGGGGYTDGTFYDVKLLSEFGTVWGGASAVVTVTAGTVTAVTIMDPGSGYSAGQTLFIDGTTIGGGTNATISITQADLEDNKHSILQISGGALYNPDSYVVMTSVEDQSSVGVARTSGSPAIIPGMYAYPADSGTGISSTTYNSDTGLTTLVSTGSAGFGLQRGNTFVVFSSNYSYLGKFFVSNVPTPDTLEFYSYRDLGTVSIVGKTGLDVNDANTGSLGENVGVRATPLYDNGVFYLEQSSGTGTQLTVRAEDGGVAGNVDSKMYLGRYFQMGSEIIRVASKNFDGANNNIVTVIRGALGTVVSNLPINTKVKAIRPSALELRRPSILRASGHTFEYLGYGPGNYSTSLPQLQVKQLPDDEIYLVQAQELSCGQVVYTGMSDNGDFYIGNTKYSATSGTQSTFDVPIPTVAGQPGSSNNVVFDEVIINRRLFVSGGETNEVQSQFDGPVKFTQSVTIQNNLFVTGTTQLNRIEITSTENATSSANGGALTIRGGAAIGKDFYVGGEMYTNAYQIEDTSAVLEIGTNQSSKDISVGGSTDTDRVVFNTTKLATGEGAEEVVNADAGVVVEGGLVVRDVIIAKEFRGAGTGGGPGTILLWGGSTSALPDRYLLCNGATLNKNTYNKLFEAIGYIHGGSGNSFKLPDLRNRFIPGAGSSYAVAAKGGDDSVVLTETQMPRHTHSTSAVNAPHTHPVSFTSGAANAPHKHPAGTGGGGNHNHPSGGTGGGGNHNHPSGGSNNTGNHGHPYSAPGQSKTDVANSNEKNVTSNVNASGAGTGGGGAHSHSVSVNSTSSAHNHPVSVNSGSSAHNHPVSVNSANAPHSHPISGNAGSANAPHVHPIGNTGGTASFDNRPKYYALCYIIQSE

Physico‐chemical properties

protein length:	1955 AA
molecular weight:	209741,94010 Da
isoelectric point:	5,19249
aromaticity:	0,08900
hydropathy:	-0,31801

Domains [InterPro]

InterPro ID	Start	End	Source	Name
IPR037053	1682	1737	InterPro	Phage tail collar domain superfamily
SSF88874	1683	1823	SUPERFAMILY	None
IPR011083	1684	1741	InterPro	Phage tail collar domain

	Name	Taxonomy ID	Lineage
Phage	Synechococcus phage ACG-2014f [NCBI]	1493511	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	Synechococcus sp. WH 7803 [NCBI]	32051	Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Genbank protein accession

AIX34219.1 [NCBI]

Genbank nucleotide accession

KJ019111.1 [NCBI]

CDS location

range 19185 -> 25052
strand +

CDS

TTGCCCCTTAATAAGTTAGAGAATTTCATTAAGAATACGGATGGACGTACTCTGTATGTTAATCCAAACGATCTTAATGCTACTGATAGTATTACAAACCAAGGCACTTCCCTTACAGAACCCTTCAGAACTATTCAGAGGGCGTTAATTGAGAGTGCGCGTTTCTCATATGTGCGTGGTGATGATAATGATCTCATCGAGAGAACCACCATCATGGTGTATCCCGGTGAGCATCCTATCGATAACCGTCCTGGTTTCGGTATTAAGACAGTAGGTAATAGTCCGGTAGCGGTAACTCCTTCAGGTGAATTGATTGATCCGTTCCAAGCATTTAACCTGACTGATGCTAGTAACTTTGATATTGAGTCTAGTAATAACGTTCTCTATAGATTTAACAGTATCTACGGTGGTGTTGTTGTTCCCCGTGGTACTTCTATCGTGGGTATGGACCTACGTAAGACAAAGATTCGTCCGATATATGTTCCCAACCCCACTGATGATTCAGTAGATTACTCAGCGATCTTCCGTATCACAGGTACTTGCTACTTCTGGCAGTTCACCATCTTCGATGGTAATGAGAATGGTGTAGTATTCACTGATCCAAGAGATTTCTCTGAGAATAACCAGTCCAGACCCACTTTCTCACACCACAAACTAACAGCATTTGAATACGCTGATGGTGTTAACCCAGCGGTAGAATCAGGGTTTGAACTTACTGACCTTGCTATGTATTATAGTAAGTTGTCTAACGCATATAATGAAGCATCTGGTCGTCCTATTGATGAGAAGTATCCATCAGATCCTGGTGGTTTTTCACCACAACGTCCTGAGTTTGAGATTGTTGGTGCATTCGCAACTGACCCAATCAATATCACTCGTTTAATCTCTGGTGATGGTTTTGTCCCTGATGCTGTCATCACAGTAGATACACAGGTCCCACATGAACTAAACACTGGAACACCAATTAAGATTCGTGGTGTTGCCATCAGTGACTATAATATCTCTACAAAAGTATCTGCAGTTCTTAGTCCTACTAGGTTTACGTATAACCTATCATTCGTAAGACCTAACCTACCAGCAGAACCTTCAGTATCCTCTGCAACTGTAACCGTTGAGACTGATACTGTAACAGGTGCTTCACCATACATCTTTAACTGTTCGATGAGATCAGTTTGGGGTATCAATGGAATGCATGCCGATGGTGCCAAAGCAACTGGATTCCGTTCCATGGTTGTTGCTCAGTTCACCGCGATCTCCCTTCAAAAAGATGATAGATCCTTCGTTACTTATAATAAACAGGCACGTAGATACGATGGTATCAATGTCAATAAGACTGTAAGGGGTGCTGAACTATCTGCACAGTCATCTTCTACCAACTCGGCAACTGTATACCACCTAGATCCTGACGCTATCTATCGTCCTGACTGGGGTACAACTCACATCAAGATGAGTAATGATGCAGTCATTCAGATTGTGTCTGTATTCGCTATTGGTTTCAATCAACACTTTGCTTCTATTGGTGGAGCTGATGCATCAATCACAAACTCTAACTCCAACTTTGGTCAGTTTGCACTGAAAGCTGATGGATTCAAGAATGATGCTTTCCTCAAAGATGATAAAGGTTTCCTAACATCATTTGTTTCTCCTAAGAGTGCGTATAACCCAGAAACTGATGATATTGAGATCATTGACTGGATCAACATTGACTTTGATCTAACTCGTAGTATTGCCTTTGCTAATCAACTCTATCTAACTGGTTATACTAACGCGGAAGATAAACCACCAGTAGTTAATCAGGGTTTCCGAATTGGTGCCAACTACAAAGAGAGTCTCATTCAGAGAACAACAGTTGGTGCTGGTGCAGATGTAACCTCATCAGTAAGAATGTGTGATAATATTCTCGGTCCTGGTAACAATCAAGCAACTGGTAGTAGTGTCGCTAGAAAGGTATATCAAGTTCTAGCTGGACCTATCAACAATACCCTTTCATTGGGTGTTCATGGACTACTTAATGGTGAGAGTGTAAGAGTATTCTCATCAACAGGTGACCTACCTGAGAACCTAGAAAGAGGTGCCCTATACTACGCAAATGTGGTTGATGGTGAGAATATTCGTATTGCTACTTCCGAGTCTAATGCACTCAACAACATCTTCCTCAACATCTATGGTGGTGTTGAACTTCGTGTTGAGTCTAGAGTTAATGATAAGGAAGCAGGTGAAAGAGGTCATCCCGTTCAGTATGACTACACTAACCAGAACTGGTTTGTTCATACTGATGCCAATAGTGATATCTATCAGTATATTGTAGCCAACCCAACCTCTACAGATGGTATTGACTTTGTATCCATATTCAAGAGATTTGGTGATAACAGGGCACTAGAAGACAAACTATATCGCCTCAGGTATGTTATTCCTAAGGAGTCAAGGAACGCAAAACCACCTACCCCTGGTTATGTTCTACAAGCATCAGCAACAACAGGTGCTAGGAATAACGATGACTTTATCCTACAGGATATTGGTATCAATGACTATGAATATAACAGAAACCCACGTTATATTGTAAGTTGTACTGTTATTGCTAATGAAGTTGAGGTTCGTAGTGAGATTCCACACAACTTGAATGTTGGTGATAAGATTAAAATAGTGAATGTTGCCAGTACAAATAACACTGGCGCATCACAAATCAAAGGTTTCAATGGTGAGTTCCTAGTTACTAGAGTTATCAACTCTCGTGAGTTTAGGTATGATATTACTGATGTAAATGGTTTTAGTAGAAATCCTGGTACCTTCACCAACAACATCAATGAAAGAAACATTCTTCTACCTCGTTATGAGAGAAAGGATCTACAGAGTAATGTATTCGTATATCGTATTGAAACTATCACTGATTTCCTAGAAGGTGAGAGGGATGGTATCTACCACTTATTCCTTCTTAATGGTTCTAACCCAGTAACAGAGACATTCACTGATATCCAATACAATCAACCTGTGGAAGATTTATATCCACAGATGGATCCTGATAACCTTATTCAGAACCCCCCTGCAACCACAACGTTTGCTAAGAGGGCACCCCTAGGTGATGTTACTATTGATGAACAACAGAACTCCATTACTAAAGAGTCTGTTGATAAAATATACAAGACACTTAATGTTGGTATCATTGAGACTGCTACTGATGGCACTGTTGGTGCTGGTGGAACACGTACAACCACACTAACATTCCAAAGAGAGCACGAGTTCAACTCTGTGTATAGTTACACCACACTAGTTGGTGGTGGTGGATATACTGATGGTACTTTCTATGATGTTAAACTACTCAGTGAGTTTGGCACAGTATGGGGAGGTGCTTCTGCTGTTGTTACTGTTACTGCTGGTACAGTTACCGCAGTTACTATCATGGATCCTGGTTCAGGTTATTCTGCAGGTCAGACACTATTCATCGATGGAACTACAATTGGTGGTGGTACTAACGCTACTATTAGTATTACTCAGGCAGACTTAGAGGATAACAAGCATAGTATCCTACAGATTTCTGGTGGTGCTTTGTATAACCCAGATTCATATGTAGTGATGACCAGTGTTGAGGATCAGTCTTCAGTTGGTGTTGCTAGAACTTCTGGAAGTCCTGCTATTATTCCTGGTATGTACGCATATCCAGCAGATAGTGGAACAGGTATTTCTTCAACTACATATAACTCCGATACAGGTTTAACAACACTAGTATCTACAGGTAGTGCTGGTTTTGGTCTTCAGAGGGGTAACACTTTCGTTGTATTCAGTAGTAACTATAGCTATCTCGGTAAGTTCTTTGTATCTAATGTTCCAACTCCAGATACATTGGAGTTCTACTCATACCGAGATCTAGGAACTGTATCTATTGTAGGTAAGACAGGTTTAGATGTAAATGATGCTAACACTGGTTCCTTAGGTGAGAACGTGGGTGTTAGAGCTACACCACTATATGATAACGGTGTATTCTATCTTGAACAGTCTTCAGGTACTGGAACACAACTAACAGTTAGGGCTGAAGATGGTGGTGTGGCTGGTAATGTAGACTCTAAGATGTACCTAGGAAGATACTTCCAAATGGGTTCTGAGATTATCAGAGTTGCTAGTAAGAACTTTGATGGAGCCAATAACAATATCGTAACTGTTATCCGTGGTGCTCTTGGTACCGTTGTTAGCAACCTTCCCATTAATACTAAGGTGAAGGCAATCAGACCTTCCGCACTAGAACTTAGAAGACCTTCTATTCTACGTGCCTCAGGTCACACCTTTGAATATCTTGGTTATGGTCCTGGTAACTATTCCACTTCATTACCACAACTACAGGTTAAGCAACTCCCAGATGATGAAATTTACCTAGTACAGGCTCAGGAACTATCCTGTGGTCAGGTTGTTTATACTGGTATGAGTGATAATGGTGACTTCTATATCGGTAATACCAAGTATTCCGCAACCTCAGGAACACAATCAACCTTTGATGTTCCCATCCCAACTGTTGCTGGTCAACCAGGTAGTTCTAATAATGTTGTGTTTGATGAAGTTATCATCAACCGTCGTCTATTCGTATCTGGTGGTGAAACTAATGAGGTTCAGTCACAGTTTGATGGTCCTGTTAAGTTTACCCAGTCTGTTACTATTCAGAACAATCTTTTCGTAACTGGTACAACTCAACTCAATAGAATTGAGATCACCAGTACAGAGAACGCAACCAGTTCTGCTAATGGTGGAGCACTAACTATCAGAGGTGGTGCTGCTATTGGTAAAGACTTCTATGTTGGTGGTGAAATGTACACCAACGCATATCAAATAGAAGATACAAGTGCAGTTCTTGAAATTGGTACTAACCAGTCATCTAAGGATATCTCTGTTGGTGGTTCAACTGATACAGATAGAGTTGTTTTTAATACAACTAAACTAGCAACAGGTGAAGGTGCTGAAGAGGTAGTTAACGCAGACGCTGGTGTTGTTGTTGAGGGTGGATTAGTTGTTCGTGATGTTATTATCGCGAAAGAGTTTAGAGGTGCTGGAACTGGTGGTGGTCCTGGTACTATCCTACTCTGGGGTGGTTCTACTAGTGCTCTCCCTGACAGATATCTACTCTGCAACGGAGCTACTCTCAATAAAAACACATATAACAAACTATTCGAAGCCATTGGTTATATCCATGGTGGTAGTGGTAATAGTTTTAAGTTACCAGATTTGAGAAATAGGTTTATCCCTGGTGCTGGTAGTTCTTATGCGGTAGCTGCAAAAGGTGGGGATGATTCAGTTGTACTAACTGAAACGCAGATGCCACGCCACACGCACTCAACTTCAGCAGTCAACGCACCACATACTCACCCAGTATCGTTTACTAGTGGAGCGGCAAATGCACCACATAAACACCCAGCTGGCACAGGTGGCGGTGGAAATCATAACCACCCATCAGGTGGCACAGGTGGTGGTGGTAATCACAATCACCCATCAGGTGGCTCTAACAATACAGGCAACCATGGACACCCGTATAGTGCTCCGGGGCAATCCAAAACTGATGTTGCTAATTCTAACGAGAAGAATGTAACTAGCAACGTCAATGCCTCAGGTGCAGGAACCGGTGGTGGTGGAGCACACTCCCACTCTGTTTCAGTTAACAGTACATCCTCAGCTCATAATCACCCAGTAAGTGTCAACTCTGGATCTTCAGCTCATAATCACCCTGTTAGTGTTAATTCAGCTAATGCACCACATTCCCACCCAATTAGTGGTAATGCAGGTTCTGCAAACGCACCTCACGTTCACCCAATTGGTAATACTGGTGGTACTGCTTCCTTTGACAATAGACCCAAATACTACGCTCTCTGCTATATTATCCAATCAGAGTGA

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence