Phage RBP Database

Genbank accession

AIX23211.1 [GenBank]

Protein name

tail fiber protein

RBP type

TF

Evidence Phold

Probability 1,00

Protein sequence

MPLNKLENFIKNTDGRTLYVNPNDLNATDSITNQGTSLTEPFRTIQRALIESARFSYVRGDDNDLIERTTIMVYPGEHPIDNRPGFGIKTVGNSPVAVTPSGELIDPFQAFNLTDASNFDIESSNNVLYRFNSIYGGVVVPRGTSIVGMDLRKTKIRPIYVPNPTDDSVDYSAIFRITGTCYFWQFTIFDGNENGVVFTDPRDFSENNQSRPTFSHHKLTAFEYADGVNPAVESGFELTDLAMYYSKLSNAYNEASGRPIDEKYPSDPGGFSPQRPEFEIVGAFATDPINITRLISGDGFVPDAVITVDTQVPHELNTGTPIKIRGVAISDYNISTKVSAVLSPTRFTYNLSFVRPNLPAEPSVSSATVTVETDTVTGASPYIFNCSMRSVWGINGMHADGAKATGFRSMVVAQFTAISLQKDDRSFVTYNKQARRYDGINVNKTVRGAELSAQSSSTNSATVYHLDPDAIYRPDWGTTHIKMSNDAVIQIVSVFAIGFNQHFASIGGADASITNSNSNFGQFALKADGFKNDAFLKDDKGFLTSFVSPKSAYNPETDDIEIIDWINIDFDLTRSIAFANQLYLTGYTNAEDKPPVVNQGFRIGANYKESLIQRTTVGAGADVTSSVRMCDNILGPGNNQANGSSVARKVYQVLAGPINNTLSLGVHGLLNGESVRVFSSTGDLPENLERGALYYANVVDGENIRIATSESNALNNIFLNIYGGVELRVESRVNDKEAGERGHPVQYDYTNQNWFVHTDANSDIYQYIVANPTSTDGIDFVSIFKRFGDNRALEDKLYRLRYVIPKESRNAKPPTPGYVLQASATTGARNNDDFILQDIGINDYEYNRNPRYIVSCTVIANEVEVRSEIPHNLNVGDKIKIVNVASTNNTGASQIKGFNGEFLVTRVINSREFRYDITDVNGFSRNPGTFTNNINERNILLPRYERKDLQSNVFVYRIETITDFLEGERDGIYHLFLLNGSNPVTETFTDIQYNQPVEDLYPQMDPDNLIQNPPATTTFAKRAPLGDVTIDEQQNSITKESVDKIYKTLNVGIIETATDGTVGAGGTRTTTLTFQREHEFNSVYSYTTLVGGGGYTDGTFYDVKLLSEFGTVWGGASAVVTVTAGTVTAVTIMDPGSGYSAGQTLFIDGTTIGGGTNATISITQADLEDNKHSILQISGGALYNPDSYVVMTSVEDQSSVGVARTSGSPAIIPGMYAYPADSGTGISSTTYNSDTGLTTLVSTGSAGFGLQRGNTFVVFSDNYSYLGKFFVSNVPTPDTLEFYSYRDLGTVSIVGKTGLDVNDANTGSLGENVGVRATPLYDNGVFYLEQSSGTGTQLTVRAEDGGVAGNVDSKMYLGRYFQMGSEIIRVASKNFDGANNNIVTVIRGALGTVVSNLPINTKVKAIRPSALELRRPSILRASGHTFEYLGYGPGNYSTSLPQLQVKQLPDDEIYLVQAQELSCGQVVYTGMSDNGDFYIGNTKYSATSGTQSTFDVPIPTVAGQPGSSNNVVFDEVIINRRLFVSGGETNEVQSQFDGPVKFTQSVTIQNNLFVTGTTQLNRIEITSTENATSSANGGALTIRGGAAIGKDFYVGGEMYTNAYQIEDTSAVLEIGTNQSSKDISVGGSTDTDRVVFNTTKLATGEGAEEVVNADAGVVVEGGLVVRDVIIAKEFRGAGTGGGPGTILLWGGSTSALPDRYLLCNGDTLNKNTYNKLFEAIGYIHGGSGNSFKLPDLRNRFIPGAGSSYAVAAKGGDDSVVLTETQMPRHTHSTSAVNAPHTHPVSFTSGAANAPHKHPAGTGGGGNHNHPSGGTGGGGNHNHPSGGTNNTGNHGHPYSAPGQSKTDVANSNEKNVTSNVNASGAGTGGGGAHSHSVSVNSTSSAHNHPVSVNSGSSAHNHPVSVNSANAPHSHPISGNAGSANAPHVHPIGNTGGTASFDNRPKYYALCYIIQSE

Physico‐chemical properties

protein length:	1955 AA
molecular weight:	209840,98500 Da
isoelectric point:	5,15765
aromaticity:	0,08900
hydropathy:	-0,32348

Domains [InterPro]

InterPro ID	Start	End	Source	Name
IPR037053	1682	1737	InterPro	Phage tail collar domain superfamily
SSF88874	1683	1823	SUPERFAMILY	None
IPR011083	1684	1741	InterPro	Phage tail collar domain

	Name	Taxonomy ID	Lineage
Phage	Synechococcus phage ACG-2014f [NCBI]	1493511	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	Synechococcus sp. WH 7803 [NCBI]	32051	Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Genbank protein accession

AIX23211.1 [NCBI]

Genbank nucleotide accession

KJ019066.1 [NCBI]

CDS location

range 19197 -> 25064
strand +

CDS

TTGCCCCTTAATAAGTTAGAGAATTTCATTAAGAATACGGATGGACGTACTCTGTATGTTAATCCAAACGATCTTAATGCTACTGATAGTATTACAAACCAAGGCACTTCCCTTACAGAACCCTTCAGAACTATTCAGAGGGCGTTAATTGAGAGTGCGCGTTTCTCATATGTGCGTGGTGATGATAATGATCTCATCGAGAGAACCACCATCATGGTGTATCCCGGTGAGCATCCTATCGATAACCGTCCTGGTTTCGGTATTAAGACAGTAGGTAATAGTCCGGTAGCGGTAACTCCTTCAGGTGAATTGATTGATCCGTTCCAAGCATTTAACCTGACTGATGCTAGTAACTTTGATATTGAGTCTAGTAATAACGTTCTCTATAGATTTAACAGTATCTACGGTGGTGTTGTTGTTCCCCGTGGTACTTCTATCGTGGGTATGGACCTACGTAAGACAAAGATTCGTCCGATATATGTTCCCAACCCCACTGATGATTCAGTAGATTACTCAGCGATCTTCCGTATCACAGGTACTTGCTACTTCTGGCAGTTCACCATCTTCGATGGTAATGAGAATGGTGTAGTATTCACTGATCCAAGAGATTTCTCTGAGAATAACCAGTCCAGACCCACTTTCTCACACCACAAACTAACAGCATTTGAATACGCTGATGGTGTTAACCCAGCGGTAGAATCAGGGTTTGAACTTACTGACCTTGCTATGTATTATAGTAAGTTGTCTAACGCATATAATGAAGCATCTGGTCGTCCTATTGATGAGAAGTATCCATCAGATCCTGGTGGTTTTTCACCACAACGTCCTGAGTTTGAGATTGTTGGTGCATTCGCAACTGACCCAATCAATATCACTCGTTTAATCTCTGGTGATGGTTTTGTCCCTGATGCTGTCATCACAGTAGATACACAGGTCCCACATGAACTAAACACTGGAACACCAATTAAGATTCGTGGTGTTGCCATCAGTGACTATAATATCTCTACAAAAGTATCTGCAGTTCTCAGTCCTACTAGGTTTACGTATAACCTATCATTCGTAAGACCTAACCTACCAGCAGAACCTTCAGTATCCTCTGCAACTGTAACCGTTGAGACTGATACTGTAACAGGTGCTTCACCATACATCTTTAACTGTTCGATGAGATCAGTTTGGGGTATCAATGGAATGCACGCCGATGGTGCCAAAGCAACTGGATTCCGTTCCATGGTTGTTGCTCAGTTCACCGCGATCTCCCTTCAAAAAGATGATAGATCCTTCGTTACTTATAATAAACAGGCACGTAGATACGATGGTATCAATGTCAATAAGACTGTAAGGGGTGCTGAACTATCTGCACAGTCATCTTCTACTAACTCAGCAACTGTATACCACCTAGATCCTGACGCTATCTATCGTCCTGACTGGGGTACAACTCACATCAAGATGAGTAATGATGCAGTCATTCAGATTGTGTCTGTATTCGCTATTGGTTTCAATCAACACTTTGCTTCTATTGGTGGAGCTGATGCATCAATCACAAACTCTAACTCCAACTTTGGTCAGTTTGCACTGAAAGCTGATGGATTCAAGAATGATGCTTTCCTCAAAGATGATAAAGGTTTCCTAACATCATTTGTTTCTCCTAAGAGTGCGTATAACCCAGAAACTGATGATATTGAGATCATTGACTGGATCAACATTGACTTTGATCTAACTCGTAGTATTGCCTTTGCTAATCAACTCTATCTAACTGGTTATACTAACGCGGAAGATAAACCACCAGTAGTTAATCAGGGTTTCCGAATTGGTGCCAACTACAAAGAGAGTCTCATTCAGAGAACAACAGTTGGTGCTGGTGCAGATGTAACCTCATCAGTAAGAATGTGTGATAATATTCTCGGTCCTGGTAACAATCAAGCCAATGGTAGTAGTGTTGCTAGGAAAGTATATCAAGTTCTAGCAGGACCTATCAACAATACCCTCTCACTGGGTGTTCATGGACTACTTAATGGTGAGAGTGTAAGAGTATTCTCATCAACAGGTGACCTACCTGAGAACCTAGAAAGAGGTGCCCTATACTACGCAAATGTGGTTGATGGTGAGAATATTCGTATTGCTACTTCCGAGTCTAATGCACTCAACAACATCTTCCTCAACATCTATGGTGGTGTTGAACTTCGTGTTGAGTCTAGAGTTAATGATAAGGAAGCAGGTGAAAGAGGTCATCCCGTTCAGTATGACTACACCAATCAGAACTGGTTTGTTCATACTGATGCCAATAGTGATATCTATCAGTATATTGTAGCCAACCCAACCTCTACGGATGGTATTGACTTTGTATCCATATTCAAGAGATTTGGTGATAACAGGGCACTAGAAGACAAACTATATCGCCTCAGGTATGTTATTCCTAAGGAGTCAAGGAACGCAAAACCACCTACCCCTGGTTATGTTCTACAAGCATCAGCAACAACAGGTGCTAGGAATAACGATGACTTTATCCTACAGGATATTGGTATCAATGACTATGAATATAACAGAAACCCACGTTATATTGTAAGTTGTACTGTTATTGCTAATGAAGTTGAGGTTCGTAGTGAGATTCCACACAACTTGAATGTTGGTGATAAGATTAAAATAGTGAATGTTGCCAGTACAAATAACACTGGCGCATCACAAATCAAAGGTTTCAATGGTGAGTTCCTAGTTACTAGAGTTATCAACTCTCGTGAGTTTAGGTATGATATTACTGATGTAAATGGTTTTAGTAGAAATCCTGGTACCTTCACCAACAACATCAATGAAAGAAACATTCTTCTACCTCGTTATGAGAGAAAGGATCTACAGAGTAATGTATTCGTATATCGTATTGAAACTATCACTGATTTCCTAGAAGGTGAGAGGGATGGTATCTACCACTTATTCCTTCTTAATGGTTCTAACCCAGTAACAGAGACATTCACTGATATCCAATACAATCAACCTGTGGAAGATTTATATCCACAGATGGATCCTGATAACCTTATTCAGAACCCCCCTGCAACCACAACGTTTGCTAAGAGGGCACCCCTAGGTGATGTTACTATTGATGAACAACAGAACTCCATTACTAAAGAGTCTGTTGATAAAATATACAAGACACTTAATGTTGGTATCATTGAGACTGCTACTGATGGCACTGTTGGTGCTGGTGGAACACGTACAACCACACTAACATTCCAAAGAGAGCACGAGTTCAACTCTGTGTATAGTTACACCACACTAGTTGGTGGTGGTGGATATACTGATGGTACTTTCTATGATGTTAAACTACTCAGTGAGTTTGGCACAGTATGGGGAGGTGCTTCTGCTGTTGTTACTGTTACTGCTGGTACAGTTACCGCAGTTACTATCATGGATCCTGGTTCAGGTTATTCTGCAGGTCAGACACTATTCATCGATGGAACTACAATTGGTGGTGGTACTAACGCTACTATTAGTATTACTCAGGCAGACTTAGAGGATAACAAGCATAGTATCCTACAGATTTCTGGTGGTGCTTTGTATAACCCAGATTCATATGTAGTGATGACCAGTGTTGAGGATCAGTCTTCAGTTGGTGTTGCTAGAACTTCTGGAAGTCCTGCTATTATTCCTGGTATGTACGCATATCCAGCAGATAGTGGAACAGGTATTTCTTCAACTACATATAACTCCGATACAGGTTTAACAACACTAGTATCTACAGGTAGTGCTGGTTTTGGTCTTCAGAGAGGTAACACTTTCGTTGTATTCAGTGATAACTATAGTTATCTTGGTAAGTTCTTTGTATCTAACGTTCCAACTCCTGACACTTTGGAGTTCTACTCATACAGAGATCTTGGAACTGTATCTATTGTAGGTAAGACAGGTTTAGATGTAAATGATGCTAACACTGGTTCCTTAGGTGAGAACGTGGGTGTTAGAGCTACACCACTATATGATAACGGTGTATTCTATCTTGAACAGTCTTCAGGTACTGGAACACAACTAACAGTTAGGGCTGAAGATGGTGGTGTGGCTGGTAATGTAGACTCTAAGATGTACCTAGGAAGATACTTCCAAATGGGTTCTGAGATTATCAGAGTTGCTAGTAAGAACTTTGATGGAGCCAATAACAATATCGTAACTGTTATCCGTGGTGCTCTTGGTACCGTTGTTAGCAACCTTCCCATTAATACTAAGGTGAAGGCAATCAGACCTTCCGCACTAGAACTTAGAAGACCTTCTATTCTACGTGCCTCAGGTCACACCTTTGAATATCTTGGTTATGGTCCTGGTAACTATTCCACTTCATTACCACAACTACAGGTTAAGCAACTCCCAGATGATGAAATTTACCTAGTACAGGCTCAGGAACTATCCTGTGGTCAGGTTGTTTATACTGGTATGAGTGATAATGGTGACTTCTATATCGGTAATACCAAGTATTCCGCAACCTCAGGAACACAATCAACCTTTGATGTTCCCATCCCAACTGTTGCTGGTCAACCAGGTAGTTCTAATAATGTTGTGTTTGATGAAGTTATCATCAACCGTCGTCTATTCGTATCTGGTGGTGAAACTAATGAGGTTCAGTCACAGTTTGATGGTCCTGTTAAGTTTACCCAGTCTGTTACTATTCAGAACAATCTTTTCGTAACTGGTACAACTCAACTCAATAGAATTGAGATCACCAGTACAGAGAACGCAACCAGTTCTGCTAATGGTGGAGCACTAACTATCAGAGGTGGTGCTGCTATTGGTAAAGACTTCTATGTTGGTGGTGAAATGTACACCAACGCATATCAAATAGAAGATACAAGTGCAGTTCTTGAAATTGGTACTAACCAGTCATCTAAGGATATCTCTGTTGGTGGTTCAACTGATACAGATAGAGTTGTTTTTAATACAACTAAACTAGCAACAGGTGAAGGTGCTGAAGAGGTAGTTAACGCAGACGCTGGTGTTGTTGTTGAGGGTGGATTAGTTGTTCGTGATGTTATTATCGCGAAAGAGTTTAGAGGTGCTGGAACTGGTGGTGGTCCTGGTACTATCCTACTCTGGGGTGGTTCTACTAGTGCTCTCCCTGACAGATATCTACTCTGCAACGGAGATACTCTCAATAAAAACACATATAACAAACTATTCGAAGCCATTGGTTATATCCATGGTGGTAGTGGTAATAGTTTTAAGTTACCAGATTTGAGAAATAGGTTTATCCCTGGTGCTGGTAGTTCTTATGCGGTAGCTGCAAAAGGTGGGGATGATTCAGTTGTACTAACTGAAACGCAGATGCCACGCCACACGCACTCAACTTCAGCAGTCAACGCACCACATACTCACCCAGTATCGTTTACTAGTGGAGCGGCAAATGCACCACATAAACACCCAGCTGGCACAGGTGGCGGTGGAAATCATAACCACCCATCAGGTGGCACAGGTGGTGGTGGTAATCACAATCACCCATCAGGTGGCACTAACAATACAGGCAACCATGGACACCCGTATAGTGCTCCGGGGCAATCCAAAACTGATGTTGCTAATTCTAACGAGAAGAATGTAACTAGCAACGTCAATGCCTCAGGTGCAGGAACCGGTGGTGGTGGAGCACACTCCCACTCTGTTTCAGTTAACAGTACATCCTCAGCTCATAATCACCCAGTAAGTGTCAACTCTGGATCTTCAGCTCATAATCACCCTGTTAGTGTTAATTCAGCTAATGCACCACATTCCCACCCAATTAGTGGTAATGCAGGTTCTGCAAACGCACCTCACGTTCACCCAATTGGTAATACTGGTGGTACTGCTTCCTTTGACAATAGACCCAAATACTACGCTCTCTGCTATATTATCCAATCAGAGTGA

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence