Phage RBP Database

Genbank accession

AIX21346.1 [GenBank]

Protein name

tail fiber protein

RBP type

TF

Evidence GenBank

Probability 1,00

TF

Evidence Phold

Probability 1,00

Protein sequence

MPLNKLENFIKNTDGRTLYVNPNDLNATDSITNQGTSLTEPFRTIQRALIESARFSYVRGDDNDLIERTTIMVYPGEHPIDNRPGFGIKTVGNSPVAVTPSGELIDPFQAFNLTDASNFDIESSNNVLYRFNSIYGGVVVPRGTSIVGMDLRKTKIRPIYVPNPTDDSVDYSAIFRITGTCYFWQFTIFDGNENGVVFTDPRDFSENNQSRPTFSHHKLTAFEYADGVNPAVESGFELTDLAMYYSKLSNAYNEASGRPIDEKYPSDPGGFSPQRPEFEIVGAFATDPINITRLISGDGFVPDAVITVDTQVPHELNTGTPIKIRGVAISDYNISTKVSAVLSPTRFTYNLSFVRPNLPAEPSVSSATVTVETDTVTGASPYIFNCSMRSVWGINGMHADGAKATGFRSMVVAQFTAISLQKDDRSFVTYNKQARRYDGINVNKTVRGAELSAQSSSTNSATVYHLDPDAIYRPDWGTTHIKMSNDAVIQIVSVFAIGFNQHFASIGGADASITNSNSNFGQFALKADGFKNDAFLKDDKGFLTSFVSPKSAYNPETDDVEIIDWINIDFDLTRSIAFANQLYLTGYTNAEDKPPVVNQGFRIGANYKESLIQRTTVGAGADVTSSVRMCDNILGPGNNQATGSSVARKVYQVLAGPINNTLSLGVHGLLNGESVRVFSSTGDLPENLERGALYYANVVDGENIRIATSESNALNNIFLNIYGGVGLRVESRVNDKEAGERGHPVQYDYTNQNWFVHTDANSDIYQYIVANPTSTDGIDFVSIFKRLGDNRALEDKLYRLRYVIPKESRNAKPPTPGYVLQASATTGARNNDDFILQDIGINDYEYNRNPRYIVSCTVIANEVEVRSEIPHNLNVGDKIKIVNVASTNNTGASQIKGFNGEFLVTRVINSREFRYDITDVNGFSRNPGTFTNNINERNILLPRYERKDLQSNVFVYRIETITDFLEGERDGIYHLFLLNGSNPVTETFTDIQYNQPVEDLYPQMDPDNLIQNPPATTTFAKRAPLGDVTIDEQQNSITKESVDKIYKTLNVGIIETATDGTVGAGGTRTTTLTFQREHEFNSVYSYTTLVGGGGYTDGTFYDVKLLSEFGTVWGGASAVVTVTAGTVTAVTIMDPGSGYSAGQTLFIDGTTIGGGTNATISITQADLEDNKHSILQISGGALYNPDSYVVMTSVEDQSSVGVARTSGSPAIIPGMYAYPADSGTGISSTTYNSDTGLTTLVSTGSAGFGLQRGNTFVVFSSNYSYLGKFFVSNVPTPDTLEFYSYRDLGTVSIVGKTGLDVNDANTGSLGENVGVRATPLYDNGVFYLEQSSGTGTQLTVRAEDGGVAGNVDSKMYLGRYFQMGSEIIRVASKNFDGANNNIVTVIRGALGTVVSNLPINTKVKAIRPSALELRRPSILRASGHTFEYLGYGPGNYSTSLPQLQVKQLPDDEIYLVQAQELSCGQVVYTGMSDNGDFYIGNTKYSATSGTQSTFDVPIPTVAGQPGSSNNVVFDEVIINRRLFVSGGETNEVQSQFDGPVKFTQSVTIQNNLFVTGTTQLNRIEITSTENATSSANGGALTIRGGAAIGKDFYVGGEMYTNAYQIEDTSAVLEIGTNQSSKDISVGGSTDTDRVVFNTTKLATGEGAEEVVNADAGVVVEGGLVVRDVIIAKEFRGAGTGGGPGTILLWGGSTSALPDRYLLCNGATLNKNTYNKLFEAIGYIHGGSGNSFKLPDLRNRFIPGAGSSYAVAAKGGDDSVVLTETQMPRHTHSTSAVNAPHTHPVSFTSGAANAPHKHPAGTGGGGNHNHPSGGTGGGGNHNHPSGGSNNTGNHGHPYSAPGQSKTDVANSNEKNVTSNVNASGAGTGGGGAHSHSVSVNSTSSAHNHPVSVNSGSSAHNHPVSVNSANAPHSHPISGNAGSANAPHVHPIGNTGGTASFDNRPKYYALCYIIQSE

Physico‐chemical properties

protein length:	1955 AA
molecular weight:	209621,83460 Da
isoelectric point:	5,20892
aromaticity:	0,08849
hydropathy:	-0,31606

Domains [InterPro]

InterPro ID	Start	End	Source	Name
IPR037053	1682	1737	InterPro	Phage tail collar domain superfamily
SSF88874	1683	1823	SUPERFAMILY	None
IPR011083	1684	1741	InterPro	Phage tail collar domain

	Name	Taxonomy ID	Lineage
Phage	Synechococcus phage ACG-2014f_Syn7803C8 [NCBI]	2790336	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	No host information

Coding sequence (CDS)

Genbank protein accession

AIX21346.1 [NCBI]

Genbank nucleotide accession

KJ019058.1 [NCBI]

CDS location

range 19541 -> 25408
strand +

CDS

TTGCCCCTTAATAAGTTAGAGAATTTCATTAAGAATACGGATGGACGTACTCTGTATGTTAATCCAAACGATCTTAATGCTACTGATAGTATTACAAACCAAGGCACTTCCCTTACAGAACCCTTCAGAACTATTCAGAGGGCGTTAATTGAGAGTGCGCGTTTCTCATATGTGCGTGGTGATGATAATGATCTCATCGAGAGAACCACCATCATGGTGTATCCCGGTGAGCATCCTATCGATAACCGTCCTGGTTTCGGTATTAAGACAGTAGGTAATAGTCCGGTAGCGGTAACTCCTTCAGGTGAATTGATTGATCCGTTCCAAGCATTTAACCTGACTGATGCTAGTAACTTTGATATTGAGTCTAGTAATAACGTTCTCTATAGATTTAACAGTATCTACGGTGGTGTTGTTGTTCCCCGTGGTACTTCTATCGTGGGTATGGACCTACGTAAGACAAAGATTCGTCCGATATATGTTCCCAACCCCACTGATGATTCAGTAGATTACTCAGCGATCTTCCGTATCACAGGTACTTGCTACTTCTGGCAGTTCACCATCTTCGATGGTAATGAGAATGGTGTAGTATTCACTGATCCAAGAGATTTCTCTGAGAATAACCAGTCCAGACCCACTTTCTCACACCACAAACTAACAGCATTTGAATACGCTGATGGTGTTAACCCAGCGGTAGAATCAGGGTTTGAACTTACTGACCTTGCTATGTATTATAGTAAGTTGTCTAACGCATATAATGAAGCATCTGGTCGTCCTATTGATGAGAAGTATCCATCAGATCCTGGTGGTTTTTCACCACAACGTCCTGAGTTTGAGATTGTTGGTGCATTCGCAACTGACCCAATCAATATCACTCGTTTAATCTCTGGTGATGGTTTTGTCCCTGATGCTGTCATCACAGTAGATACACAGGTCCCACATGAACTAAACACTGGAACACCAATTAAGATTCGTGGTGTTGCCATCAGTGACTATAATATCTCTACAAAAGTATCTGCAGTTCTTAGTCCTACTAGGTTTACGTATAACCTATCATTCGTAAGACCTAACCTACCAGCAGAACCTTCAGTATCCTCTGCAACTGTAACCGTTGAGACTGATACTGTAACAGGTGCTTCACCATACATCTTTAACTGTTCGATGAGATCAGTTTGGGGTATCAATGGAATGCACGCCGATGGTGCCAAAGCAACTGGATTCCGTTCCATGGTTGTTGCTCAGTTCACCGCGATCTCCCTTCAAAAAGATGATAGATCCTTCGTTACTTATAACAAACAGGCACGTAGATACGATGGTATCAATGTCAATAAGACTGTAAGGGGTGCTGAACTATCTGCACAGTCATCTTCTACCAACTCGGCAACTGTATACCACCTAGATCCTGACGCTATCTATCGTCCTGACTGGGGTACAACTCACATCAAGATGAGTAATGATGCAGTCATTCAGATTGTGTCTGTATTCGCTATTGGTTTCAATCAACACTTTGCCTCTATCGGTGGAGCTGATGCATCAATCACGAACTCTAACTCCAACTTTGGTCAGTTTGCACTGAAAGCTGATGGATTTAAGAATGATGCTTTCCTCAAAGATGATAAAGGTTTCCTAACATCATTTGTTTCTCCTAAGAGTGCATATAACCCAGAAACTGATGATGTTGAGATCATTGACTGGATTAACATTGACTTTGATCTAACTCGTAGTATTGCCTTTGCTAATCAACTCTATCTAACTGGTTATACTAACGCGGAAGATAAACCACCAGTAGTTAATCAGGGTTTCCGAATTGGTGCCAACTACAAAGAGAGTCTCATTCAGAGAACAACAGTTGGTGCTGGTGCAGATGTAACCTCATCAGTAAGAATGTGTGATAATATTCTCGGTCCTGGTAACAATCAAGCAACTGGTAGTAGTGTCGCTAGAAAGGTATATCAAGTTCTAGCTGGACCTATCAACAATACCCTTTCATTGGGTGTTCATGGACTACTTAATGGTGAGAGTGTAAGAGTATTCTCATCAACAGGTGACCTACCTGAGAACCTAGAAAGAGGTGCCCTATACTACGCAAATGTGGTTGATGGTGAGAATATTCGTATTGCTACTTCCGAGTCTAATGCACTCAACAACATCTTCCTCAACATCTATGGTGGTGTTGGACTTCGTGTTGAGTCTAGAGTTAATGATAAGGAAGCAGGTGAAAGAGGACATCCTGTTCAGTATGACTACACTAACCAGAACTGGTTTGTTCATACTGATGCCAATAGTGATATCTATCAGTATATTGTAGCCAACCCAACCTCCACAGATGGTATTGACTTTGTATCCATATTCAAGAGACTTGGTGATAACAGAGCACTAGAAGACAAACTATATCGCCTCAGGTATGTTATTCCTAAGGAGTCAAGGAACGCAAAACCACCTACCCCTGGTTATGTTCTACAAGCATCAGCAACAACAGGTGCTAGGAATAACGATGACTTTATCCTACAGGATATTGGTATCAATGACTATGAATATAACAGAAACCCACGTTATATTGTAAGTTGTACTGTTATTGCTAATGAAGTTGAGGTTCGTAGTGAGATTCCACACAACTTGAATGTTGGTGATAAGATTAAAATAGTGAATGTTGCCAGTACAAATAACACTGGCGCATCACAAATCAAAGGTTTCAATGGTGAGTTCCTAGTTACTAGAGTTATCAACTCTCGTGAGTTTAGGTATGATATTACTGATGTAAATGGTTTTAGTAGAAATCCTGGTACCTTCACCAACAACATCAATGAAAGAAACATTCTTCTACCTCGTTATGAGAGAAAGGATCTACAGAGTAATGTATTCGTATATCGTATTGAAACTATCACTGATTTCCTAGAAGGTGAGAGGGATGGTATCTACCACTTATTCCTTCTTAATGGTTCTAACCCAGTAACAGAGACATTCACTGATATCCAATACAATCAACCTGTGGAAGATTTATATCCACAGATGGATCCTGATAACCTTATTCAGAACCCCCCTGCAACCACAACGTTTGCTAAGAGGGCACCCCTAGGTGATGTTACTATTGATGAACAACAGAACTCCATTACTAAAGAGTCTGTTGATAAAATATACAAGACACTTAATGTTGGTATCATTGAGACTGCTACTGATGGCACTGTTGGTGCTGGTGGAACACGTACAACCACACTAACATTCCAAAGAGAGCACGAGTTCAACTCTGTGTATAGTTACACCACACTAGTTGGTGGTGGTGGATATACTGATGGTACTTTCTATGATGTTAAACTACTCAGTGAGTTTGGCACAGTATGGGGAGGTGCTTCTGCTGTTGTTACTGTTACTGCTGGTACAGTTACCGCAGTTACTATCATGGATCCTGGTTCAGGTTATTCTGCAGGTCAGACACTATTCATCGATGGAACTACAATTGGTGGTGGTACTAACGCTACTATTAGTATTACTCAGGCAGACTTAGAGGATAACAAGCATAGTATCCTACAGATTTCTGGTGGTGCTTTGTATAACCCAGATTCATATGTAGTGATGACCAGTGTTGAGGATCAGTCTTCAGTTGGTGTTGCTAGAACTTCTGGAAGTCCTGCTATTATTCCTGGTATGTACGCATATCCAGCAGATAGTGGAACAGGTATTTCTTCAACTACATATAACTCCGATACAGGTTTAACAACACTAGTATCTACAGGTAGTGCTGGTTTTGGTCTTCAGAGGGGTAACACTTTCGTTGTATTCAGTAGTAACTATAGCTATCTCGGTAAGTTCTTTGTATCTAATGTTCCAACTCCAGATACATTGGAGTTCTACTCATACCGAGATCTAGGAACTGTATCTATTGTAGGTAAGACAGGTTTAGATGTAAATGATGCTAACACTGGTTCCTTAGGTGAGAACGTGGGTGTTAGAGCTACACCACTATATGATAACGGTGTATTCTATCTTGAACAGTCTTCAGGTACTGGAACACAACTAACAGTTAGGGCTGAAGATGGTGGTGTGGCTGGTAATGTAGACTCTAAGATGTACCTAGGAAGATACTTCCAAATGGGTTCTGAGATTATCAGAGTTGCTAGTAAGAACTTTGATGGAGCCAATAACAATATCGTAACTGTTATCCGTGGTGCTCTTGGTACCGTTGTTAGCAACCTTCCCATTAATACTAAGGTGAAGGCAATCAGACCTTCCGCACTAGAACTTAGAAGACCTTCTATTCTACGTGCCTCAGGTCACACCTTTGAATATCTTGGTTATGGTCCTGGTAACTATTCCACTTCATTACCACAACTACAGGTTAAGCAACTCCCAGATGATGAAATTTACCTAGTACAGGCTCAGGAACTATCCTGTGGTCAGGTTGTTTATACTGGTATGAGTGATAATGGTGACTTCTATATCGGTAATACCAAGTATTCCGCAACCTCAGGAACACAATCAACCTTTGATGTTCCCATCCCAACTGTTGCTGGTCAACCAGGTAGTTCTAATAATGTTGTGTTTGATGAAGTTATCATCAACCGTCGTCTATTCGTATCTGGTGGTGAAACTAATGAGGTTCAGTCACAGTTTGATGGTCCTGTTAAGTTTACCCAGTCTGTTACTATTCAGAACAATCTTTTCGTAACTGGTACAACTCAACTCAATAGAATTGAGATCACCAGTACAGAGAACGCAACCAGTTCTGCTAATGGTGGAGCACTAACTATCAGAGGTGGTGCTGCTATTGGTAAAGACTTCTATGTTGGTGGTGAAATGTACACCAACGCATATCAAATAGAAGATACAAGTGCAGTTCTTGAAATTGGTACTAACCAGTCATCTAAGGATATCTCTGTTGGTGGTTCAACTGATACAGATAGAGTTGTTTTTAATACAACTAAACTAGCAACAGGTGAAGGTGCTGAAGAGGTAGTTAACGCAGACGCTGGTGTTGTTGTTGAGGGTGGATTAGTTGTTCGTGATGTTATTATCGCGAAAGAGTTTAGAGGTGCTGGAACTGGTGGTGGTCCTGGTACTATCCTACTCTGGGGTGGTTCTACTAGTGCTCTCCCTGACAGATATCTACTCTGCAACGGAGCTACTCTCAATAAAAACACATATAACAAACTATTCGAAGCCATTGGTTATATCCATGGTGGTAGTGGTAATAGTTTTAAGTTACCAGATTTGAGAAATAGGTTTATCCCTGGTGCTGGTAGTTCTTATGCGGTAGCTGCAAAAGGTGGGGATGATTCAGTTGTACTAACTGAAACGCAGATGCCACGCCACACGCACTCAACTTCAGCAGTCAACGCACCACATACTCACCCAGTATCGTTTACTAGTGGAGCGGCAAATGCACCACATAAACACCCAGCTGGCACAGGTGGCGGTGGAAATCATAACCACCCATCAGGTGGCACAGGTGGTGGTGGTAATCACAATCACCCATCAGGTGGCTCTAACAATACAGGCAACCATGGACACCCGTATAGTGCTCCGGGGCAATCCAAAACTGATGTTGCTAATTCTAACGAGAAGAATGTAACTAGCAACGTCAATGCCTCAGGTGCAGGAACCGGTGGTGGTGGAGCACACTCCCACTCTGTTTCAGTTAACAGTACATCCTCAGCTCATAATCACCCAGTAAGTGTCAACTCTGGATCTTCAGCTCATAATCACCCTGTTAGTGTTAATTCAGCTAATGCACCACATTCCCACCCAATTAGTGGTAATGCAGGTTCTGCAAACGCACCTCACGTTCACCCAATTGGTAATACTGGTGGTACTGCTTCCTTTGACAATAGACCCAAATACTACGCTCTCTGCTATATTATCCAATCAGAGTGA

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence