UniProt accession
A0AAE9PZ57 [UniProt]
Protein name
Tail fiber protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
Seq2Symm
C1 confidence 0,377 truncated
C1 0,377
C2 0,030
H 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSEPLIGNKPNDNKIDVPSIKVKEPTSQAEFTAILEEASKAHAKPVQQKPTTEPVRTPVTTDSRSIDVPPVVPSSDVPSDVIDSIAGQREPGTYSPLVSPGEPLQQERPTLRLPVYPQQDFNTPSADVQPYQGQQVYSTADPLVFGNTVSDERFNHWVSEAQKQATQMRPTDMLSQAFRVPQLDPSVSGGFAPTSQNQPWWGSPEQTEGYYDKQTGRWVQLKRNDFNIFKGKFGEFGQGLIGGGMQLLNIPQAVVQGGIADAANIFGALGSGLDKSGGLFGAIMNPGKFAQAVGQTWQQNSPVSQGQAPLTDANPSGFFQQLRNNSYTVAGLSGRNTTGTNSRRDASGRVEPFGQLYEKPSTLALPGREGETTTLGLGITQGTNVRRERNTVDEVAIRAATALVPGISEAERQRRQQDYLSKDDQLGGVFRGLGVDIVTGGLGEKLLGGLVQGATRQTTRQAVREVVVTRKPLPEVPKLPPGRTASPTRRLPPAQGINNPAYQLPPANRGLRQAPEVLEVKPVEPRVIVTPPSGRDEFGRIIADDKPVVQQPDRLVKTQRTALPGTPERPTLPETTQPRPSVEPEPPIYVVSGDGSVQGTFRDGKPYRPIDLGEATFDKVNTTVRIKPEDVPTVEVEALTVPYTELPPSAFTVSDTRVFKRRVSRPDAVEVLTTDITGELRPKLEGTDPNAPRLNPSPDEELKIPFQAYDKQGVPLPELQRTPEQIINGMVDGVDSLFKEYEDVLKRAEDQRLLSPAREFTTADLTRKALPEGTSPKLLDELNAPGKPLPTLKAREPLPDLRKLDKASEDIIDQIAKGLVSLDDGLKKLNELDKAKETTDLLRQAGYVQTEPGVIQSQAAQVNQKVRKVVRATDKETPVVSPLLKAPEALKVVDAEVFSPQYSLADFAKLVTREQAGAVYNPNAMKRGERTVASLIEVGKRITLPDGTTLLPGDTKPSTVNTFAKLNRKIERALESAGVPMQDRTYYRQIFSRNGIPIPENLPDDLIIRVGKAKPDGTPETLAVSSKPKQDVTPTLPLSEDYGVAVMMTYRDGKLVPTDRQPMKVMPAVGERNWKPWVYQKDLPAELVSKSPEGLDLTVRRAEVETNIAQLSDEYQAAKVNLEAVSKELNNALTKLDKVPDAGGRTLLDDPVFTKQEQVVGNSTNWLVDGANDGSPMFHGTRVNDLDLAKADPVKGASRSELGTAIYLTKNVDEATAKAVADVNRHLPMLSGRSFGDGVVHETRIKPTAVIIKDTHLLDDDMKRIFLDAAESTYGFEHPKVVRALDKALNKEGVTIKQAYALLDKAVLKFTGDVVEKELLTTQRDIVSQLRMYGIDGVSSADTVAIYNPDVIKTVARTGIGEVEDTLEHAVARLNVDSLAASRNPESPFLKASHAESKVRTLSELQEIAERELKQAQERLVDEVNKLADIDNELEGLSLSERNKLRQEALDADKRTYESFKRELNKPNDTNCL
Physico‐chemical
properties
protein length:1473 AA
molecular weight: 161148,92850 Da
isoelectric point:5,51608
aromaticity:0,05092
hydropathy:-0,53686

Domains

View on InterPro
A0AAE9PZ57
1 1473 aa

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Phage
Leptolyngbya phage LPP-2, strain SPI [NCBI] · taxon 2996053

Coding sequence (CDS)

Genbank protein accession
UZV39990.1 [NCBI]
Genbank nucleotide accession
OP590147 [NCBI]
CDS location
range 20341 -> 24762
strand -
CDS
ATGAGTGAACCACTGATAGGGAACAAACCTAACGACAACAAGATAGATGTGCCTAGTATCAAAGTGAAAGAACCAACATCACAAGCAGAGTTCACAGCCATACTAGAGGAAGCGAGTAAAGCACATGCAAAACCAGTACAACAAAAGCCAACGACCGAGCCTGTACGCACACCTGTTACTACTGATAGCAGAAGTATCGATGTTCCTCCTGTTGTTCCAAGTAGTGACGTACCCTCAGATGTCATCGACAGTATCGCAGGACAACGAGAACCAGGTACTTACAGTCCGTTAGTCTCTCCTGGTGAACCGCTACAACAGGAACGTCCAACGCTACGACTACCTGTATACCCTCAACAGGACTTTAACACACCGTCAGCAGACGTACAGCCATACCAAGGACAACAAGTGTACAGTACTGCTGATCCCTTGGTGTTTGGTAACACTGTAAGTGATGAACGCTTTAACCACTGGGTGTCTGAAGCACAGAAGCAAGCCACCCAGATGCGACCTACAGATATGTTGTCTCAGGCGTTCCGTGTACCACAACTAGATCCTTCTGTGTCTGGTGGCTTTGCTCCAACATCACAGAACCAACCGTGGTGGGGTAGTCCAGAGCAGACCGAAGGTTACTACGACAAACAGACAGGACGTTGGGTACAGCTTAAACGAAACGACTTTAACATCTTCAAAGGTAAGTTTGGTGAGTTCGGACAAGGACTTATCGGTGGTGGTATGCAACTACTGAACATCCCACAAGCGGTAGTACAAGGTGGTATAGCTGATGCGGCTAACATCTTTGGTGCGTTAGGCAGTGGTCTAGATAAGTCTGGTGGACTCTTTGGGGCTATCATGAACCCTGGTAAGTTTGCTCAAGCTGTGGGACAAACATGGCAACAGAACTCACCAGTATCACAAGGACAAGCACCACTTACCGACGCTAACCCTAGTGGGTTTTTCCAACAACTACGCAACAACAGCTATACCGTAGCTGGTTTGTCTGGTCGTAACACAACAGGGACAAACAGTAGACGTGATGCTAGTGGTCGTGTAGAACCCTTTGGTCAGTTGTACGAGAAACCAAGCACACTAGCCTTACCTGGTCGTGAGGGTGAGACAACAACACTAGGGCTAGGTATCACACAAGGTACGAACGTACGACGAGAACGTAACACTGTAGATGAAGTAGCCATCAGAGCAGCTACCGCACTTGTACCAGGTATCAGTGAAGCTGAACGACAACGTAGACAACAAGACTACTTATCAAAAGACGATCAACTTGGTGGTGTCTTCCGTGGACTAGGTGTTGACATCGTAACTGGTGGTTTAGGTGAGAAGTTGTTAGGTGGTCTTGTTCAAGGTGCGACAAGACAGACAACACGTCAAGCTGTACGTGAAGTTGTCGTTACTCGTAAACCGTTACCAGAAGTACCTAAGCTTCCCCCTGGTCGTACAGCGTCACCAACTAGACGACTACCACCAGCACAAGGTATCAACAACCCTGCATACCAACTGCCACCAGCTAACCGAGGACTGAGACAAGCACCAGAGGTACTGGAGGTTAAACCAGTAGAACCACGGGTTATCGTTACGCCACCATCAGGACGTGACGAGTTTGGTCGTATCATCGCCGACGACAAACCAGTAGTACAACAACCAGACAGACTGGTGAAGACACAACGTACAGCACTCCCTGGGACACCTGAACGCCCTACGTTACCAGAGACTACACAGCCACGTCCTTCAGTAGAACCAGAACCACCTATCTATGTTGTGTCGGGTGATGGAAGTGTACAAGGTACGTTCCGTGATGGTAAGCCATACAGACCTATCGATCTAGGTGAAGCTACCTTTGATAAGGTAAACACTACTGTACGCATCAAACCAGAAGATGTACCTACTGTAGAGGTTGAGGCACTTACTGTACCTTATACCGAGCTTCCACCATCAGCGTTTACTGTGTCTGATACACGTGTGTTCAAGCGTCGTGTGTCTCGCCCTGACGCAGTAGAGGTACTGACTACAGACATCACAGGAGAGTTAAGACCCAAGCTGGAAGGCACTGACCCTAACGCACCAAGACTTAACCCAAGTCCTGATGAAGAGTTAAAGATACCCTTCCAAGCTTACGACAAACAAGGTGTTCCTCTTCCTGAACTACAACGCACACCTGAACAGATCATCAACGGTATGGTTGATGGTGTCGATAGCTTGTTCAAAGAGTACGAAGATGTACTTAAACGTGCTGAAGATCAACGCTTGTTGTCTCCTGCTCGTGAGTTCACGACTGCTGACTTAACACGCAAAGCTCTACCAGAAGGTACATCACCTAAGCTACTTGACGAACTCAACGCACCAGGTAAACCACTGCCTACACTTAAGGCACGTGAACCTCTGCCTGATCTACGTAAACTAGACAAAGCAAGTGAAGACATCATCGACCAGATAGCTAAAGGTCTAGTCAGTCTTGATGATGGTCTTAAGAAGCTGAACGAACTCGACAAGGCAAAAGAGACTACAGACTTGTTACGCCAAGCTGGTTATGTTCAAACAGAACCAGGTGTTATCCAAAGTCAAGCAGCACAGGTAAACCAAAAAGTACGTAAGGTGGTACGTGCGACAGACAAAGAGACACCTGTTGTGTCTCCCTTACTGAAAGCACCCGAAGCGCTGAAGGTCGTAGATGCTGAAGTGTTTAGCCCACAGTACTCACTCGCAGACTTTGCTAAGTTAGTCACTCGTGAACAAGCTGGTGCTGTCTACAACCCGAACGCTATGAAACGAGGAGAACGCACCGTAGCGTCTCTTATCGAGGTCGGTAAGCGTATCACACTACCAGACGGTACAACGCTGCTTCCTGGCGATACTAAGCCCAGTACAGTGAACACGTTCGCTAAGCTTAACCGCAAGATAGAACGAGCGCTTGAGTCTGCTGGTGTGCCTATGCAGGATAGAACATACTATCGTCAGATCTTTAGTCGTAACGGTATCCCGATCCCTGAGAACCTACCCGATGATCTTATCATCCGTGTGGGTAAAGCTAAACCTGACGGAACACCTGAGACACTAGCTGTCTCATCTAAGCCTAAGCAGGACGTAACACCTACGTTACCGTTGTCTGAGGACTACGGCGTGGCTGTGATGATGACATACAGAGACGGTAAGTTAGTCCCAACGGACAGACAACCTATGAAGGTCATGCCTGCTGTTGGAGAGCGTAACTGGAAACCTTGGGTGTATCAGAAAGACCTACCTGCTGAGCTTGTGTCTAAGTCTCCTGAAGGGTTAGACCTCACGGTTAGACGTGCTGAGGTTGAGACAAACATCGCTCAGTTATCTGATGAGTACCAAGCAGCTAAGGTTAACCTTGAAGCTGTAAGTAAGGAACTTAACAACGCACTTACCAAGCTTGACAAAGTACCTGATGCTGGTGGTCGTACCTTGTTAGATGACCCAGTGTTCACTAAACAAGAACAGGTTGTAGGTAACTCTACGAACTGGCTGGTTGATGGTGCTAACGATGGCTCACCTATGTTCCACGGTACACGAGTCAACGATCTAGACCTAGCGAAAGCTGACCCCGTTAAGGGTGCGTCTAGATCAGAACTAGGCACTGCTATCTACCTCACTAAGAACGTAGATGAGGCTACTGCTAAGGCTGTAGCTGACGTTAACAGACATCTACCTATGCTGTCTGGTCGGTCGTTCGGTGATGGTGTTGTACATGAGACACGTATCAAACCTACGGCTGTCATCATCAAAGACACACATCTACTAGATGACGACATGAAGCGTATCTTCCTTGACGCTGCTGAGTCTACCTATGGGTTCGAGCATCCGAAGGTTGTTCGTGCTTTAGATAAGGCACTGAACAAGGAAGGTGTCACCATCAAACAAGCATACGCGTTACTAGATAAAGCTGTACTCAAGTTCACTGGTGATGTCGTAGAGAAAGAACTGTTAACGACACAACGTGACATCGTAAGTCAACTACGTATGTACGGTATAGATGGTGTGTCCTCTGCTGACACAGTAGCTATCTATAACCCAGACGTTATCAAGACCGTTGCACGTACTGGTATCGGTGAGGTTGAAGACACACTAGAACATGCTGTAGCTCGTCTCAACGTAGACAGCCTAGCTGCTAGTCGTAACCCTGAGTCACCGTTCCTTAAGGCTTCACATGCTGAGTCTAAAGTACGTACGCTCAGTGAGCTACAAGAGATAGCAGAACGTGAGCTTAAGCAAGCACAAGAGCGTTTAGTAGATGAGGTTAACAAGCTTGCGGATATCGACAACGAACTAGAAGGTTTGTCGTTATCTGAACGCAACAAGCTACGACAGGAAGCACTAGACGCAGACAAACGTACATACGAAAGCTTCAAGCGTGAGCTAAACAAACCTAACGACACTAACTGTCTATAA

Genome Context

Tertiary structure

A0AAE9PZ57
ESMFold structure
Source ESMFold
pLDDT 35.2
Oligomeric state monomer