Genbank accession
XAI95613.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,87
TF
Evidence RBPdetect2
Probability 0,81
Protein sequence
MPQVGVIAALVGNGVGFGTAVGAAFGLGPIGTAVLKVAGSLLLSTAANALLASRQKAPRAQDIRAQLFQPTATPAYRFVYGETRAAGTPYAWPVKGPHIYGCWIINSRPSAGPFTLYLDGREVELTGDPYDFAGGGALATNEPFVNCIRVWIQRGEKTTPPLLFTTGLGIDGLSGGAPFSAERPDFWKTTDGWQGRTVVWMLLFNGDNGRRQERWPSSPPQVQVEGRFSRVWDPRDPAQDPDDPDTWGWSDNQALCLLDFVRQNPVESWPLDLLDLPSFVAAANAADQPVPLSGGGTEPRYRVGGWLVFEAAEFEDLAAPLIAAGASDLIRVGGRLGIAPGIWQAPAYSVGEFFGDTIGFTSGRPGPETPRALRVTYASADRGYETAELAEWALPGGGGTKVDTLALDMVTSPTQAARVRNITGNLMALQRGLEGVLPPEALVLSSGDVVTVDLPAPLEPANGSYRVRAMSPALLPISDDPDRLSMRIPVRLEETAESVYAWNPATDEPVVVELSYDGVRQGVAPPGALSVARDDLDTGGTIVPRLRFAFDPSPTTAVDVYEWQFRADGGVWESGGNIAADVRDGSGLVFGHAIIAEGVLYDIRVRAFALSGRSEWRTITGVGSPFVLTGSITAGDDADVTWAGTTPAVNYAGARIYQTDTASFVDPVLLRATTPGNSVTAVDVVLGPGYFWAVPVTLTGAEGAPLGPFYLTVREIVYVADFEGAVYELDGAAAAIGDVLAVTRASVATFVDGAGLIQTAAVNVPRIDHAAGVPCLLIEPAGANAFTWSEAMDNAAWTKTNATVTANAIAAPDGATTADLLVENTATSSHRTQRTRAMESGVAATISLFAKAGGRDILRLRASGTGMTAQAAEVQISTGTVSVQAGTPTVETVALAGGWRRITFTFTPNVTVSGLFEVYLCSAFGVSSYTGDGVSGAYLWGAQDGAGSYIATAGAAGSRAADVPAMQGVSGVMDLLATYDNGTTAAFDAAPVLPGYWPTLTRQRLRSLIGTI
Physico‐chemical
properties
protein length:1012 AA
molecular weight: 105956,83730 Da
isoelectric point:4,61143
aromaticity:0,08794
hydropathy:0,07154

Domains

View on InterPro
XAI95613.1
1 1012 aa
ATT 366–467 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Taxonomy

Phage
Nostoc phage Nsp-JY21 [NCBI] · taxon 3128152
Host No host information

Coding sequence (CDS)

Genbank protein accession
XAI95613.1 [NCBI]
Genbank nucleotide accession
PP438413.1 [NCBI]
CDS location
range 30036 -> 33074
strand +
CDS
GTGCCACAAGTCGGCGTAATTGCAGCCCTCGTCGGCAACGGCGTGGGCTTTGGCACGGCAGTGGGCGCGGCCTTTGGCCTTGGGCCGATCGGCACGGCGGTGCTGAAGGTGGCCGGGTCGCTGCTTTTGTCCACCGCCGCCAACGCGCTGTTGGCCTCGCGGCAAAAGGCCCCGCGCGCGCAGGATATCCGGGCGCAGCTGTTCCAGCCGACCGCCACGCCCGCCTATCGCTTTGTCTATGGCGAGACGCGGGCCGCTGGCACGCCCTATGCCTGGCCGGTCAAGGGGCCTCACATTTATGGCTGCTGGATCATCAACAGCCGCCCCTCGGCGGGTCCGTTCACGCTCTATCTCGACGGGCGCGAGGTGGAGCTGACGGGCGACCCCTATGACTTCGCCGGGGGCGGGGCGCTCGCCACGAATGAGCCCTTTGTCAACTGCATCCGTGTCTGGATTCAGCGCGGCGAGAAAACGACGCCGCCGCTGCTGTTCACCACAGGCCTCGGGATCGACGGGCTTTCGGGCGGCGCGCCCTTCTCGGCCGAGCGGCCAGACTTCTGGAAGACCACCGACGGCTGGCAGGGGCGCACGGTGGTGTGGATGCTGCTGTTCAACGGCGACAATGGCCGGCGGCAAGAACGCTGGCCCTCATCGCCGCCGCAAGTGCAGGTGGAGGGTCGGTTTTCCCGCGTCTGGGACCCGCGCGATCCCGCGCAAGACCCCGATGACCCGGACACTTGGGGCTGGTCTGACAACCAGGCACTGTGCCTGCTGGATTTTGTGCGGCAGAACCCGGTGGAAAGCTGGCCGCTCGATCTTCTCGATCTGCCGTCCTTCGTCGCGGCTGCCAATGCCGCCGATCAGCCCGTGCCTCTGAGCGGTGGCGGGACAGAACCGCGCTATCGTGTCGGCGGCTGGCTGGTCTTCGAAGCGGCCGAGTTCGAGGATCTGGCCGCGCCGCTGATCGCGGCCGGCGCAAGTGACTTGATCCGTGTCGGCGGGCGTCTGGGCATCGCACCGGGCATCTGGCAGGCCCCGGCCTATTCGGTCGGCGAGTTTTTCGGCGACACGATCGGCTTCACTTCGGGCCGCCCGGGGCCGGAAACCCCGCGCGCGCTGCGCGTGACCTATGCCTCGGCAGATCGCGGCTACGAAACCGCCGAGCTGGCCGAATGGGCGCTGCCTGGGGGCGGTGGAACCAAGGTCGACACGCTGGCGCTTGACATGGTGACTAGCCCGACGCAGGCCGCCCGGGTGCGCAACATCACGGGCAATCTGATGGCCCTGCAGCGCGGTCTCGAGGGCGTCTTGCCGCCCGAGGCGCTGGTGCTGTCCTCGGGCGACGTGGTCACGGTTGATCTGCCCGCGCCGCTGGAACCCGCCAATGGCAGCTATCGGGTGCGAGCCATGTCGCCCGCGCTGCTGCCGATCAGCGATGATCCCGACCGGCTGTCGATGCGCATTCCGGTTCGCCTCGAAGAGACGGCGGAAAGCGTCTACGCTTGGAACCCCGCCACCGATGAGCCGGTGGTGGTGGAACTTTCCTACGATGGCGTCCGGCAGGGCGTGGCGCCACCCGGTGCGCTGTCGGTAGCGCGGGATGATCTGGACACTGGCGGCACCATCGTGCCGCGCCTGCGCTTTGCCTTCGACCCATCGCCCACCACGGCGGTCGATGTCTACGAGTGGCAGTTCCGCGCCGATGGCGGGGTCTGGGAATCGGGCGGCAACATCGCGGCGGACGTGCGCGACGGCAGCGGTCTGGTCTTCGGGCATGCGATCATTGCCGAGGGCGTGCTCTACGACATCCGCGTGAGGGCGTTCGCGCTGTCGGGCCGGTCGGAGTGGCGCACGATCACCGGCGTGGGCTCGCCTTTTGTCCTGACGGGCAGCATCACCGCGGGCGATGACGCTGATGTCACTTGGGCAGGCACGACGCCTGCCGTGAACTACGCCGGCGCCCGGATTTATCAGACAGACACGGCCAGCTTTGTCGATCCGGTTCTGCTGCGCGCCACGACGCCGGGCAACAGTGTGACTGCTGTCGATGTTGTCCTTGGTCCAGGATACTTTTGGGCGGTGCCGGTGACGCTGACAGGGGCTGAGGGGGCGCCGCTCGGGCCGTTTTATCTGACGGTGCGCGAGATTGTCTATGTGGCTGACTTCGAAGGGGCTGTGTACGAACTCGACGGGGCTGCGGCTGCGATCGGCGATGTGCTCGCGGTCACGCGCGCCAGTGTGGCGACCTTTGTCGACGGCGCAGGGCTGATCCAGACGGCTGCGGTGAATGTGCCGCGCATCGATCACGCGGCGGGGGTGCCTTGCCTGCTGATCGAGCCTGCGGGGGCGAACGCCTTCACCTGGTCCGAGGCGATGGACAACGCGGCATGGACCAAGACGAATGCGACGGTCACGGCCAATGCCATCGCGGCCCCGGACGGTGCCACCACCGCAGATCTGCTGGTCGAGAATACGGCGACAAGCTCGCATCGCACCCAGCGCACGCGCGCGATGGAATCGGGCGTGGCGGCGACGATCAGCCTGTTCGCCAAGGCGGGCGGGCGCGACATTCTGCGCTTGCGGGCCTCTGGCACCGGGATGACGGCGCAGGCCGCCGAGGTTCAGATTTCCACCGGCACCGTGAGCGTGCAAGCCGGAACGCCGACTGTCGAGACTGTGGCTTTGGCCGGTGGCTGGCGGCGGATCACGTTCACGTTCACACCGAACGTCACGGTGTCGGGTCTGTTCGAGGTCTACCTCTGCTCGGCCTTCGGCGTGTCGAGCTACACCGGCGACGGTGTTTCGGGCGCGTATCTCTGGGGCGCGCAGGATGGCGCGGGCAGTTACATCGCCACGGCGGGCGCGGCCGGCAGCCGTGCTGCGGATGTCCCCGCGATGCAAGGCGTCAGTGGCGTCATGGACCTGCTGGCCACCTATGACAACGGCACAACGGCGGCCTTTGACGCAGCGCCCGTGCTGCCCGGCTACTGGCCGACACTGACCCGCCAGAGGCTGCGCAGCCTGATCGGCACAATCTGA

Genome Context

Tertiary structure

XAI95613.1
ESMFold structure
Source ESMFold
pLDDT 84.4
Oligomeric state monomer