Genbank accession
CAH9015108.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,88
TF
Evidence RBPdetect2
Probability 0,42
Seq2Symm
C3 confidence 0,899
C3 0,899
C1 0,584
I 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MPFGTAGGSGGGIVYPDSASRPFNSNSARNTWANNNKQDLIKDTTVVNVGGSQWYLWTGQSNPSSVDNSKWMDADQIVPGEQGDKGDPGIDVTTAIVDGDGDLIVTLSDGSDINAGRARGEDGDLVYQQLPAADYANFFDADWANLGTNIYGVTALGNQFANAPFPLNASTTYSFECLLVNEPNQYSLRVTSMSNADFDNSGRDAILAGATKTAAESIGWKVYAFTSDAGHADPSEGFDLQPDADIGLDSTSAITIKNNAGDIHNAIDQDLNLDAIRLGSPVMRTYLRTGTERIQVQTTNGMKDIAHLDDISSPTNPVTPSRFAYWIREPEYTLSEDEIQQEVMLMIQPESVVGNDRVCTVTFPSQVTFLNHYYIPGVSPAGDESTKPHIESFRFSIWLYYYSSSANPVKIIMNSTGNWLPFVSSESLSETDGVYLYKENAQSGKAELHTFAFMRPVNFNPAVGVNGWSFQNVHPYDWIPLNDAPPQSPPVSLLANFMINDDESSHLRTGTGIESTFDPLTGEHTLSVDPTNIDLSGYAELDADVSFSKVTVQNATDPLYNSVVNVTNGGNSEVNLVGTTNIRKVDKATGDTTDVVSINGTSGAVDIKTDATYQGAVSGGKSLVSKEYTDALSYYKGQGVGIPSATTISTNTVEQNTAVALFENSTTHSAETIISYDESLVGAETIIKVSPFANYQSKNFLFYHGATGNGEKTIRRGETWRIRLDATGVNSWFFERVDDGTRVTRGLGGRTVNVEHPYVGLFQYAENMPYHLLVETPTSSRLVHEFPRNKTFRFTPINSDRQHDGNVLLSQGNQGVATNDLALGQYSDIPLYIIEPNVVVNRDQRAWINFPASVEIDVSAGFYAFGTVSGWCGNNNTEGNVAVYVGTSENFRSYTQNVGFVLGNNGLVILDGNNIRTADNSTSFGFNIESGVTHMYRYAFYVDASGMMTYYIADLNTGQVSSGTQQCLLNSIGSNPKLYISYDRYSNNTAAFAIAETHLVVNSEGDAEDRWNWRN
Physico‐chemical
properties
protein length:1015 AA
molecular weight: 110494,98790 Da
isoelectric point:4,51042
aromaticity:0,10148
hydropathy:-0,34936

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

CAH9015108.1
1 1015 aa
Domain Start End Length (AA) Confidence
N-terminal 1 135 135 0,9801
Central domain 136 334 200 0,1078
C-terminal 335 1015 680 0,6281
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Phage
Vibrio phage 489E54-1 [NCBI] · taxon 2963206
Host No host information

Coding sequence (CDS)

Genbank protein accession
CAH9015108.1 [NCBI]
Genbank nucleotide accession
OX241561.1 [NCBI]
CDS location
range 7627 -> 10674
strand +
CDS
ATGCCTTTTGGAACAGCTGGCGGTTCTGGTGGCGGTATTGTGTACCCAGATTCAGCATCAAGACCATTTAACTCAAACTCAGCAAGAAATACTTGGGCTAACAACAACAAGCAAGACCTAATCAAAGACACCACTGTAGTTAACGTTGGTGGCTCTCAGTGGTACTTGTGGACTGGTCAATCAAACCCTAGCAGTGTTGATAACTCTAAGTGGATGGACGCTGACCAAATCGTACCTGGTGAGCAGGGCGACAAAGGTGACCCGGGCATTGACGTAACCACAGCTATTGTTGATGGTGACGGCGACTTAATAGTTACCCTGTCAGATGGTAGCGATATAAATGCTGGACGCGCTCGCGGTGAAGATGGTGACTTGGTTTACCAACAACTGCCAGCGGCTGATTATGCTAACTTCTTTGATGCTGATTGGGCTAACTTAGGTACTAACATTTATGGTGTTACTGCGCTTGGTAATCAATTTGCAAACGCTCCATTCCCTCTTAATGCATCAACAACATACAGCTTCGAATGCTTGCTAGTAAACGAGCCTAACCAATACTCGTTGCGCGTAACATCGATGAGTAACGCTGACTTTGATAACTCAGGTCGCGATGCAATCCTAGCTGGTGCAACAAAGACAGCAGCTGAATCTATTGGCTGGAAGGTTTACGCTTTCACATCAGATGCAGGTCACGCAGACCCATCAGAGGGTTTTGACTTACAGCCCGATGCAGACATTGGTTTAGATAGTACATCAGCTATCACAATCAAGAACAACGCTGGTGACATCCACAACGCGATTGACCAAGACCTAAACCTTGATGCTATCCGACTTGGCTCGCCTGTAATGCGCACTTACCTGCGTACAGGCACAGAGCGAATTCAGGTTCAGACCACTAACGGCATGAAGGACATCGCCCACCTAGATGACATATCAAGCCCTACAAATCCAGTTACACCTTCTAGGTTCGCATATTGGATTCGAGAGCCTGAATACACGCTAAGTGAAGATGAGATTCAGCAAGAAGTTATGCTGATGATTCAGCCTGAGTCTGTTGTTGGTAATGACCGCGTTTGTACGGTTACTTTCCCTAGCCAAGTTACATTTCTGAATCACTACTACATCCCTGGCGTTTCACCTGCTGGTGATGAGTCAACGAAGCCGCACATTGAGTCTTTTAGATTCTCAATCTGGCTTTACTACTACAGCAGCTCAGCTAATCCTGTAAAAATCATCATGAACTCAACTGGTAACTGGTTGCCGTTCGTATCTAGTGAATCTCTATCTGAGACTGATGGTGTTTATCTTTACAAAGAGAATGCACAATCAGGTAAGGCAGAGTTACACACGTTTGCTTTCATGCGCCCTGTTAACTTCAACCCAGCTGTAGGTGTTAATGGTTGGTCATTCCAGAACGTACACCCTTACGACTGGATTCCATTAAACGATGCTCCACCACAGTCTCCACCTGTTTCTTTACTAGCTAACTTCATGATTAATGATGATGAGTCTAGCCACCTAAGAACTGGTACAGGTATCGAGTCTACATTCGACCCACTTACTGGTGAGCACACTCTATCTGTTGACCCAACAAACATTGATTTGAGCGGTTATGCAGAGCTAGACGCAGACGTTTCATTCAGCAAGGTTACAGTTCAGAACGCTACTGACCCGCTTTACAACTCTGTGGTTAACGTTACAAACGGCGGTAACAGCGAGGTTAACCTTGTTGGTACGACAAATATCCGCAAGGTGGATAAGGCTACAGGAGACACAACAGATGTTGTTAGCATTAACGGCACTAGTGGCGCTGTTGATATCAAGACAGATGCAACATATCAAGGTGCAGTATCTGGTGGTAAATCTCTAGTCAGCAAAGAGTACACGGACGCACTTAGCTATTACAAAGGTCAAGGTGTTGGTATTCCTTCTGCTACAACCATCAGTACGAACACGGTTGAGCAAAACACAGCGGTTGCATTGTTTGAGAACTCAACAACCCATAGCGCAGAGACAATCATTTCATATGACGAATCTCTAGTTGGTGCTGAGACAATAATCAAGGTTAGCCCTTTTGCTAATTATCAATCTAAGAACTTCCTTTTCTATCACGGTGCAACCGGAAACGGTGAGAAGACAATTAGGCGTGGTGAGACTTGGCGCATTAGATTAGATGCAACAGGCGTTAATAGTTGGTTCTTCGAGCGGGTTGATGATGGGACTAGGGTTACTCGCGGCTTAGGTGGTAGAACAGTTAATGTTGAGCATCCGTATGTTGGACTATTTCAGTACGCGGAAAACATGCCGTATCACTTACTGGTTGAAACCCCAACATCTAGCAGATTGGTGCACGAGTTCCCACGTAACAAGACGTTTAGATTCACACCAATAAACTCAGACAGACAGCACGATGGAAACGTTCTGCTTAGCCAGGGGAATCAGGGTGTGGCAACGAACGACCTTGCGCTAGGTCAATACTCGGATATTCCGCTATACATCATTGAACCTAACGTGGTGGTTAACCGAGACCAAAGAGCTTGGATTAACTTTCCTGCAAGTGTTGAAATTGATGTTAGTGCTGGTTTCTATGCATTCGGCACAGTTTCAGGCTGGTGTGGTAACAACAATACTGAGGGTAATGTTGCTGTTTACGTTGGTACGTCAGAAAACTTTAGGTCATACACTCAAAATGTCGGGTTCGTACTAGGTAATAACGGATTGGTTATTCTTGATGGAAACAACATAAGAACGGCAGATAATAGCACCTCTTTTGGTTTCAACATTGAGTCAGGTGTTACTCACATGTACCGATATGCTTTCTACGTTGATGCTTCAGGGATGATGACTTACTACATTGCCGACCTAAACACAGGTCAGGTGTCATCTGGAACTCAACAATGTTTGTTAAATAGCATTGGTAGCAACCCTAAACTTTACATTAGTTATGACCGCTACTCTAACAACACAGCGGCATTCGCAATTGCAGAGACGCACCTGGTTGTTAACTCTGAGGGTGACGCTGAAGACCGATGGAACTGGAGAAACTAA

Genome Context

Tertiary structure

CAH9015108.1
ESMFold structure
Source ESMFold
pLDDT 46.8
Oligomeric state monomer