UniProt accession
A0A0E3FGE3 [UniProt]
Protein name
Tail fiber-like protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,90
TF
Evidence RBPdetect2
Probability 0,98
Seq2Symm
C1 confidence 0,770
C1 0,770
C3 0,466
I 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSKILANQIANYGDNSPVEVKEGVNIPAGKPLQAAGVAGTSGQVLTATGASIQWTTPFDGSYLTLTNKPTIPAAQINADWNASGGSVAAILNKPVIPAQPSIVLTAAGSSTLTYNQANGEFTFTPPDFSSYLTTYTETDPIFLASPAYQITNQNRTDWGLAYSWGDHSQAGYITTYTETDPVFTASVAAGITTQNKTNWDTSYGWGNHAAQGYITSYSETDPVFTASVAAGITLTNVSNWDTAYTWGDHGQAGYLTDLLSSSIELLSDVAISGPVADQLLKYNGSNWINYTPSYLESYTETDTLASITARGASTTTTVTLTDLNVSGNLNVLGTTTTNNVSTLNVTNNEIVLNENQASGGLDALLTNERGTDADVSIKWNETTDRWQFTNDGSTYYNVAINASELTNDAGYLTTSSSINSLGDVTISTPTSGDVLSYNGSDWVNSPASITAKASISDAAPSSPSPGDMWWKSDEGTMKVWYDDGNTAQWVDASPVGDPFENVYASVAFFPGANVNTGAFAYSEATGAMYYSNSVSWTSQRLVTTNSSTSSDFATLLANTQLTYSVSAIDYTTGGTAEYNAARKIVRLSDSQGVTGDIILTAGTGLSIVKSNNEITFNNDVVDTTYGISVEASSGANSILRLTDSQGVLDDVVFAGADGLVVENTDANTFTFRAPDISSQFYTDEEAQDAVATMFANGTHTNITFTYDDTNNSLSATAQAGGGGGGGTTYDLVGSNTNSNNAIITLLDANNNEDKIEIAGGGGTDVSWDGPNERITVSSTAPVQSDWDATTGLAQILNKPSIPSAYALPTAAAGTLGGIKVGANLSIDGDGILSANAGGYTLPAADATSLGGIKVGSGLSIDGNGVLTATGGSSVPSIQDLSGTTASLAADQSAELNITGYKAYSLFKVTTDAEAWVRVYVDDASRDADNTRSEGEDPTPGSGVISEVRTSGAESVLISPGIMGFNNDSPRTDTIYLSVTNRSGSATTITVTLTALQIGE
Physico‐chemical
properties
protein length:999 AA
molecular weight: 103869,41090 Da
isoelectric point:4,05003
aromaticity:0,08208
hydropathy:-0,18809

Domains

View on InterPro

No domain architecture available.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
AIX26886.1 [NCBI]
Genbank nucleotide accession
KJ019082 [NCBI]
CDS location
range 155975 -> 158974
strand +
CDS
ATGTCAAAAATTCTTGCAAACCAAATTGCCAACTACGGGGACAACTCTCCGGTTGAGGTAAAGGAGGGTGTAAATATTCCTGCTGGAAAACCACTACAGGCAGCAGGTGTTGCTGGTACTTCGGGTCAAGTCCTTACAGCAACTGGTGCTTCTATTCAGTGGACTACTCCTTTTGATGGCAGTTATCTTACTCTTACAAATAAACCTACGATTCCAGCAGCACAAATAAATGCTGATTGGAATGCTAGTGGTGGCAGTGTTGCTGCTATTTTAAACAAACCAGTTATTCCAGCACAACCTAGCATTGTATTAACTGCTGCTGGTTCTTCGACACTAACATACAACCAAGCAAATGGTGAGTTTACATTTACTCCACCAGATTTTTCTTCATATCTCACAACATATACAGAAACAGATCCTATTTTCTTAGCGTCTCCAGCGTATCAAATTACTAATCAGAATAGAACTGACTGGGGTTTGGCATACTCATGGGGAGATCATAGTCAAGCAGGATATATTACAACATATACTGAGACTGACCCTGTATTTACTGCTTCAGTTGCTGCTGGAATTACTACACAGAATAAGACTAACTGGGACACATCATATGGGTGGGGTAATCATGCCGCTCAGGGTTATATAACCTCATATTCAGAGACTGACCCTGTATTTACTGCTTCAGTTGCTGCTGGAATTACTCTTACTAATGTATCTAATTGGGACACTGCTTATACGTGGGGAGATCATGGTCAGGCAGGTTATTTAACTGATCTTTTATCCTCTTCTATTGAATTGTTGAGTGATGTTGCTATTAGTGGACCAGTTGCAGATCAGTTGTTGAAATATAATGGTTCTAATTGGATTAATTATACTCCATCATACTTAGAATCGTATACAGAAACCGATACACTAGCTAGTATTACTGCCAGAGGAGCTAGCACAACAACTACAGTTACTTTAACCGATCTTAATGTAAGTGGAAATTTAAATGTTCTTGGAACAACTACTACTAATAACGTTTCAACATTAAATGTAACTAATAACGAAATAGTTCTCAATGAGAATCAAGCGTCTGGTGGATTAGATGCTCTCCTTACAAATGAGAGGGGTACTGATGCTGATGTAAGTATTAAATGGAATGAAACCACTGATAGGTGGCAGTTTACTAATGATGGATCTACCTATTATAATGTTGCTATCAACGCAAGTGAACTTACAAATGATGCTGGGTATCTAACAACTTCAAGTTCAATCAATTCTCTTGGTGATGTTACAATTAGCACACCAACTAGCGGTGATGTATTATCATATAATGGTAGTGATTGGGTAAATTCTCCAGCATCAATTACTGCTAAAGCATCTATTTCGGATGCTGCTCCATCTAGTCCATCGCCAGGAGACATGTGGTGGAAGTCTGATGAAGGCACCATGAAGGTGTGGTATGATGATGGCAACACAGCACAGTGGGTTGATGCTTCTCCTGTTGGCGATCCATTTGAAAATGTGTATGCTAGTGTAGCATTCTTCCCTGGAGCAAATGTAAATACTGGTGCTTTCGCATACTCTGAAGCGACTGGTGCGATGTATTATTCCAACTCTGTAAGTTGGACCAGTCAGAGACTTGTTACTACCAATAGTTCCACTTCATCTGACTTTGCTACACTACTTGCTAATACTCAACTAACATATTCTGTTAGCGCAATAGATTATACTACAGGTGGAACCGCAGAATATAATGCTGCCAGAAAGATAGTAAGACTTTCTGATTCTCAAGGTGTTACTGGTGATATTATCCTGACAGCAGGAACTGGACTATCGATTGTTAAGTCCAACAATGAAATTACATTTAACAATGATGTAGTTGACACCACGTATGGCATTTCTGTTGAGGCATCTTCTGGTGCTAACTCTATCTTAAGATTAACTGATAGTCAGGGAGTCTTAGATGATGTTGTTTTTGCTGGTGCTGATGGTTTAGTAGTAGAAAATACAGACGCCAATACATTTACATTCAGAGCACCTGATATTTCTTCTCAGTTCTATACTGATGAGGAAGCACAAGATGCTGTTGCTACGATGTTTGCCAATGGCACACATACAAATATCACATTTACATATGATGATACTAACAACTCTCTTAGTGCCACAGCACAAGCAGGCGGTGGAGGTGGTGGTGGAACTACTTATGACTTAGTAGGTTCTAATACTAATAGCAATAATGCTATTATTACTCTACTGGATGCTAATAATAACGAAGATAAAATTGAAATTGCTGGTGGGGGAGGAACTGATGTTTCTTGGGATGGTCCCAATGAAAGAATTACTGTTAGTAGCACAGCACCAGTTCAATCTGATTGGGATGCTACAACAGGATTAGCACAGATTCTCAACAAACCATCTATTCCGTCAGCATATGCATTACCTACTGCTGCAGCAGGAACTTTAGGTGGTATTAAAGTTGGTGCTAATCTAAGCATAGATGGCGATGGTATTCTTAGTGCTAATGCTGGGGGATATACACTACCAGCAGCAGATGCAACATCTCTTGGTGGTATTAAAGTAGGTTCTGGTTTATCTATCGATGGCAATGGAGTCCTGACTGCTACTGGTGGTTCTAGTGTTCCATCAATTCAAGATCTTTCTGGAACTACCGCATCACTTGCTGCTGACCAATCAGCAGAACTAAATATTACAGGTTACAAAGCCTATTCGTTATTTAAAGTTACTACTGATGCTGAGGCATGGGTGCGAGTCTACGTAGATGATGCGTCAAGAGACGCTGATAATACGAGAAGTGAGGGAGAAGATCCTACTCCAGGTAGCGGTGTTATTTCTGAAGTGAGAACATCTGGAGCAGAATCAGTTCTAATATCCCCAGGCATCATGGGATTTAATAATGATAGTCCAAGAACGGACACCATTTATTTGTCAGTCACTAACAGAAGTGGATCGGCAACTACAATTACAGTTACTCTAACAGCACTACAGATCGGAGAATAA

Genome Context

Tertiary structure

A0A0E3FGE3
ESMFold structure
Source ESMFold
pLDDT 59.2
Oligomeric state monomer