Genbank accession
YP_009599168.1 [GenBank]
Protein name
straight fibre tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,53
Seq2Symm
C1 confidence 0,981 truncated
C1 0,981
C3 0,189
I 0,003
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MIKNPSPAKMVLSSIAVGYTKALVYHSPFTDPDTIGKTFWITTGNKEVAQTSQDLNTFYMILEKLTPNTKYSVTGAYWDSMVDSELLANKLSILISDSSNITTLLAPRIKSYKAEMEAAVVGVGTSYLIVDFEGAGQIVELQLSKDGKTWETIYSGEIKEGVRLANIPAGTYKARCRGRVALPDGFTTDISDWTQYPADLVVNYAFTPPSKPTNLTFTAARILDGNERYDVQVKWNWSAGSGANIREFVMYYVSKAEFDKTGWAKAARVNTGATQAAIITGFPWEIPTVFKVEAISWGPSDKNTTASDNANFTLNASIPLDSSFTKTTGIEITYSHIKGQKQVNGKWEQTFLLNASDGSFSLGMLNDKGVAPISMDPVTGTVNVDGRIISNEIYAASVVLSNLTGQDNPKIYSTGKTYGGDTSGVWMGMGKDGLARFDVGNKDSFIRFDGEKIWMSAGVTIGTPNGDITIGDGITGIRQVTIYQLNTAAPSIPVSQEYPPPGWSKTPPSIQDPFKQKIYASTGQLDPVTDKLVSGTNYSQPVQWSGTTGSDGKPGSNGSNGLDGKGTVSIYQLGNKGTVPVASTLPDYPPNGWSTTPPAIPNPLTQCVYVSIGQLDPKTNKLVSGTKWATPVQFTGNNGNNGQDGKPGADGKPGSNGTNGLPGKDGFGLTYVYQVSRTQPVIPGGIEYPPTNWSKTPPANYNPTVEAVYASMGTLDPRTNKLVAGTGWSTPIQWSGIPANPVNNNLLTGTTDLVIVDSSNTSVSKSSMLSTEFMPTVESFNLLKGKKVTVSCFIETNGIVEGTAGGRHRIGCEMSITYVDGQTQHIGTWYDRGTATSAVSKATITIQNKEVKSVAAMGVHIQGKTTFGKVSQVKLEEGDVATAWVDAGKNGKPGADGKPGANGTNGTPGANGQRGPGFYRQGRGAAGWSDADATAFFKSTFSSTPVQYDVLTQYHTANPKAGITRQWNGSSWTNPALMVHGDMVLDGTITSKKIVADQAFFAQTGINVIYDRAAALSSNPEGTYKMKIDLQNGSIHIR
Physico‐chemical
properties
protein length:1038 AA
molecular weight: 110745,86200 Da
isoelectric point:7,94117
aromaticity:0,08863
hydropathy:-0,32659

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_009599168.1 [NCBI]
Genbank nucleotide accession
NC_041913 [NCBI]
CDS location
range 82598 -> 85714
strand -
CDS
ATGATTAAAAACCCATCTCCAGCAAAGATGGTTCTGAGTTCAATAGCGGTAGGGTACACTAAGGCTTTAGTGTACCACTCCCCTTTTACAGACCCAGATACTATCGGTAAGACATTCTGGATTACCACAGGTAATAAAGAAGTAGCACAAACTTCACAAGACCTAAATACTTTCTACATGATCCTAGAAAAATTAACTCCTAATACTAAATATAGTGTCACAGGAGCATATTGGGATTCTATGGTAGATTCTGAATTATTAGCTAATAAGCTAAGTATCTTAATATCCGACTCTAGTAATATAACAACTCTTCTAGCTCCACGAATAAAATCTTATAAAGCAGAGATGGAAGCGGCAGTTGTTGGGGTAGGTACATCTTATTTAATTGTTGATTTTGAAGGGGCAGGACAAATAGTTGAACTACAATTATCTAAAGATGGTAAAACGTGGGAAACTATCTATTCCGGAGAGATTAAAGAAGGGGTACGACTAGCTAACATTCCTGCTGGTACATACAAGGCTCGTTGTAGGGGACGTGTTGCACTACCAGACGGCTTCACTACTGATATCTCTGATTGGACTCAGTATCCAGCAGACCTGGTTGTTAATTATGCATTTACTCCGCCAAGTAAACCTACTAACCTAACTTTTACTGCTGCTAGAATTTTAGACGGTAACGAAAGATACGACGTCCAAGTTAAGTGGAATTGGTCGGCAGGTAGTGGTGCAAACATCCGGGAATTCGTTATGTACTATGTATCTAAGGCAGAGTTTGATAAAACTGGTTGGGCTAAAGCAGCACGTGTTAATACCGGTGCTACTCAAGCAGCAATTATTACTGGATTCCCTTGGGAAATTCCAACAGTATTTAAGGTAGAAGCCATCTCGTGGGGCCCTTCTGATAAGAATACTACCGCAAGTGATAATGCTAACTTTACATTAAACGCAAGCATACCATTAGACTCTTCATTTACTAAGACTACAGGTATTGAGATAACTTATTCCCATATCAAAGGTCAGAAACAGGTAAATGGTAAATGGGAACAGACTTTCCTATTAAATGCGTCGGATGGGTCTTTTAGTCTTGGTATGTTAAATGATAAAGGGGTTGCTCCAATATCTATGGACCCAGTTACTGGTACAGTAAACGTTGATGGTAGAATCATCTCTAATGAGATATACGCTGCTAGTGTTGTTCTATCTAACCTTACTGGACAAGATAACCCTAAGATATACTCTACTGGTAAGACTTATGGTGGTGATACATCGGGTGTTTGGATGGGTATGGGTAAGGACGGTCTTGCAAGATTTGACGTTGGTAATAAAGATAGTTTTATCCGGTTTGACGGTGAAAAGATCTGGATGTCTGCTGGAGTAACTATTGGTACACCTAATGGGGATATTACCATAGGTGATGGTATTACTGGTATCAGACAAGTTACTATTTACCAGCTAAACACCGCAGCTCCTAGTATACCCGTTTCTCAAGAGTATCCGCCTCCAGGATGGAGTAAAACTCCTCCTAGCATTCAAGATCCTTTTAAACAAAAGATCTATGCAAGTACTGGTCAGTTAGATCCTGTTACTGATAAGCTAGTTTCTGGGACTAACTATTCTCAACCAGTTCAATGGAGTGGTACTACGGGGTCTGATGGTAAGCCTGGTAGTAACGGTAGTAATGGTCTAGATGGTAAAGGTACTGTATCAATTTACCAGCTAGGTAATAAAGGTACAGTACCTGTGGCTTCTACATTACCAGATTATCCTCCGAATGGTTGGAGCACAACTCCTCCTGCTATACCAAATCCATTGACCCAGTGTGTGTATGTATCGATTGGTCAACTAGATCCTAAGACTAATAAACTAGTTTCAGGAACTAAATGGGCAACTCCAGTACAGTTTACAGGCAACAATGGTAATAATGGGCAAGACGGTAAGCCTGGTGCGGATGGTAAACCTGGCTCTAATGGTACTAATGGGTTACCGGGTAAAGACGGTTTTGGTCTTACATACGTTTATCAAGTATCTAGAACACAACCAGTTATTCCTGGAGGTATCGAGTACCCACCAACTAACTGGTCTAAAACACCACCAGCTAACTATAACCCAACAGTAGAAGCTGTATATGCCTCTATGGGTACACTAGATCCTAGAACTAATAAACTAGTTGCAGGAACAGGTTGGTCAACTCCGATTCAGTGGAGTGGTATACCAGCTAACCCCGTTAATAATAACTTGCTTACGGGTACTACAGATCTAGTTATTGTGGACTCTAGTAACACTAGTGTAAGTAAGTCTTCAATGCTATCTACTGAGTTTATGCCAACAGTAGAATCCTTTAACCTACTTAAAGGTAAGAAAGTAACTGTATCCTGTTTTATAGAAACTAACGGTATTGTAGAGGGTACTGCTGGCGGTAGACATAGGATTGGTTGTGAGATGAGTATTACTTATGTAGACGGTCAAACCCAACATATTGGTACTTGGTACGATAGAGGTACTGCTACTTCTGCGGTATCCAAGGCTACTATAACTATTCAGAATAAGGAAGTTAAATCTGTAGCTGCAATGGGTGTGCACATCCAAGGTAAAACTACTTTTGGTAAGGTATCACAAGTTAAACTAGAGGAGGGAGATGTAGCTACCGCTTGGGTAGATGCAGGTAAGAATGGTAAGCCTGGAGCAGATGGTAAGCCTGGAGCTAACGGTACCAATGGTACTCCGGGTGCAAACGGGCAGCGTGGTCCTGGGTTTTACAGACAGGGTAGAGGGGCGGCTGGCTGGTCAGATGCTGATGCTACTGCGTTCTTTAAATCCACATTTAGCTCTACCCCTGTTCAGTATGACGTATTAACCCAATATCATACGGCTAACCCTAAAGCAGGTATCACTAGACAGTGGAATGGTAGTTCATGGACTAATCCAGCACTTATGGTACATGGAGACATGGTTCTAGACGGTACAATTACATCTAAGAAAATTGTTGCCGATCAGGCATTCTTTGCACAAACTGGTATTAACGTTATATATGACCGTGCTGCTGCATTATCATCTAATCCAGAGGGTACATATAAGATGAAGATAGACTTACAAAATGGGTCTATTCATATAAGGTAA

Genome Context

Tertiary structure

YP_009599168.1
ESMFold2 structure
Source ESMFold2
pLDDT 70.4
Oligomeric state monomer