Protein
- Genbank accession
- AGH06985.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TF
- Seq2Symm
-
C1 confidence 0,395 truncated
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C1 0,395 I 0,296 C3 0,014 - Protein sequence
-
MAQNTNLNVTPYYDDFDKDKNFYRVLFRPGFPIQARELTTMQSILQNQVENVGSHLFKDGAMVIPGQVGYDLNVAAIMLQESFLGADVEEYRTQLNGKIIEGLTTGVKAKVLYSISSTESDKGYITLYVKYIESGGVNANQETFQNNEQLITDVEITFGTTLIEVGSPFAQLLPTAALQVGSVAYVQSGVYFIRGFFVDVDYQYILLDQYGSNPSYRIGLDIQESIVTPEDDLSLNDNAAGTSNYAAPGAHRFRITTRLIKKLLTDDADKNFIELLRINASKVEKLVDRSAYEELEKGLALRTYEESGNYVVRDFAIKVRENLDDGFNNGVFAKGSTTSSGNTADEAKYAVEFGAGIAYVKGYRVSRLAPSFVDLEKPRATKDAQNVVIPFEMGNFSNVQNVFGFPNITGSTLSNAYQTIELRDTFSASQGSAAGNLIGFARVTSLQHLSDPDTTFGNADDRYKMNIMDVQMFGVLELTSAQTVSAGSLVVGASSGARAYLVNAISNSVRFDVYQIEGNFIENEMLTVDGENLDTIDSLHIYQYSDTRQVVARDETTSAIEFTADIVLEDAQIIEGSTFTYDATGGSEDITGLQSNFALDLRPGDEIYFNSTDFVVVDKIDPADVANTDIGNIFDYSNQVVNVTPGSSAPSAGTYTTLVRYRSKLFDIQNADLLSEMPKKYIKSIADESMVVRRTFDSQTVASNSVSITLPENEQFQSISNENYTITVLAGTNGTHPVGDQITIDTATPANLGYTSFTSADRTTIQIDNLTNITSVKVTATISKNVTIRKTKSGNQMFILKVNKTDKNLDKQNYNLVYSNLYGTRIQDKELSLGLTDCYRMHAVYESNDDNDPVIPSVTLVEPTFFATGSIVTGRTSKARAKVVDFASGSLKLSLVYLSGQFVAGETLDGFDSNDDALTAIINDSEGSVVAGSKVVTDNYFLEVNQTGFIYNISKLVRKKGVAAPIRKLKIVLDYYTHSATGDYFGGQSYLDTTYSDIPFFGFKFLADYLDFRPGVKNLYSGTGTVASPAFVNCSTFDFKSRVFNVSGTPNATVFDVPKLESNFRCDFNWYLPRVDKVFVTPEGEFQVIKGKSEEAPQPPDEIAEGMLLATISHKPYGFDPEKDTVITRSDNKRYTMRDIGALERRLDQVEYYTSLNILESNTYNTQILDSSGKNRLKNGFIVDDFSDHGKSDTAHEDFAASLDFQYGECQASHYTTNIPLVINTSLSTNYQQTGPLITLPYTEKKLIEQPYASRVENINPFNVFTYIGRVTLTPGSDDWLDTSRIPAQVTQIEGDFEQTSSELNVDQNGFAPIQWRAWETNWTGERVIGSSIQRNSHWLAQDRGRSPNPGVWGGRGMRRINRVTTIEATGTATREGIRTRVIPRIDRQSLGDSVVSSVSIPWIRSRNIEVDVARLKPRTRFYSFFDGKQTIDYQIPKMIELIKDPAIDNRTNSTPFSIGETVTGLTSGCKFKVAAPNDFYRFNPYDDTELPTSYASTTAYLNIDTTELAKQAVGDFYGNFQVQEVLEGTSGARAVIKDRRLISDRFGKLKTSFFIPSPGVDTNPRWATGTRTLRLSTDENDSRLAGAVASAAETNYEASGTLNTVQENVLAVRNAEIVRDTVTQDRTVRSTRTEIRQVGWYDPLAQSFIVDENGGAFITSVDVYFFKKDTNIPVSMQIRTMENGYPTTTILPFSDVSIEPDDVQLSETAAVATRFTFDAPVFIPQSVEHCFVLLSDSNSYQIWISRMGDQDITGDRTISEQPYAGVLFKSQNASTWTADQYEDLKFVVNRAEFSNTVNSALVLNNTVLARGNGGELNLRRDGIQTFTPELVLNLNSTTLPYTVGARIYQKTTNAEGTISKREVTVAGVLLTINDISGNWQQGSVNNNIVTNGIVSSKTTATITVTSASRTGATYSAGDTVTGATSGATAEVVSDDGGDTGTIVFRYVSKAFTAGETLEGDGTAGNVAFSAVTYAGDAVEAATISNAFPDATPTYASTQRKVKVFHSNHCMHSTANNVKIEGAVSEVADTSLTASISASDTSVSVSDAAAFHKTINGALISSNNVGYIKIGNEIMSYSAISNDNKTITINERGLDGTTAVSHADESVVECYNLDGIPLIEINKTHIGIQNPTLDSYELTTSSIARLGILGGGTNMYATQNVQYNLLVPQVERMLLPKTDITARINTISGTSINDGQTLSQASFSNDGVFNDVILGTDNYLDSPQLICSNINESNELSGAKSFRMDLTLSSLEANVSPVIDTDRLSATLVSSRINNPSDPNTAKLAVGDSHDAVYISRIADLTNPSGSIKVYFEGYRPPNSQIKVLYRVRPVGTATPIEELGFDFFPTEDAKIPATTERQLFREYEYEVSGLNFDQYQIKVVFVSPNQAYSPIIKDIRAIALAV
- Physico‐chemical
properties -
protein length: 2403 AA molecular weight: 263545,07860 Da isoelectric point: 4,76950 aromaticity: 0,09280 hydropathy: -0,26305
Domains
Domain architecture
AGH06985.1
1
2403 aa
STR 12–68 · STR 183–391 · STR 1040–1286 ·
ATT Attachment Domain
STR Structural Domain
RBD Receptor-Binding Domain
CBM Carbohydrate-Binding Module
LEC Lectin-like Domain
ENZ Enzymatic Domain
CHP Intramolecular Chaperone
LNK Linker/Spacer Domain
TAS Tail-Associated Structural
TTP Tail Tubular Protein
UNK Uncharacterized Domain
Unmapped
Proteins with similar domain architecture
Taxonomy
Coding sequence (CDS)
Genbank protein accession
AGH06985.1
[NCBI]
Genbank nucleotide accession
HQ317291.1
[NCBI]
CDS location
range 82236 -> 89447
strand +
strand +
CDS
ATGGCACAAAACACAAACCTTAACGTCACACCTTATTACGACGACTTCGATAAGGACAAGAATTTTTATCGAGTGCTGTTCCGCCCTGGATTTCCTATTCAGGCAAGGGAACTTACTACGATGCAGAGTATTCTGCAGAATCAGGTAGAAAACGTCGGTTCTCACTTGTTCAAAGATGGCGCAATGGTCATCCCTGGTCAAGTTGGTTATGACCTGAACGTTGCTGCTATCATGCTTCAGGAGTCGTTCCTTGGTGCTGATGTTGAGGAATATAGAACTCAGTTGAATGGTAAGATTATTGAAGGTCTTACAACAGGTGTTAAGGCAAAAGTTCTTTATAGTATTTCTTCTACCGAGTCTGATAAAGGTTACATCACACTTTACGTTAAGTACATTGAATCTGGTGGTGTCAATGCTAATCAGGAGACTTTCCAGAACAACGAACAGTTGATTACCGACGTCGAGATTACGTTCGGTACAACTTTGATTGAGGTTGGTTCTCCCTTTGCTCAGTTACTTCCTACCGCTGCTCTACAAGTCGGTTCTGTTGCATATGTTCAGAGTGGTGTCTACTTCATTCGCGGTTTCTTTGTTGATGTAGATTATCAATACATCCTTCTCGACCAGTATGGAAGCAACCCCTCCTATCGTATCGGTCTCGATATTCAAGAGTCTATTGTCACACCAGAAGATGACCTTAGTCTCAACGATAACGCTGCTGGAACATCTAACTATGCTGCACCTGGTGCTCATAGATTTAGAATCACCACGAGACTGATCAAAAAACTTCTGACTGATGATGCTGATAAGAACTTCATCGAACTGCTTCGTATTAATGCTTCTAAGGTAGAGAAACTTGTTGATAGAAGTGCATATGAAGAACTTGAGAAGGGTCTTGCATTAAGAACATATGAAGAGTCTGGCAACTACGTTGTTAGAGATTTTGCAATCAAAGTTAGAGAAAATCTTGATGATGGTTTTAACAATGGTGTGTTTGCAAAAGGTTCGACTACATCCTCTGGCAATACTGCCGATGAAGCAAAGTATGCTGTAGAGTTTGGTGCTGGTATTGCATACGTCAAGGGTTATAGAGTTAGTAGACTTGCTCCTTCTTTTGTTGATCTTGAAAAACCTCGTGCTACAAAAGATGCACAGAACGTCGTTATCCCATTTGAAATGGGTAACTTCTCCAATGTCCAGAATGTTTTTGGATTCCCCAATATTACTGGTTCTACTCTGAGTAATGCATATCAGACAATCGAACTGCGTGACACTTTTTCTGCTTCTCAGGGTAGTGCCGCTGGTAACCTGATTGGTTTTGCTCGTGTCACATCACTGCAGCATCTGAGTGATCCAGATACGACCTTTGGTAACGCTGACGACAGATATAAGATGAACATCATGGATGTTCAGATGTTTGGTGTCTTGGAACTTACAAGTGCTCAAACTGTATCTGCAGGTTCTTTGGTTGTTGGTGCATCTTCTGGTGCAAGAGCATATCTTGTAAATGCTATCTCAAACTCTGTTAGATTTGATGTATATCAAATTGAAGGTAACTTCATTGAGAATGAAATGCTTACCGTTGATGGTGAGAATCTGGATACTATTGATTCTCTGCATATCTATCAGTATTCTGATACTCGTCAGGTTGTTGCTAGAGATGAGACAACTTCTGCAATCGAGTTCACTGCTGACATCGTTCTGGAAGACGCTCAGATCATTGAAGGTAGTACGTTTACATATGATGCAACAGGCGGTTCTGAAGATATTACAGGTCTTCAATCTAACTTCGCTTTGGATCTCAGACCTGGAGACGAGATCTATTTCAACAGTACCGATTTTGTTGTTGTAGATAAGATCGATCCTGCTGATGTTGCTAATACCGATATTGGCAATATCTTTGATTATTCTAACCAAGTTGTTAATGTAACTCCTGGTTCTTCTGCTCCTAGTGCAGGAACTTATACCACTCTTGTTCGTTACAGATCAAAACTGTTTGATATTCAGAATGCTGATCTCTTGAGTGAAATGCCCAAGAAGTATATCAAGAGCATTGCTGACGAATCAATGGTTGTCAGAAGAACATTTGATTCTCAGACTGTTGCATCAAACTCTGTTTCCATTACTCTGCCTGAGAATGAGCAGTTCCAGTCAATCTCTAACGAAAACTACACAATCACTGTTCTTGCTGGTACTAATGGTACTCACCCTGTCGGTGACCAAATCACTATTGATACTGCTACACCTGCTAATCTTGGTTATACTTCATTCACATCTGCTGATAGAACGACGATTCAGATTGATAACCTGACAAATATCACTTCTGTTAAAGTTACTGCAACTATTTCTAAGAACGTAACTATCAGAAAAACTAAGTCTGGCAACCAGATGTTTATTCTTAAGGTCAACAAGACCGATAAGAATCTTGATAAGCAGAACTATAACTTGGTATATTCCAATCTTTATGGTACAAGGATTCAAGACAAAGAACTGTCTCTGGGTCTGACTGATTGTTATCGTATGCACGCTGTGTATGAATCTAACGATGATAATGATCCTGTAATCCCTTCTGTGACTCTGGTTGAACCAACTTTCTTTGCTACAGGTAGCATCGTAACTGGTAGAACCTCAAAAGCAAGAGCAAAAGTTGTTGACTTTGCTTCTGGTTCCTTGAAACTGAGTTTGGTATATCTCAGTGGTCAGTTTGTTGCTGGTGAAACTCTCGACGGTTTCGATAGCAATGATGATGCACTCACTGCTATTATCAACGATAGTGAAGGTTCGGTTGTTGCAGGTTCTAAGGTTGTTACTGACAACTACTTCTTGGAAGTAAATCAGACAGGATTTATCTACAATATTTCTAAACTTGTTCGTAAGAAAGGTGTTGCTGCACCTATTAGAAAACTGAAAATTGTTCTTGACTACTACACTCACTCTGCAACAGGTGATTATTTTGGTGGTCAATCCTATCTGGACACTACTTATAGTGACATTCCTTTCTTTGGATTCAAGTTCCTTGCAGATTATCTCGATTTCCGTCCTGGTGTCAAGAACCTCTATAGTGGAACTGGTACTGTAGCATCTCCTGCATTCGTCAACTGTTCTACATTTGATTTTAAATCTAGAGTATTCAACGTATCTGGCACACCTAACGCAACAGTCTTTGATGTTCCTAAGTTGGAAAGCAACTTCCGTTGTGATTTCAACTGGTATCTGCCTAGAGTTGACAAAGTATTTGTTACTCCCGAGGGAGAGTTCCAAGTTATCAAAGGTAAGTCTGAGGAAGCACCTCAACCACCTGATGAAATCGCAGAAGGTATGCTTCTGGCAACCATCAGTCATAAACCATATGGTTTTGACCCAGAAAAGGATACGGTCATCACTCGCTCCGATAATAAGCGTTACACGATGCGTGACATTGGTGCGTTAGAGCGTCGTCTTGACCAAGTTGAGTATTATACCTCCTTGAATATCCTGGAGTCCAATACCTATAATACTCAGATTCTTGATTCTAGTGGTAAGAACAGACTGAAAAATGGTTTTATCGTTGATGATTTCTCCGATCACGGTAAGTCTGATACTGCACATGAAGACTTTGCAGCATCTCTTGATTTCCAATATGGTGAGTGTCAAGCATCTCACTATACAACTAACATTCCTCTTGTTATCAATACAAGTCTTTCTACTAACTATCAGCAAACAGGTCCTCTGATTACTCTTCCTTATACAGAGAAGAAACTGATTGAGCAACCTTATGCTTCTAGAGTTGAAAATATCAACCCCTTCAACGTCTTTACCTATATTGGTCGTGTAACACTGACTCCTGGTTCTGATGATTGGTTGGATACAAGTAGAATCCCTGCACAGGTCACACAGATTGAAGGTGACTTTGAGCAGACTTCTTCTGAACTTAATGTTGACCAGAATGGTTTTGCTCCTATTCAATGGAGAGCATGGGAAACTAACTGGACTGGTGAAAGAGTCATTGGTTCTAGTATCCAACGTAACTCTCACTGGTTAGCACAAGACCGTGGCAGATCTCCCAACCCTGGCGTCTGGGGTGGTCGTGGTATGCGTCGTATTAATAGAGTTACTACTATTGAAGCGACTGGAACTGCAACCAGAGAAGGCATTAGAACTCGTGTTATTCCCAGAATCGACCGTCAGTCTCTGGGCGATAGTGTTGTTTCTAGTGTTAGTATTCCTTGGATTCGTTCTAGAAATATTGAAGTTGATGTTGCACGTCTGAAGCCTAGAACTCGTTTCTACTCTTTCTTTGACGGTAAGCAGACCATTGATTATCAGATTCCTAAGATGATTGAACTCATCAAAGATCCTGCGATTGATAATAGAACAAACTCAACACCTTTCTCTATTGGTGAAACTGTAACAGGTTTGACTAGTGGATGTAAATTTAAAGTTGCTGCTCCTAATGACTTCTACAGATTCAACCCATATGATGATACAGAACTTCCTACATCGTATGCATCTACCACAGCATATCTGAATATTGATACTACTGAACTTGCTAAGCAGGCAGTCGGTGATTTCTATGGTAACTTCCAAGTACAGGAAGTTCTGGAAGGCACATCTGGTGCTCGTGCTGTTATTAAGGACCGTCGTCTTATCTCTGACCGCTTCGGTAAACTGAAGACTTCATTCTTCATTCCTTCTCCTGGAGTTGATACCAATCCCCGTTGGGCAACTGGTACAAGAACTCTGAGACTGTCTACCGATGAGAATGATTCACGTCTGGCAGGTGCAGTTGCATCCGCTGCTGAAACAAACTACGAAGCAAGTGGTACTCTGAATACTGTTCAGGAAAATGTCTTGGCAGTTCGTAATGCTGAAATCGTTCGCGATACTGTTACTCAAGATCGAACAGTTCGTTCTACTAGAACTGAGATTCGTCAGGTTGGTTGGTATGACCCTCTGGCACAATCCTTTATTGTTGATGAAAACGGTGGTGCATTTATCACCTCTGTCGATGTTTACTTCTTCAAGAAAGATACAAACATCCCCGTTTCCATGCAAATCAGAACCATGGAGAATGGTTATCCCACAACAACCATCCTTCCTTTCTCTGATGTAAGTATTGAACCTGATGATGTTCAGTTGTCTGAGACTGCTGCAGTTGCTACTAGATTTACATTTGATGCTCCTGTCTTCATTCCTCAGTCTGTTGAGCACTGCTTCGTTCTCCTCTCTGACTCCAACTCTTATCAGATTTGGATCTCTAGAATGGGTGACCAGGATATTACTGGTGACAGAACAATCTCTGAACAACCTTATGCTGGTGTTCTGTTTAAGTCACAAAACGCATCTACATGGACTGCTGACCAGTACGAAGACCTTAAGTTTGTTGTAAACAGAGCAGAATTTAGTAATACTGTTAACTCTGCATTGGTTTTGAACAACACTGTTCTTGCAAGAGGTAATGGTGGTGAACTAAACCTCCGTAGAGATGGTATTCAGACATTCACACCTGAACTGGTTTTGAACCTGAACTCCACAACTCTTCCCTATACCGTTGGCGCTCGTATCTATCAGAAGACTACTAACGCAGAAGGTACTATCTCTAAGAGAGAAGTAACTGTTGCTGGTGTTCTTCTGACAATCAACGATATTTCTGGTAACTGGCAGCAAGGTAGTGTGAATAATAATATCGTTACTAACGGTATTGTTTCTTCCAAGACTACTGCAACTATTACAGTCACTTCTGCTTCTAGAACTGGTGCTACCTATAGTGCAGGTGATACTGTTACTGGCGCTACATCTGGCGCAACTGCTGAAGTTGTAAGCGATGATGGTGGTGATACTGGTACAATCGTATTCCGTTATGTTTCTAAGGCATTTACTGCTGGTGAAACTCTGGAAGGAGATGGAACTGCTGGTAACGTCGCATTCTCTGCTGTTACCTATGCTGGTGACGCTGTTGAAGCTGCAACAATCAGCAATGCATTCCCTGATGCAACGCCTACCTATGCATCTACTCAGAGGAAGGTTAAGGTCTTCCACAGTAATCACTGTATGCATAGCACTGCCAACAACGTTAAGATTGAAGGTGCAGTCTCCGAAGTTGCAGATACCTCTCTGACGGCATCTATTTCTGCTTCAGATACATCTGTTTCTGTCAGTGATGCTGCAGCGTTCCACAAGACAATCAATGGTGCATTAATCTCTTCCAACAATGTTGGTTATATCAAGATTGGTAATGAGATTATGTCTTATTCTGCTATCAGTAATGATAATAAGACAATCACAATCAATGAAAGAGGTCTTGACGGTACAACTGCAGTATCTCACGCAGACGAGTCTGTTGTTGAGTGCTACAACCTTGACGGCATTCCTCTGATTGAGATTAACAAGACTCATATTGGAATCCAGAATCCAACTCTCGATTCTTATGAACTGACTACCTCTTCTATTGCTAGACTTGGTATCCTGGGTGGTGGCACTAACATGTATGCAACTCAAAATGTTCAGTACAACTTGCTTGTTCCTCAGGTTGAGAGAATGCTTCTTCCCAAGACCGATATTACGGCAAGAATTAATACCATCTCTGGTACATCTATCAATGATGGACAAACCTTATCTCAGGCATCGTTCTCGAATGATGGTGTATTTAATGATGTCATCCTCGGAACCGACAACTATCTTGACTCTCCTCAACTGATTTGTTCTAACATCAACGAGTCTAACGAACTCAGTGGTGCTAAGTCCTTCAGAATGGACTTGACCTTATCAAGTCTTGAAGCAAACGTTTCTCCTGTTATTGATACTGATAGACTGTCGGCAACTCTTGTTTCTAGTAGGATTAACAATCCTTCCGATCCCAATACTGCTAAACTTGCAGTTGGTGATTCTCACGATGCGGTATACATTAGTCGTATTGCAGATCTGACCAATCCTTCTGGTTCTATCAAGGTCTACTTTGAGGGATACCGTCCTCCTAATAGTCAGATTAAGGTCCTATATAGAGTACGTCCCGTTGGTACGGCAACACCTATTGAAGAACTCGGATTCGATTTCTTCCCAACCGAAGATGCTAAGATTCCTGCTACAACGGAAAGACAACTGTTCCGTGAGTATGAGTACGAAGTATCTGGTCTAAACTTTGACCAGTATCAAATCAAGGTTGTATTTGTTTCTCCCAACCAGGCGTACAGTCCAATCATCAAAGATATCAGAGCAATCGCCCTTGCTGTATAA
Genome Context
Tertiary structure
AGH06985.1
ColabFold structure
Source
ColabFold
pLDDT
77.9
Oligomeric state
monomer
Literature
| Title | Authors | Date | PMID | Source |
|---|---|---|---|---|
| The Genome Sequence of Synechococcus phage S-RIM2 isolate R9_2006 | Henn,M.R., Marston,M., Levin,J., Malboeuf,C., Casali,M., Russ,C., Lennon,N., Chapman,S.B., Erlich,R., Young,S.K., Yandava,C., Zeng,Q., Fitzgerald,M.F., Alvarado,L., Anderson,S., Berlin,A., Chen,Z., Freedman,E., Gellesch,M., Goldberg,J., Green,L., Griggs,A., Gujja,S., Heilman,E., Heiman,D., Hollinger,A., Howarth,C., Larson,L., Mehta,T., Neiman,D., Pearson,M., Roberts,A., Ryan,E., Saif,S., Shea,T., Shenoy,N., Sisk,P., Stolte,C., Sykes,S., White,J., Haas,B., Nusbaum,C. and Birren,B. | 2021-02-24 | — | GenBank |