Genbank accession
YP_009608425.1 [GenBank]
Protein name
tail fiber protein proximal subunit
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence RBPdetect
Probability 0,70
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MADIKRKFRAEDGLDAGGDKIVNVALADRTVGTDGVNVDFLVQENTVQVYDSTRGYNKGFVVLYDNRLYQAINDIVSPSGAFNLLQWRAVRTDAQWITVSSGTYQLSSGDSISVNTGAGNDMVFTLPNAPVDGDTVVLADIGGRTGTVKVQINASVQSILNFRGEQVRTVLMTRPRSQLLFVFSNRLWQMYIIDYGKESITVTPATPYQAQANDFIVRRFTSAAPINITLPRNANNGDIITLVDLDKLNPLYHTIVKTFDDTTSIGEVGTHIAEGRNDSDAFFVFDASNSLWRIWEGDQKSRLRIIRADSNIRPNEEVLIFGTNNATTGTINLTLPTGILSGDTVKISMNYMRKGQTVKIKAAEGDTIASSVALLQFPKRSEYPPDAQWVSVTELEFNGTTSYVPVLELSYIEDTVAGTRYWVVQQNVPTVERVDAGTDATRARLGVIALATQAQANVDLENTPAKEVAITPETLANRTATEARRGIAKIATTAQVNQNSTASFVDDTIVTPKKLNERTATETRRGLAEIATQTETDAGLDDTTIITPKKLQARQGSETLSGIVKYVSTTSATPAETRGAAGTNVYNKTVNNLTISPKALDQYKATYAQQGAVILAIDSEVIAGQSQSGYSHAVVTPETLHKKTSTDGRIGLIEIATQAETNAGTDYTRAVTPKTLNDRRATEGLSGIAEIATQVEFDTGTDDTRISTPLKIKTHFDSSDRTSVNSDSGLIEEGTLWNHYTLDISKANETQRGTLRVATQAESNAGTLDDVLITPKKLLGTKSTETSEGVIKVATQAETVTGTSANTAVSPKNLKWIVQNEPTWAATTAIRGFVKTSSGSITFVGNDTVGSTQNLELYEKNSYAVSPYELNRVLANYLPLKAKAADANLLDGLDSSQFIRRDIAQTVNGSLTLTQQTNLSAPLVSSSTATFGGSVSANSTLTISNTGASTRLIFEKGPQTGNNPAQAMNIRVWGNQFAGGSDTSRATIFEVGDETSNHFYSQRDNLGNITFSINGTVRPINVNASGTLNANGAATFGRSVTAQGEFITYSANAFRAISGNYGFFIRNDAANTYFMLTASGDQTGGFNGLRPLAINNASGQVTVGESLIIAKGATINSGGLTVNSRIRSQGTKTADLYTRAPTSDTVGFWSIDINDSATYNQFPGYFKMVEKTNEVTGLPYLERGEEVKSPGTLTQFGNTLDSLYQDWITYPTTPEARTTRWTRTWQKTKNSWSSFVQVFDGGNPPQPSDIGALPSDNATIGNLTIRDFLRIGNVRIIPDPVNKTVKFEWIE
Physico‐chemical
properties
protein length:1291 AA
molecular weight: 139537,55520 Da
isoelectric point:5,38455
aromaticity:0,07436
hydropathy:-0,30728

Domains

Domains [InterPro]
IPR048390
ATT
981–1094
DC_1209
STR
1066–1275
YP_009608425.1
1 1291
Architecture
ATT
STR
ATT
STR
ATT
STR
ATT 15-141 | STR 343-980 | ATT 981-1094 | STR 1095-1140 | ATT 1141-1239 | STR 1240-1275 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage ST0
[NCBI]
2005047 Uroviricota > Caudoviricetes > Pantevenvirales > Tevenvirinae > Mosigvirus
Host Escherichia coli H8
[NCBI]
2072452 Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Escherichia > Escherichia coli

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_009608425.1 [NCBI]
Genbank nucleotide accession
NC_041990 [NCBI]
CDS location
range 77072 -> 80947
strand -
CDS
ATGGCCGACATCAAACGTAAGTTCAGAGCCGAAGACGGTCTGGACGCCGGTGGCGACAAGATTGTTAACGTAGCATTAGCCGACCGTACAGTAGGTACTGATGGCGTAAACGTTGACTTCCTGGTACAAGAAAACACCGTTCAAGTATATGATTCTACGCGTGGATATAACAAAGGATTTGTTGTTCTTTATGACAACCGTTTATATCAAGCAATAAATGATATCGTGTCTCCTTCCGGGGCATTTAACCTTTTACAATGGCGTGCAGTTCGTACCGATGCACAATGGATAACTGTCTCTTCTGGGACTTATCAACTTTCTTCAGGTGATTCTATTTCGGTTAACACTGGGGCCGGCAATGATATGGTTTTCACGTTGCCAAATGCGCCGGTTGATGGTGATACTGTTGTTTTGGCTGATATTGGTGGAAGAACCGGGACAGTTAAAGTACAGATTAACGCGTCTGTGCAGAGTATTTTAAACTTTAGAGGTGAACAAGTTCGTACAGTTTTAATGACGCGTCCACGTTCACAACTATTGTTTGTGTTTAGTAATCGTTTGTGGCAGATGTATATCATTGATTACGGTAAAGAATCAATCACTGTTACACCTGCGACACCATATCAAGCACAAGCAAATGATTTTATCGTTCGTCGTTTTACTAGTGCAGCACCAATCAACATTACACTTCCACGTAATGCTAACAATGGTGATATAATCACCCTAGTCGATTTAGATAAATTAAACCCACTGTATCATACAATTGTTAAAACATTTGATGATACAACGTCTATTGGTGAAGTCGGGACTCATATTGCCGAAGGCAGAAATGACTCTGACGCGTTTTTTGTTTTTGATGCTTCAAATAGTTTATGGCGTATATGGGAAGGCGACCAGAAATCGCGTCTTCGTATTATCCGTGCTGATTCAAATATTCGTCCAAATGAAGAAGTTCTTATTTTTGGCACAAATAACGCTACAACCGGAACTATTAATCTTACGCTGCCTACTGGAATTTTGAGTGGTGACACTGTTAAAATTTCAATGAACTACATGCGTAAAGGCCAAACCGTAAAAATTAAAGCTGCCGAAGGTGATACAATTGCTTCTTCTGTTGCGTTGCTTCAGTTCCCTAAACGTTCTGAATATCCACCTGATGCTCAATGGGTCTCTGTTACTGAACTAGAATTCAATGGCACTACTTCATATGTTCCTGTATTAGAATTATCGTATATCGAAGACACCGTTGCTGGTACACGTTATTGGGTTGTTCAACAAAACGTCCCAACTGTAGAACGTGTTGATGCTGGAACTGATGCTACACGAGCTCGTTTAGGTGTTATTGCTCTTGCTACTCAAGCGCAAGCAAATGTTGATTTAGAGAATACTCCGGCTAAAGAAGTTGCTATTACTCCGGAAACATTGGCAAATCGTACAGCAACTGAAGCTCGACGTGGTATCGCTAAAATTGCTACAACAGCACAAGTTAACCAGAATTCCACAGCATCATTTGTGGACGATACTATTGTTACGCCTAAAAAACTAAATGAGCGTACAGCAACTGAAACTCGTCGCGGTCTTGCTGAAATTGCTACTCAGACTGAAACCGATGCTGGTCTTGATGACACAACGATTATTACACCTAAGAAATTACAGGCACGTCAGGGTTCCGAAACACTATCGGGTATAGTTAAATATGTATCAACTACTTCTGCTACTCCTGCTGAAACTCGTGGGGCCGCAGGCACTAACGTTTATAATAAAACCGTAAATAATTTAACTATTTCTCCTAAAGCCCTTGACCAATATAAAGCAACTTACGCCCAACAAGGTGCAGTAATTTTAGCTATTGATAGTGAAGTAATTGCTGGACAATCTCAGTCTGGATACTCTCATGCTGTAGTAACTCCTGAAACACTACATAAGAAAACTTCTACTGATGGACGTATTGGTTTAATTGAAATTGCTACGCAAGCAGAAACTAATGCTGGGACTGATTATACACGTGCAGTAACGCCTAAGACGTTAAATGATAGGAGAGCGACGGAAGGATTATCCGGCATAGCCGAAATTGCTACGCAAGTTGAATTTGATACTGGAACTGATGATACTCGTATCTCGACTCCACTGAAAATTAAAACTCATTTTGATTCTTCTGACCGTACCAGTGTTAATTCTGATTCCGGACTTATTGAAGAAGGAACCTTGTGGAACCATTATACTCTTGATATTTCTAAAGCAAATGAAACACAACGTGGTACACTTCGCGTAGCGACCCAGGCAGAATCTAATGCAGGAACTTTAGATGATGTTCTTATTACTCCTAAAAAGCTTTTAGGGACTAAGTCCACTGAAACGTCTGAAGGTGTAATCAAGGTTGCTACTCAGGCTGAAACTGTGACTGGAACGTCAGCGAACACTGCTGTATCTCCTAAGAATTTAAAATGGATTGTCCAGAACGAACCAACATGGGCTGCTACTACAGCAATTCGCGGATTCGTTAAAACTTCATCCGGTTCTATTACATTCGTTGGTAATGATACAGTCGGTTCTACACAAAACTTAGAGCTATACGAGAAAAATAGCTATGCAGTATCACCGTATGAATTAAACCGTGTATTGGCAAATTACTTGCCATTAAAAGCAAAAGCTGCTGACGCAAATTTATTAGATGGCCTAGATTCATCTCAGTTCATTCGTAGGGACATTGCACAGACGGTTAATGGTTCACTAACCTTAACCCAACAAACGAATCTGAGTGCCCCTCTTGTATCATCTAGTACGGCTACGTTTGGTGGTTCGGTATCTGCTAATAGTACATTAACTATTTCTAATACAGGTGCTTCAACTCGCTTAATATTTGAAAAAGGTCCACAAACTGGAAACAACCCTGCTCAGGCGATGAATATCCGTGTATGGGGTAACCAATTCGCCGGCGGTTCTGATACATCTCGTGCTACGATATTTGAAGTTGGTGATGAAACATCTAACCACTTTTATTCACAACGGGATAACCTTGGTAATATTACTTTCAGCATCAACGGTACAGTTCGGCCGATTAATGTTAATGCATCCGGAACATTGAATGCTAATGGTGCGGCAACATTTGGACGTTCGGTGACAGCACAGGGTGAATTTATAACCTATAGTGCAAACGCATTCAGAGCAATTAGTGGTAATTACGGATTCTTTATTCGTAATGATGCTGCTAATACCTATTTTATGCTTACTGCATCAGGTGATCAGACTGGCGGATTTAATGGATTACGTCCTTTAGCTATTAATAATGCATCCGGCCAAGTAACGGTTGGTGAAAGCTTAATCATTGCCAAAGGTGCTACTATAAATTCAGGTGGTTTAACTGTTAACTCGAGAATTCGTTCTCAGGGCACTAAAACCGCTGATTTATACACCCGTGCACCGACATCTGATACTGTAGGATTCTGGTCAATTGACATTAATGATTCAGCTACTTATAACCAATTCCCGGGTTATTTTAAAATGGTTGAAAAAACTAATGAAGTGACTGGGCTTCCATACTTAGAACGTGGCGAAGAAGTTAAATCTCCTGGTACATTGACTCAGTTTGGTAATACACTTGATTCACTTTACCAAGATTGGATTACTTATCCAACAACTCCAGAAGCACGTACAACCCGTTGGACACGTACATGGCAGAAAACTAAAAATTCTTGGTCGAGTTTTGTTCAGGTATTTGATGGCGGAAACCCTCCTCAACCTTCTGATATTGGCGCTTTACCTTCTGATAATGCAACAATCGGAAACTTGACAATAAGGGATTTCTTAAGGATTGGTAATGTTCGCATTATTCCAGACCCTGTGAATAAAACTGTTAAATTTGAGTGGATTGAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
82913d60c2c1d7a3f2a6d3b92c02434cf69ad2f87d303fa772b64be46bddaff8
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5549
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequence of Escherichia phage ST0 Liu,X., Liu,H. and Li,J. 2017-12-19 GenBank