Genbank accession
WFG41560.1 [GenBank]
Protein name
hypothetical protein
RBP type
TF
Evidence RBPdetect2
Probability 0,28
Seq2Symm
C3 confidence 0,997 truncated
C3 0,997
C1 0,014
D3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MKTYPYDPRGVNPECHFIEERIIDSDNPNDRVVMLDHRPFFEGLVVRLAGSSIPLTRGTDYELEYALTPLDDSVTTPVFCGVHLINPKLRGAVVFEGQMLGGTFYSGLIEMLDELVKALNNPTAADWLLLGNRPSLYPATPAAVAWSDMLNKKYVASAVHDVELDAGAANEQIREKLTELKDAVLGLGTEIATFNYPGHIASTNPHGTTAAQAGAHPVNLKTPDTFLAYGKTLRQLTSEVRALGLQQSDIDKYISKWVSKESKGVFNATISGTRALFRSPAGESEIVFSAEAFTLKSNGSVVLACGYADTTGTTRFMEWKAGINTLRIESTGSALGMDKLTLNGTTLLTTTALMGYQQDPGTGGGTVDPDDNKLYISGVNGITFTGKGSKADPVTGKVTAKPATTSEPGVVTLTDKPSDVVKGQAVTPASLLPYEGDLSSYVRKTTLLNNQPMDTGSRTLTKKDLGLDLADNTADVDKPLSDALAEAVTGLSDKGHHHNFADLQIPTASQTVPGIARYSTNLNGLSDNRGVTPNVLYDLSKRLDVVAAALANAKEDSVADFAAVRGKTWTVGSTRTTLAVTDLNYFYLLNGARKEGTVSGSIDLQTTPMFQWFSPDNRMERTWQNAVINTGAGIDFSGFEVAVPETNYGAQIGLTTTGMGDLSVVNLLAKTWVRCDSGKLRIWVRGGGAVSVYLDGEIIGAGITEAGYLEATVKEGWKQHCLAFRAECNDSAKAAAIRFTIYDGDFAVGASDKNTKVARLQEFVKTPNGLRHYLYVNMITDALYSRAEPIVDTEGINLERGYIGHIDVPDAGLVAGTTYEFETTFDFGMASELKRHFETRLAHGVSNSDWSLTDNPKMLPLNKVDPLPKQWLYAYPTNPSVSGDNLVRLDRGLFDYKFVSATSLRILLAAVVSTENASPYCWFTPSNPKENGMATFEGSVVIDTDYPEVPKTSDVEVSLNFMAPSADGKGKTRVLRWSNSRTSLNCGFIAAPYDKPTGRIATTQSSVTNTLVDAPRVIKSVDVQSPDCLDYLPVSIASEFAAIGSRWLIRYRYIVDTQILRISSISKIGGQASATIREIEYDLPFDAIDYFKGGALSISVTGIETGEGVTINHGLMDPSTTEVDLNRFHYLRSLFESYIERSPDSQSSGHEEMSISTVAFANFGDNVDNPVTEYITMSAASEGYPELAPNGKLPAPFYKGLQKRGAPLLESAPADYTSNGGEWKYGFMRAYRPTQNERFVSVNGTMLSNYPGYIIVGSEKIPGNVIPFSASTTAVQISGTLARTKPMQPIHIVFVPPEGSVPPLQAKFTINGVGSSGNPMFVITETTPVELRTGGETILIEKRNPFHIPTRTWDWILQTLDTERRNEGNNSGEWAS
Physico‐chemical
properties
protein length:1376 AA
molecular weight: 149132,08230 Da
isoelectric point:5,21506
aromaticity:0,08576
hydropathy:-0,21810

Taxonomy

Phage
Host No host information

Coding sequence (CDS)

Genbank protein accession
WFG41560.1 [NCBI]
Genbank nucleotide accession
OQ383623 [NCBI]
CDS location
range 29109 -> 33239
strand +
CDS
ATGAAAACGTATCCTTACGATCCTCGGGGTGTAAATCCTGAGTGTCACTTCATCGAGGAACGTATCATCGACTCCGACAATCCTAACGATCGGGTGGTGATGCTAGATCATCGCCCGTTTTTCGAAGGATTGGTGGTAAGGCTCGCCGGCTCGTCCATACCGCTTACCCGCGGGACGGACTATGAGCTGGAGTATGCTTTAACACCGTTGGACGACTCGGTGACGACCCCGGTGTTTTGCGGGGTGCATCTTATTAACCCTAAACTGCGTGGTGCGGTGGTCTTTGAAGGCCAGATGCTTGGGGGTACGTTTTACAGTGGTTTGATTGAGATGTTGGATGAGCTAGTTAAGGCACTCAACAACCCAACGGCTGCAGATTGGCTGCTTTTAGGTAATCGTCCTTCCCTGTACCCAGCCACCCCTGCAGCGGTAGCTTGGTCGGACATGCTGAATAAAAAGTATGTTGCCTCTGCAGTGCATGATGTGGAGTTAGATGCCGGGGCGGCCAACGAGCAGATTCGTGAAAAGCTTACTGAGCTGAAAGATGCGGTTTTGGGCTTAGGAACTGAAATCGCCACATTTAACTACCCCGGACACATTGCGTCCACTAACCCCCACGGGACTACCGCGGCGCAGGCCGGTGCGCATCCTGTCAACCTGAAAACGCCAGATACTTTCCTGGCGTATGGAAAGACGTTGCGTCAGTTAACCAGCGAGGTCCGTGCACTGGGTCTGCAACAATCGGATATCGACAAGTACATTTCTAAATGGGTATCGAAAGAATCCAAAGGGGTGTTTAATGCGACGATATCCGGTACTCGTGCCCTGTTCCGTTCTCCTGCTGGTGAATCCGAAATTGTGTTCTCTGCTGAGGCATTCACTCTTAAATCTAATGGCTCTGTTGTGTTGGCGTGTGGGTATGCCGACACTACTGGAACCACCCGGTTTATGGAGTGGAAAGCAGGCATCAATACATTACGTATTGAGTCGACTGGCAGTGCCTTGGGGATGGATAAGCTGACGCTTAATGGCACGACGTTACTGACCACAACTGCTCTCATGGGCTATCAACAAGACCCTGGTACCGGCGGTGGTACCGTTGACCCGGATGACAACAAACTGTACATTAGCGGGGTGAACGGCATTACTTTCACGGGTAAAGGGTCAAAAGCCGATCCCGTCACCGGGAAGGTCACAGCCAAACCCGCGACGACCTCTGAACCCGGCGTTGTGACGCTGACTGATAAGCCGAGCGATGTAGTCAAGGGACAAGCAGTCACCCCAGCTTCGCTCTTACCGTACGAGGGTGATCTGTCTTCGTACGTCAGGAAGACAACGCTACTGAATAACCAGCCGATGGACACTGGTAGCCGAACGCTAACGAAAAAGGATTTGGGTCTGGACTTGGCTGATAACACAGCTGACGTCGATAAACCACTTTCTGATGCGTTGGCAGAAGCAGTTACCGGTCTTAGTGATAAAGGTCACCATCACAACTTCGCCGATTTACAGATCCCAACGGCTTCTCAAACAGTTCCCGGTATCGCTCGATATTCTACCAACCTAAACGGCTTGTCAGATAATCGCGGCGTTACCCCGAATGTTCTGTACGATCTGTCAAAACGTTTAGACGTAGTTGCAGCTGCGCTAGCAAACGCGAAAGAGGATTCCGTGGCCGATTTTGCCGCTGTGCGTGGTAAGACTTGGACTGTGGGATCTACACGTACCACCCTCGCCGTAACGGATTTGAATTATTTCTATCTGTTAAATGGTGCACGTAAAGAGGGGACGGTATCTGGTTCGATAGACCTGCAAACCACACCGATGTTCCAGTGGTTCTCTCCAGATAACCGTATGGAAAGAACGTGGCAGAACGCGGTAATTAATACCGGTGCCGGTATTGATTTTAGTGGGTTTGAGGTTGCCGTCCCGGAAACGAACTACGGTGCGCAGATTGGGTTAACGACAACCGGAATGGGTGATTTGTCGGTCGTTAACCTCTTGGCGAAAACGTGGGTTCGTTGCGACTCTGGTAAGCTGCGGATTTGGGTTCGTGGCGGTGGTGCTGTTTCTGTTTATCTGGACGGTGAAATTATCGGTGCGGGTATTACAGAAGCGGGGTATCTGGAGGCGACTGTCAAAGAGGGGTGGAAGCAACACTGCTTAGCATTCCGTGCAGAATGTAACGATAGCGCTAAAGCAGCCGCAATTCGTTTCACAATTTACGACGGTGACTTTGCGGTTGGGGCCTCGGATAAAAACACCAAAGTCGCCCGCCTGCAGGAGTTTGTTAAGACGCCGAACGGTTTAAGGCATTACCTCTATGTGAACATGATAACCGATGCGTTATATTCGCGCGCCGAACCTATTGTGGACACGGAAGGTATTAACTTGGAACGCGGCTATATCGGCCACATTGATGTCCCTGACGCGGGATTGGTTGCAGGCACGACTTACGAGTTTGAAACGACGTTTGACTTCGGCATGGCGTCCGAACTTAAACGGCACTTCGAAACACGTCTAGCACACGGGGTGAGTAACAGCGACTGGTCGTTGACGGATAACCCGAAAATGCTGCCGTTGAATAAGGTTGATCCATTACCTAAACAATGGCTGTATGCGTATCCAACTAACCCGTCTGTTTCTGGGGATAACCTCGTTCGTTTAGATCGTGGGTTATTTGATTATAAATTCGTAAGTGCCACCTCGCTCAGGATTCTTCTTGCGGCGGTTGTTTCCACTGAAAACGCGTCCCCGTATTGCTGGTTTACACCAAGCAACCCGAAAGAAAATGGAATGGCGACATTCGAGGGTTCGGTGGTAATCGACACTGATTATCCTGAAGTCCCAAAAACCTCGGACGTCGAAGTTTCATTAAACTTCATGGCCCCTTCTGCTGATGGGAAAGGTAAAACCAGAGTCCTGCGGTGGAGTAACTCCCGCACCAGTTTAAACTGCGGCTTTATTGCTGCGCCGTACGATAAACCAACTGGAAGAATTGCCACCACACAATCCAGCGTTACTAATACGCTGGTTGATGCACCTCGTGTAATCAAGAGCGTGGATGTTCAGTCGCCTGACTGTTTAGACTATCTCCCGGTTTCAATCGCTAGCGAGTTCGCAGCCATTGGTTCGCGCTGGCTTATTCGTTATCGCTATATTGTTGATACGCAGATACTGCGAATATCGTCGATTAGTAAGATAGGCGGCCAGGCTTCGGCAACTATTCGTGAGATAGAATACGACCTTCCGTTTGACGCGATTGATTATTTTAAAGGCGGCGCTTTATCGATTAGTGTTACTGGCATCGAAACTGGTGAAGGCGTCACAATCAACCACGGTTTGATGGACCCTTCCACAACAGAAGTAGATTTAAATCGTTTCCATTATCTACGCTCGCTATTTGAGTCGTATATTGAGCGTTCTCCGGATAGCCAGTCTTCTGGGCATGAGGAGATGTCGATATCAACCGTCGCGTTCGCGAACTTTGGAGATAACGTCGATAACCCGGTTACGGAATACATCACGATGTCTGCTGCAAGTGAGGGTTATCCGGAACTTGCACCGAACGGTAAACTCCCAGCGCCGTTTTACAAAGGGCTGCAGAAACGTGGTGCTCCGCTACTTGAGTCGGCTCCTGCAGACTATACGTCTAACGGTGGTGAATGGAAGTACGGCTTTATGCGGGCTTATCGCCCGACTCAAAATGAGCGTTTTGTGTCGGTAAATGGGACAATGCTCTCTAACTACCCTGGATATATCATCGTGGGTAGTGAGAAAATTCCGGGTAATGTTATACCTTTCAGTGCATCGACAACAGCTGTTCAGATATCTGGGACTCTTGCCCGCACGAAACCGATGCAGCCAATTCACATCGTGTTCGTGCCTCCGGAAGGTTCTGTGCCGCCGCTGCAAGCGAAGTTCACTATTAATGGCGTGGGCAGTAGCGGTAATCCGATGTTCGTGATTACTGAAACGACACCGGTGGAACTTCGCACTGGTGGCGAGACGATTCTCATTGAGAAGCGTAATCCATTCCATATCCCCACCAGGACATGGGATTGGATTTTACAAACGTTGGATACTGAACGTAGAAACGAAGGCAACAACTCGGGTGAGTGGGCCTCTTAG

Genome Context

Tertiary structure

WFG41560.1
ESMFold2 structure
Source ESMFold2
pLDDT 45.1
Oligomeric state monomer