Genbank accession
AJA73002.1 [GenBank]
Protein name
host specificity protein J
RBP type
TF
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C3 confidence 0,825 truncated
C3 0,825
C1 0,194
D3 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MGLFSRKRKNHTPKEAPETGRSKQIVNIVELLCEGEIEGLVDGFKSIYLDGTQIQNDDGSYNFNNVSGQLNVGTQDQNVLDGYDSSQNEVSVGVEVKKKSGAIVRTVTDERISRLRLTLGVRSLFHQNNQGDTNTTNVDLKITIGTRQYSHSFNGKYSSQYLESVVFDNLPPVPFNISVERVTKDSNSQRLQNGTIWSSYTEIIDTEFTYPNSAVAGISFDSEYFNNIPTRNYLIKAKKVKVPSNYDPVKRTYTGFWDGTFKIAWTNNPAWEIYDLAPILSKMLGVEISFDKWALYDVARYCDQLVPDGMGGMEPRFTCNVWLTEVKTAYDLLNDFCSVFRAIPIWTGTEVSVIIDRPRDPVWTYTNANVVGGFERSYSARKSRHNAVQVTYSDKTNGYESAIEYVSDDEEIKKHGLNLSQVTAFGCTSRGQAYRTGKWILETEKREKETITFTVGREGLMHLPGDIIRVADSHYAGTEIGGRVLAINGRKVTLDREISIDNASYFTYINGEATHSSIKIQSVNGKEITLDSNPTGLEVYGVWSLSTQQITSGLYRSISIVENADGTNTITALQHEPQKEAIVDNAAHFVETARTLYKAPQINAVEVSTGYDGKLYISSDISSGDGKLTYDIKITKDGNLYQFKKGLADPNIELSDLPNGDYSVIIYGKNAKGQIVTEKTQTFTIDRPPAPTGVVVTGGLGQITLEWDWVNEVTQTEIFAAETDNFALAKKIAKVTARTYAHTVRGNKVVRYYWLRHTRGINVGPFYQQQGVRGESAVDLDARLTELNTQLSRNIVDEIFDVAAPARGLELVKTVANLNDKRTKLASSQVYNQADGKLYTWNGTAYSATVAAEDVTGKLSKSKIDTSLISQLTGADNTANLARRLAETAQSNINQEITNRQDAVTAEANNRTKAIQAESANLTKKIQAEATARGAAVTQLQNVDAQQSQLISAVTAKADNALSGLEAEKTARANADKAESQAREALTARMSDAESNIATIQRTVATNAQSISEVSQNLNAKIDNINIGGRNLLRDSEFNAYNKWGNPQIDFTENANRRTIKVTSTGTNGPVGIVSSNRHSTSYFQQGETYTLSLFARGSKALDYLYLMRQDGNNVRLPVINVASETEFNHYKLTFKAPFTTQQGYVLIGFRQTSTEQFVEFHSVKLEKGNVATDWTPAPEDVDSAVSAVSADLTSYKQTQAATDSAQAQQLNQLSVNLTKAETNFNAKITEEKKARVDADKANAERLTDITSRVANAESTITNFQSTKANKSEVASLAQSSLQAVWKADTQSAIGELAVGGRNLLLKSNATNLINFVRSSQDVLDNTDFKTPVVRINCIQDSWFGRKTAITSGKLLAGKYTLSFKYRTNATINNTFIGYGGNQRRRLITSNVVGNETWQTCKLTFETTEDYPDIFIIIGGYGKADVSYIEFAELKLEKGAIATDWTPAPEDVESSVSAVSAKVDSVQQTLANADSALSSRIDTVNASVGSNSSKITQVSNAVASVDGKLSATHTIKTETIAGGRKAIAGIAFGATADNRNAESSVIVMADKFEVVKNAQDGTPVRLFGVVENKVAINGNLIATGSISGDHINANSVRTAVLTAGAIKTEHLAAGQISADKLAIGLGGNLLVNPIFATPDLSIAPFGWNYWRGEVGDRLNIDTRNIFNRNEQDNYGLKNGGLPNELVFSMRYSTTEETSDTGRIGWLSQDINVVPNKKYIASVWLACHRGQAKLVIENIEKPGGAYLGWIGDSEVITGYSANQGEFKNMKRVKVVFTAPTSGCIRFALRLDNIQGKANPFLFARRPMLEEASDNVTDITQPSPWQNAGVTAIHGGSIATNTVTAQQIAANTITANQIAVGTIAARNMAVDSIEARHIVGSSITADKLNVNNLAAISANLGAITAGSININNRFKVSNAGVVEMRANSGNVGMVMNNDSIIVYDEQGRVRVKMGKL
Physico‐chemical
properties
protein length:1954 AA
molecular weight: 213272,75760 Da
isoelectric point:6,34064
aromaticity:0,07574
hydropathy:-0,34806

Taxonomy

Phage
Mannheimia phage vB_MhS_587AP2 [NCBI] · taxon 1572745

Coding sequence (CDS)

Genbank protein accession
AJA73002.1 [NCBI]
Genbank nucleotide accession
KP137435 [NCBI]
CDS location
range 17474 -> 23338
strand +
CDS
ATGGGATTATTTAGTCGTAAGAGAAAAAATCATACTCCTAAAGAAGCACCGGAAACCGGTCGCTCTAAACAGATTGTAAATATTGTGGAATTGCTGTGCGAGGGCGAAATCGAGGGCTTGGTTGATGGCTTTAAATCGATTTACTTAGACGGCACGCAGATCCAAAACGATGACGGCAGCTATAACTTTAATAATGTGAGTGGTCAGTTAAATGTCGGTACGCAAGACCAAAATGTGTTAGACGGTTACGACAGCTCACAAAATGAAGTGAGTGTGGGTGTAGAAGTCAAGAAAAAAAGCGGTGCAATCGTCCGCACCGTTACTGATGAACGCATCAGCCGTTTGCGTTTAACGTTGGGCGTGCGGTCACTATTCCATCAAAATAATCAAGGCGATACCAATACCACCAATGTTGATTTAAAAATCACGATTGGCACACGGCAATATTCGCATAGCTTTAACGGCAAATACAGCTCGCAATACCTTGAATCTGTGGTGTTTGATAACCTGCCTCCTGTACCGTTTAATATCTCGGTTGAACGTGTAACAAAGGATAGCAATTCTCAACGACTACAAAACGGTACAATTTGGAGCAGCTATACCGAAATTATCGACACCGAATTTACTTACCCTAATTCAGCGGTTGCCGGTATCAGTTTTGATTCGGAGTATTTTAATAATATCCCGACCCGAAACTACCTAATTAAAGCGAAAAAAGTCAAAGTGCCAAGCAATTATGATCCAGTTAAACGCACTTACACCGGCTTTTGGGACGGCACATTTAAAATTGCGTGGACGAACAACCCTGCTTGGGAAATTTACGATTTAGCTCCGATTTTAAGCAAAATGCTTGGGGTTGAAATCAGTTTTGACAAATGGGCGTTGTATGATGTTGCTCGCTATTGCGATCAACTTGTGCCGGACGGTATGGGTGGAATGGAGCCTCGTTTCACCTGTAACGTATGGCTCACGGAAGTTAAAACTGCCTATGACTTGTTGAATGATTTCTGCTCGGTATTCCGTGCGATTCCGATTTGGACCGGAACAGAAGTATCGGTCATTATCGACCGTCCGCGTGATCCGGTTTGGACTTACACAAATGCTAATGTAGTTGGTGGATTTGAACGATCCTACTCTGCTCGCAAATCACGCCATAATGCAGTGCAAGTTACTTATTCGGATAAAACAAATGGCTATGAAAGTGCGATTGAATATGTCTCTGATGACGAGGAAATCAAAAAGCACGGCTTAAATTTAAGCCAAGTAACTGCCTTTGGCTGTACATCTCGTGGGCAAGCATACCGTACCGGCAAATGGATTTTAGAAACCGAAAAACGTGAAAAAGAAACCATCACTTTTACCGTGGGGCGTGAAGGCTTAATGCACTTGCCGGGCGATATTATTCGTGTGGCAGACAGCCATTATGCCGGTACGGAAATTGGCGGACGTGTACTGGCGATTAATGGGCGAAAAGTCACGTTAGATCGTGAAATTAGCATTGATAACGCCAGTTATTTTACCTATATCAACGGTGAGGCAACGCACTCTAGCATTAAAATCCAATCGGTAAACGGTAAAGAAATCACGCTAGACAGTAATCCAACAGGACTAGAAGTTTATGGGGTGTGGTCGTTATCTACCCAACAAATTACCTCAGGTTTATATCGCTCTATCTCGATTGTTGAAAATGCGGACGGTACGAATACGATTACGGCATTGCAACACGAACCGCAGAAAGAGGCGATTGTAGATAACGCTGCTCACTTTGTGGAAACGGCGAGAACGCTTTACAAAGCCCCGCAAATTAACGCAGTAGAAGTCTCGACTGGTTATGACGGCAAGCTCTATATCTCCAGTGATATTAGTTCTGGCGACGGCAAGCTGACCTATGATATTAAAATCACCAAAGATGGCAATTTGTATCAATTCAAGAAAGGATTAGCCGACCCAAATATTGAGTTGAGCGATTTACCGAATGGCGATTACAGCGTGATTATTTACGGTAAAAATGCCAAAGGGCAAATCGTCACCGAAAAAACACAAACCTTTACTATTGATCGACCTCCAGCTCCGACCGGTGTAGTAGTAACAGGTGGATTAGGGCAAATTACCCTCGAATGGGATTGGGTAAATGAGGTTACGCAAACCGAGATTTTCGCAGCGGAAACTGATAATTTCGCCCTTGCAAAAAAAATCGCAAAAGTGACCGCTAGAACCTACGCTCACACGGTAAGAGGTAATAAGGTTGTACGCTATTATTGGCTACGTCATACCAGAGGGATTAATGTCGGCCCGTTTTACCAACAACAGGGGGTAAGAGGCGAAAGTGCGGTTGATTTGGATGCTCGATTAACCGAATTAAACACTCAGCTATCACGCAATATTGTTGATGAGATTTTTGATGTTGCTGCACCGGCACGAGGTTTAGAGCTGGTCAAAACTGTGGCAAACTTGAACGATAAGCGGACGAAACTGGCGTCATCTCAAGTTTACAATCAGGCTGACGGCAAGCTCTATACTTGGAACGGTACAGCATACTCAGCTACAGTGGCTGCGGAAGATGTTACCGGCAAATTATCAAAATCTAAAATTGATACGTCCCTTATTTCGCAATTAACAGGTGCAGATAACACCGCAAATTTGGCAAGAAGATTAGCGGAAACAGCTCAAAGCAACATTAACCAAGAGATTACTAACCGACAAGATGCCGTTACTGCCGAAGCAAATAACCGTACTAAAGCCATTCAAGCTGAAAGTGCGAATTTAACGAAAAAAATTCAAGCTGAAGCAACCGCTCGTGGGGCTGCTGTTACACAGTTACAAAATGTTGATGCTCAACAATCACAACTGATTTCTGCTGTCACAGCAAAAGCTGATAATGCCTTATCCGGTTTGGAAGCAGAAAAAACAGCTCGAGCAAATGCTGATAAAGCTGAATCACAAGCCCGTGAAGCATTAACAGCAAGAATGAGTGATGCGGAAAGCAATATTGCAACTATTCAACGTACGGTAGCAACTAATGCCCAAAGCATTAGTGAAGTCAGTCAGAATTTAAATGCTAAGATTGATAATATTAATATCGGAGGTCGGAATTTATTAAGAGACAGCGAGTTCAATGCGTACAATAAATGGGGTAATCCACAGATTGATTTTACAGAAAATGCAAATCGTCGAACTATCAAAGTAACCTCAACAGGTACTAACGGTCCTGTTGGTATTGTTTCATCTAATCGCCATTCCACATCTTATTTCCAACAAGGAGAAACTTATACACTCTCATTATTTGCTCGAGGAAGTAAGGCACTAGACTATCTCTATCTAATGCGTCAAGATGGGAATAACGTTAGATTACCAGTGATTAACGTTGCCTCTGAAACTGAGTTTAATCATTACAAACTCACGTTCAAGGCTCCTTTTACCACGCAACAAGGTTATGTCTTAATCGGTTTTCGGCAAACCAGCACAGAGCAGTTTGTTGAGTTTCACAGCGTCAAACTTGAAAAAGGCAACGTAGCCACAGACTGGACGCCAGCACCTGAAGATGTGGACAGTGCGGTTAGTGCTGTTTCGGCTGATTTAACGAGTTATAAACAAACTCAAGCGGCTACCGATTCAGCACAAGCACAGCAACTTAATCAGTTATCTGTGAACTTGACCAAAGCAGAGACTAATTTCAACGCCAAAATCACGGAAGAAAAAAAAGCTCGTGTTGATGCAGATAAAGCGAATGCAGAGAGGCTCACAGACATAACAAGCCGTGTTGCAAATGCGGAATCAACTATTACCAATTTCCAATCAACCAAAGCGAATAAAAGTGAGGTTGCGAGCCTTGCACAAAGTTCGTTGCAGGCAGTTTGGAAGGCAGATACACAATCAGCGATTGGCGAGTTGGCTGTCGGTGGAAGAAATTTATTATTAAAATCCAACGCAACAAACTTAATCAATTTTGTCAGATCATCTCAAGATGTATTAGATAACACTGATTTCAAAACTCCAGTAGTACGAATCAACTGTATACAAGATAGTTGGTTTGGTCGAAAAACAGCGATTACATCGGGAAAATTGCTTGCTGGTAAATACACTCTATCGTTTAAGTATCGCACCAACGCTACAATTAATAATACTTTTATTGGTTATGGAGGCAATCAGCGCAGACGGCTTATCACATCAAATGTTGTCGGTAATGAGACATGGCAAACTTGCAAGCTCACATTTGAGACAACCGAGGATTACCCTGATATATTTATCATTATTGGTGGTTATGGTAAGGCGGATGTAAGTTATATTGAATTTGCCGAGCTGAAACTAGAGAAAGGCGCTATCGCTACAGATTGGACACCAGCACCGGAAGATGTGGAAAGTTCTGTAAGTGCAGTATCTGCAAAAGTAGATTCGGTTCAACAAACGCTGGCAAATGCAGATTCAGCACTAAGCTCTCGCATTGATACGGTCAATGCCTCAGTCGGATCAAACTCATCTAAAATTACCCAAGTCAGCAATGCGGTAGCAAGTGTGGACGGCAAATTATCTGCTACCCATACCATCAAAACCGAAACCATTGCCGGTGGACGCAAAGCGATTGCCGGTATTGCATTTGGTGCAACGGCAGATAACCGTAATGCGGAATCTTCTGTGATTGTGATGGCAGATAAATTTGAGGTCGTGAAAAACGCCCAAGACGGCACGCCAGTAAGACTATTTGGCGTGGTAGAAAATAAAGTAGCGATTAATGGGAATTTAATCGCAACAGGCTCGATTTCAGGAGACCACATCAATGCAAATTCCGTCAGAACTGCTGTATTGACTGCAGGAGCGATTAAAACGGAGCATTTGGCAGCAGGGCAAATATCGGCGGATAAGTTAGCGATTGGGCTAGGTGGGAATTTGCTGGTTAATCCTATTTTTGCAACACCCGATTTGTCAATAGCTCCGTTTGGCTGGAACTACTGGCGAGGAGAAGTTGGTGATCGGCTAAATATTGACACCCGTAATATTTTCAATAGGAATGAACAAGATAATTACGGACTAAAAAATGGAGGACTACCAAATGAGTTAGTATTTTCGATGCGGTATAGCACTACAGAGGAAACCTCTGATACTGGGCGAATTGGGTGGTTATCTCAGGATATTAATGTTGTGCCTAATAAAAAATATATTGCCTCCGTATGGTTAGCTTGTCATCGTGGGCAAGCTAAATTAGTCATTGAGAATATCGAAAAACCTGGTGGTGCTTACTTAGGTTGGATAGGCGACAGCGAGGTAATTACTGGCTATAGTGCTAATCAAGGCGAATTTAAAAATATGAAACGGGTTAAGGTTGTATTTACTGCACCTACTTCAGGCTGTATTCGTTTCGCATTACGATTAGATAATATTCAAGGTAAAGCTAATCCATTTTTATTTGCTCGTAGACCAATGCTTGAGGAGGCTAGTGATAATGTTACAGATATCACTCAGCCTAGCCCTTGGCAAAATGCCGGTGTAACCGCTATTCACGGTGGCTCAATAGCTACTAATACCGTTACTGCTCAACAAATTGCAGCAAATACCATTACCGCCAACCAAATCGCAGTCGGCACGATTGCTGCACGCAATATGGCGGTAGATTCGATTGAGGCTCGTCATATTGTGGGGAGTTCGATCACTGCGGATAAGCTAAATGTAAACAATTTAGCAGCAATATCGGCAAATCTCGGAGCTATTACAGCTGGTTCTATTAACATCAATAATAGATTCAAGGTAAGTAATGCTGGAGTAGTCGAAATGCGAGCCAATAGTGGAAATGTTGGTATGGTAATGAATAACGATAGTATTATTGTTTATGATGAACAAGGTAGGGTTAGAGTAAAAATGGGGAAATTATGA

Genome Context

Tertiary structure

AJA73002.1
ESMFold2 structure
Source ESMFold2
pLDDT 65.4
Oligomeric state monomer