Genbank accession
QQO38687.1 [GenBank]
Protein name
minor structural protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,66
TF
Evidence RBPdetect2
Probability 0,88
Protein sequence
MVKQVIASAQITLTDLGDAIISGTKPTNPKLDQLWIERLTGKPDKLWRWNGTSWIEQTLDLSALDPDADGKIENHETTIGNMVDDAKLDVTERQEVKNKLSPLIGQAVLDSDASIPSAFQLWQNGVGEVWAVRKAAQNVGITNADPAYLAVETTYNALQAYLNGMTPIKPWDASAANKDKIITVVPTDWRNKWVDYYKAVQSLTIAVQTKLQGNIDAIDVSSRNLLNGTATPTTAIGENRTNQTWTPYFFAAGNSKTINDASTFCMSFDWVIEGTAAGTLNVQGNNPYPALATTVTFSASNNKGRVSGVRSIPNGTGTFTGVNFRLDNFPVGSKITISNVKIETGNKPTGWTPSPEDVAKAIEDADKKAQLVTESVNDMSLDSKLTPVEKIQLKTDYDSITAEFTTTLNSADAFNLTSSSERAAYNTAYNALKTFVDPLLVKMNETSGVDRAAFRQRFKDYYDTKAKLLKKISDTSKGLIDDSAKQTPNIILNSGFLQGTKFWDNLPTGVSLDTSIDLGGIPVIKVIQSGNQDNIYRGANTQLYPAPFDSNITFSIYSFAPNLANIDSGLVVEIKTYDKDKNRITPSTWAVECTPSKSGVWERFSRTISISGNKDIKYINFFFYVRKNGTAYFAKPMLQIGNALGNWSPNPADVFADTIDTKAEESKNAIADMSSDNKLTPLEKVQLKKEWGTIAAEKPQFEALGKSYYNASSELNAYINAYNTLNNTLNGTTGYLKNMASTDTINGATFRSQFDTYYAKQAELIKKVNNLIQGNIDGIQGVKNLILASKRAINSNDYLLNDFTITEDFVAGQDYTFVVKGTVTAGQKFGIWQNGGATNVGYAEVEFIKDVYYVSFKAVATTAGNARSLRLYNFPSNTTNATVEWVALYKGTKPFDWTAAPEDADVGKTNLVIDSEFKYLASWIQPNPSFFKTETGIMPNGVKNVTLSINSTDGTNKYADFAQFIEVEPNTEYTFSCKAGGTFQTFLWEKKADKTPTNVYKDNAKSHGGASWDMSSPRDTFTRTIKTQPDTKYIHFIFRVQSNTTTYVSGRLALPQLEKGTTASEWKPNPFDTSNGEIFIQGSATDITDGNRKLTVNGNVIYNSNAGRGLRLVTLKKDTLAVVDDITYDVYGSDVPKNDLATKINSLGNDVFITLTSYDAVNFNTNLLTALVSVGASGTILQGRLPYAFIGMKGLGRYNGLEQWTGLGNMFPPATISCKVVNGMIQGINNNNGQSDANVRKDLRLNAPLPTSILMDSNGITASGTDASKYARLDYRGLYIAGGAIQIDGGLSEGQLAQGVTRKMSYLDSNGLYTGQVNIGGSGQNGILSIKNSSNSEIVRGDTNGLTVNNGAITIKRPDGANLIINGMAAYNFAVTTHNPPFRGDNIDTRSWYYHTTKGIPFNRDLQVCDYVATQHTGRYMKMDVDFYTSPSNSGALVVIQAGKYNSGGQEVIVSQIEITNTTPQTNYTLSIDCGVPTYQRIGFYFCLASWSAGDVYARLVRAWMEG
Physico‐chemical
properties
protein length:1507 AA
molecular weight: 164739,55970 Da
isoelectric point:5,92384
aromaticity:0,09821
hydropathy:-0,33981

Domains

Domains [InterPro]
DC_0015
STR
356–666
DC_0904
STR
1188–1507
QQO38687.1
1 1507
Architecture
STR
STR
STR 3-1048 | STR 1069-1507
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage BCPST
[NCBI]
2801506 Uroviricota > Caudoviricetes > Sejongvirinae > Yihwangvirus BCPST >
Host Bacillus cereus
[NCBI]
1396 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QQO38687.1 [NCBI]
Genbank nucleotide accession
MW392802 [NCBI]
CDS location
range 43037 -> 47560
strand -
CDS
ATGGTAAAACAGGTTATCGCTTCAGCACAAATAACATTAACAGACTTAGGCGATGCAATAATTTCAGGTACAAAGCCTACTAATCCTAAACTGGATCAGTTATGGATTGAACGTTTAACTGGTAAACCTGATAAGTTATGGCGATGGAATGGGACAAGTTGGATTGAGCAAACATTAGATTTAAGCGCATTAGACCCTGATGCTGATGGTAAGATTGAGAATCACGAAACCACTATTGGAAATATGGTTGACGATGCAAAACTTGATGTAACAGAACGTCAAGAGGTTAAAAATAAATTAAGTCCTTTGATTGGTCAAGCTGTATTGGATAGTGATGCTTCTATCCCTTCAGCTTTCCAATTATGGCAAAATGGAGTTGGTGAAGTTTGGGCTGTTCGTAAAGCCGCTCAAAACGTAGGTATCACTAACGCTGACCCTGCTTATTTAGCGGTAGAAACAACTTACAATGCGTTGCAAGCTTACCTTAATGGAATGACACCTATTAAGCCTTGGGATGCTTCAGCAGCTAATAAAGATAAGATTATCACTGTCGTTCCTACTGATTGGAGAAATAAATGGGTTGATTATTATAAAGCTGTACAGTCATTGACTATAGCTGTTCAAACTAAGTTACAAGGTAATATAGATGCTATAGATGTTAGTAGTCGTAACTTATTGAATGGAACAGCTACACCAACAACTGCAATAGGCGAAAATAGAACTAACCAAACGTGGACTCCTTATTTTTTCGCTGCTGGTAATTCTAAGACTATAAATGATGCTTCAACATTTTGTATGTCGTTTGATTGGGTCATAGAAGGTACGGCTGCTGGAACATTAAACGTTCAAGGTAACAATCCATATCCAGCTCTCGCTACTACAGTTACTTTTTCTGCATCGAATAACAAAGGTCGTGTTTCAGGTGTGAGAAGCATACCGAATGGTACAGGAACATTTACAGGAGTCAACTTCCGTCTAGATAATTTCCCTGTAGGCTCTAAAATAACTATTTCAAATGTTAAAATCGAAACTGGAAACAAACCTACTGGTTGGACTCCATCGCCTGAAGATGTGGCGAAAGCTATTGAAGATGCAGATAAGAAAGCTCAATTAGTTACTGAATCAGTAAATGATATGTCTTTAGATAGTAAATTAACACCAGTTGAGAAAATCCAATTAAAAACTGATTATGATTCAATTACTGCTGAGTTCACTACTACTCTAAATAGTGCTGATGCATTTAATTTGACTTCATCATCGGAAAGGGCTGCATACAATACAGCTTATAACGCGTTAAAAACTTTCGTTGATCCATTGTTAGTTAAAATGAATGAAACTTCAGGTGTAGACCGCGCTGCATTTAGACAAAGATTCAAAGATTACTATGATACTAAAGCTAAGTTGTTAAAGAAGATTTCTGATACTTCAAAAGGATTGATTGATGATTCAGCAAAACAAACACCAAACATTATACTCAATAGTGGATTTTTGCAGGGTACAAAGTTTTGGGACAACTTACCTACAGGTGTATCATTGGATACAAGTATTGATTTAGGTGGAATACCTGTAATAAAAGTTATTCAATCAGGAAACCAAGACAACATTTATAGAGGTGCTAACACTCAATTATACCCAGCTCCATTTGATTCTAATATTACATTTAGTATTTATTCTTTCGCTCCTAACTTAGCTAATATTGATTCAGGACTTGTTGTTGAAATAAAAACTTATGACAAAGATAAGAACAGAATAACCCCTTCTACATGGGCTGTAGAATGTACACCTAGCAAAAGTGGAGTTTGGGAAAGATTCAGCAGAACTATTTCTATAAGTGGAAATAAAGATATAAAATATATAAATTTCTTTTTCTACGTAAGAAAGAATGGTACAGCTTATTTTGCTAAACCGATGTTACAAATAGGTAATGCATTAGGAAATTGGAGTCCTAATCCGGCCGATGTTTTCGCTGATACAATAGATACAAAAGCTGAAGAAAGCAAAAACGCTATTGCAGATATGTCTAGTGATAACAAATTAACTCCTTTAGAAAAAGTTCAGTTAAAGAAAGAATGGGGTACAATCGCTGCTGAGAAACCTCAATTTGAAGCTTTAGGTAAAAGTTATTACAATGCTTCTTCTGAACTTAACGCGTACATCAATGCTTACAATACGTTGAACAATACGTTGAATGGAACTACTGGTTATCTAAAGAACATGGCTTCTACAGATACAATCAATGGCGCTACATTCCGCTCTCAATTCGATACGTATTACGCGAAACAAGCTGAGTTAATAAAGAAAGTTAATAATCTAATCCAAGGTAATATTGATGGTATTCAAGGAGTTAAGAATTTAATACTTGCTTCCAAAAGAGCTATCAATTCTAATGACTACCTTCTGAATGATTTTACTATTACAGAAGATTTTGTTGCTGGACAGGATTACACTTTCGTTGTTAAAGGAACTGTTACTGCTGGTCAAAAATTCGGTATATGGCAAAACGGCGGTGCTACTAACGTAGGTTATGCTGAAGTTGAATTTATTAAAGATGTTTATTACGTTTCATTCAAAGCTGTTGCAACTACAGCAGGAAACGCACGTTCTTTACGATTATATAATTTCCCTAGCAACACAACTAATGCTACAGTTGAATGGGTTGCGTTGTATAAAGGAACTAAACCTTTCGATTGGACGGCCGCTCCTGAAGATGCTGATGTAGGAAAAACTAATTTAGTTATTGATTCTGAATTTAAATATTTAGCAAGTTGGATTCAACCAAATCCTAGTTTCTTCAAAACAGAAACCGGAATAATGCCTAACGGCGTAAAAAACGTAACACTTTCAATTAACAGTACTGACGGAACTAATAAGTATGCTGATTTTGCTCAATTCATTGAAGTAGAACCGAATACAGAATATACTTTCTCATGTAAAGCTGGCGGTACTTTCCAAACATTCTTATGGGAGAAGAAAGCTGATAAAACACCAACTAACGTTTATAAAGACAATGCTAAATCTCATGGTGGTGCTTCATGGGACATGTCATCACCACGCGATACATTCACAAGAACAATCAAAACTCAACCTGACACTAAGTATATTCATTTTATCTTCAGGGTTCAAAGTAACACAACAACTTATGTTAGTGGTCGTTTGGCGCTTCCGCAATTAGAAAAAGGAACTACAGCTAGTGAATGGAAACCTAATCCGTTTGACACTTCTAATGGTGAAATTTTTATTCAAGGTTCTGCTACTGATATAACTGATGGAAACAGAAAGTTAACAGTTAATGGAAATGTTATTTACAATAGTAATGCAGGTCGTGGATTAAGGCTTGTCACGTTAAAGAAAGATACATTAGCTGTTGTAGATGATATCACATATGATGTATATGGTTCTGATGTTCCGAAAAATGATTTAGCAACAAAGATTAACTCATTAGGGAATGATGTATTCATAACTTTAACTTCTTACGATGCAGTTAACTTCAATACCAATTTATTAACGGCTCTTGTTTCGGTTGGGGCTTCAGGTACTATCTTACAAGGACGTTTGCCTTATGCATTTATCGGTATGAAAGGTTTAGGTCGTTACAACGGATTAGAACAATGGACAGGTCTTGGTAACATGTTCCCTCCTGCTACTATAAGCTGTAAAGTTGTTAATGGAATGATCCAAGGAATCAATAATAATAATGGACAATCTGATGCTAACGTTCGTAAAGATTTACGTTTAAATGCTCCCTTACCGACAAGTATCCTCATGGATTCGAATGGTATAACAGCAAGTGGTACTGATGCAAGTAAGTACGCACGTTTAGATTATCGTGGTCTTTATATCGCTGGTGGAGCTATTCAAATTGATGGTGGTCTTTCTGAAGGACAACTCGCACAAGGTGTTACGAGAAAAATGTCGTATCTAGATAGTAATGGTTTATACACTGGACAGGTAAACATTGGTGGTTCTGGTCAAAATGGTATATTGTCCATTAAGAATTCTTCCAATAGTGAGATTGTCCGTGGCGATACAAACGGCTTAACTGTCAATAACGGCGCTATAACAATTAAACGTCCTGATGGAGCTAACTTGATTATAAATGGTATGGCTGCTTATAACTTCGCTGTAACAACGCATAATCCACCTTTCCGTGGTGACAACATTGATACAAGGTCATGGTATTACCACACAACGAAAGGAATTCCGTTCAATCGTGACTTACAAGTTTGTGATTATGTAGCAACTCAACATACAGGAAGATATATGAAAATGGATGTTGATTTTTACACTTCACCTAGTAATTCAGGAGCTTTAGTAGTCATACAGGCTGGTAAATATAATTCAGGCGGTCAAGAAGTTATTGTTTCTCAAATAGAGATAACTAATACAACTCCACAAACTAATTATACTTTAAGTATAGATTGCGGTGTTCCGACTTATCAAAGGATTGGCTTCTATTTCTGTTTAGCTTCTTGGAGTGCTGGTGATGTATACGCGCGTTTAGTTAGAGCTTGGATGGAAGGTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
eb0ab329db301d64bc537c59ae2e0b74822b2497876ea3561c6a7ad579c9a3df
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,8226
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50