Genbank accession
QIQ68020.1 [GenBank]
Protein name
putative tail fiber protein
RBP type
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MQNTELHIIDFKTQSIVATFQDQDYWDDMREWELKNNVDILEFKVFDGTRQAIALQQQNLVLRQDREGNVIPYTIEDEVEKTAKDRSITVRAVGSWTGLRKAGFIRPQKLEGLTAHQYVSLATAGTKWQPGNIAYASFRTMTLDEFTDPLTLLKKVATLFNLELNYRVEVDGNTITGWFVDLVEKVGRVTRKEIELGKDLINVTRIEHTKNICTALIGFARGEDNEVITIEKINNGSPYIVDNEAFQRWSENGQHKFGFYQPETEGEIDAKRLMSLMKTEMEKRKNSSVGYEVDALDIAEVFGLRHELIMKGDTIGIKDTAFIPALYLEARAIGGKESNTNPDRNKYTFGEYHEIVDYDAEMRRMYNRVQGLLENKAGKPMLDQLNKLVQEQEKKMNEVVETNQRVTEITEKLEEMVTNNSVTIHDGPNAPTEGLKEGKSLWLDTSNGKPGILKIWRGGKWEAVTEDFSGLEKEIRDQVAKDVDEKTKQLNKSVSDMEARAGEVEKKAEALDKEVKDLKGGYQSLDKITKEIKETERGTQETLQQLKVNGEKVDQTIISIGKSLDGFNQSISQIKKDAEATSKTIVQQQQTLNGFDQSIKNLVKKDSEINETLVQQQQTINGFTNEISQLKKTDGELKETTVKQQQTINGISNSIAEVNKNISGQSQKINTLESTVDGNKRLIQSVEKDLTATKNDFTKQTTEIKEKAGEISTKLEKVEARTVGGENWFIYTGPNEKPQTIGMLAGALVNKAKFAVQPGEYIVLECSDHTDSFYQFHLDNTKMGDYEKGKDMTVSLDLQNDVHVDFILFQFINGAWSENVQKGIPASNVWKRESWTFNIDTRATGWGLRLRFARNTNSVGKRIRMKKTKLEKGSVPTDFSKSTYELEQSFNGVKERIEKTESIVNDAGDRNYVRNGDFTHYWADNGLGWDKALNGNLRAGNWGTGYNAGVVNATKGYHMHVNDKKFGYPVIAVINKNAPIVGAKRWLGIAQEMPPSFKNDFQPGDNVTISLDVWTETTNNKLAVGLHHFIEGNNSQSFHSGGTPELTINPIKKWVRVHTTVKLHAKTEMKKAFSLYVYGDRSPDGHECYFKNVSIIKGSMPKAFAPSPEDGVKEVLFNQKVVEITKDADGIKSNVKNLTDLTTKHGQQITSSETKIKQLSDEVSAKMTSKQVQDYVAGVGATNILRNAGLRTDMKTLYFGLTSGTVVDVNSKFGGQNTFWSVKTGRTADDWQGAISNRYPCQGGENFVASGWFSTDNASTIDNGVFMEVEHFDAKGTRVKTDRVQVQGISPTWQKVVLPFTMHANAVNVTWRFYVQRNGRARVALPMLQRGKVASEFQLNPADISDVDALREDIAQRIATEQFNKVVTEINREIKANKDGILLKADASKVYTKQQSDGTFAKESHVKTLEGKISVNEKNINLSVKENNIIAKINVTKETILLDAKRINLVGAITAQHFQANTIKGVKYESHNPKDATNRVVIENSVVKSFGPLDKARNVQNYAELKEGGLHVYEVAPNGSPYGGKHVEVLPGRLNVTSDRWSSAIEPSEFRIWAPGNLMTIALGEVPLGENGYGMRLTAPEGIFVKSTLGNTRPTIQFEPSDAIYFDGFGNIVGGKYSKDWATFSIKDGQGRTKYITGIGNGSAQTTEYNSYGGGHAFNHNGTRLFATWIQGANFIQQFGGHAIFKWQHSANRFEFRTGNDGGWVNASAGSFQNASSLVWKKDINNFEGSALEIIMGTNIMTYRYKNVELEPFVDVDGKVIESNHEMGEAVGPVRVGVISEFAPKLITNEDGSAVDLYAMISLGWKGIQENQKAIQDKDKRLNDQETRIKDQEVTIKNQSDRISNLETKLNQVLELLGKE
Physico‐chemical
properties
protein length:1860 AA
molecular weight: 208148,67740 Da
isoelectric point:6,43067
aromaticity:0,08118
hydropathy:-0,57430

Domains

Domains [InterPro]
IPR047149
Unmapped
385–703
Coil
Unmapped
494–514
Coil
Unmapped
613–633
QIQ68020.1
1 1860
Architecture
STR
STR
CHP
STR
STR 1-1108 | STR 1139-1437 | CHP 1716-1795 | STR 1796-1853 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage vB_BceS_KLEB30-3S
[NCBI]
2719180 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Bacillus cereus
[NCBI]
1396 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QIQ68020.1 [NCBI]
Genbank nucleotide accession
MT136606 [NCBI]
CDS location
range 13882 -> 19464
strand +
CDS
ATGCAAAATACCGAACTTCACATAATAGATTTTAAAACACAATCAATCGTGGCAACATTCCAGGATCAAGATTATTGGGATGATATGCGCGAGTGGGAATTAAAAAACAATGTTGACATTCTAGAATTCAAAGTCTTTGACGGGACGCGCCAGGCTATAGCATTACAGCAACAAAACTTAGTGTTGCGCCAGGATCGTGAAGGAAATGTAATTCCGTACACTATCGAAGACGAAGTTGAAAAAACGGCAAAAGATCGTTCTATTACAGTTAGGGCGGTCGGATCATGGACAGGATTAAGAAAAGCTGGCTTTATTCGTCCACAAAAGTTAGAAGGATTAACAGCCCACCAATATGTTAGCCTTGCAACTGCTGGCACTAAGTGGCAACCAGGAAACATTGCATACGCGTCTTTCCGAACAATGACGTTAGATGAGTTTACCGATCCTCTAACTCTATTAAAGAAAGTTGCAACTCTATTTAACTTAGAATTGAATTATCGCGTAGAAGTGGACGGAAACACAATAACAGGTTGGTTTGTCGATCTAGTTGAAAAGGTTGGACGCGTTACACGAAAAGAAATTGAATTAGGTAAAGACTTGATCAATGTAACTCGTATTGAACACACAAAAAACATTTGTACGGCCCTAATCGGTTTCGCGCGTGGTGAAGATAATGAAGTGATCACAATTGAAAAGATCAATAACGGATCACCTTACATTGTTGATAATGAAGCATTTCAGCGCTGGAGTGAGAACGGCCAGCATAAATTCGGATTCTATCAACCAGAAACAGAAGGAGAAATTGACGCTAAACGTTTAATGTCTCTTATGAAAACTGAAATGGAGAAAAGAAAGAATTCTTCAGTTGGTTATGAAGTAGACGCATTAGATATTGCTGAAGTGTTTGGCCTACGTCATGAATTAATCATGAAAGGTGATACGATCGGAATTAAAGACACGGCGTTTATACCTGCTTTGTATTTAGAAGCGCGAGCGATCGGCGGGAAAGAGTCTAACACTAATCCAGATAGAAATAAATATACTTTCGGTGAATATCATGAGATCGTTGACTATGACGCGGAAATGAGAAGAATGTATAACCGCGTTCAAGGGTTACTTGAAAATAAAGCTGGTAAACCTATGTTAGATCAGCTAAACAAGTTAGTACAAGAACAAGAAAAGAAAATGAATGAAGTTGTAGAAACTAACCAACGTGTAACAGAGATCACAGAGAAGTTAGAAGAAATGGTTACTAACAATTCAGTTACGATCCATGACGGGCCAAACGCGCCAACTGAAGGATTGAAGGAAGGAAAGTCTTTATGGTTGGACACTTCAAACGGAAAACCTGGCATTCTGAAAATCTGGCGTGGCGGTAAATGGGAAGCTGTAACAGAAGATTTTTCTGGACTAGAAAAGGAAATCCGTGACCAGGTCGCTAAAGATGTAGACGAAAAGACAAAACAATTAAACAAAAGTGTATCTGATATGGAAGCGCGTGCTGGAGAAGTTGAAAAGAAAGCTGAAGCACTAGACAAAGAGGTCAAAGACTTAAAAGGCGGTTATCAATCTTTAGACAAGATCACAAAAGAGATCAAAGAAACGGAACGCGGTACACAAGAAACGTTACAACAATTAAAGGTTAACGGCGAAAAAGTTGATCAAACAATTATTAGTATCGGAAAATCGTTAGATGGTTTCAATCAATCTATTAGCCAGATCAAAAAAGATGCTGAAGCAACTAGCAAAACAATTGTACAGCAACAACAAACGTTAAATGGTTTTGATCAATCTATTAAAAACCTGGTAAAGAAAGATTCAGAGATTAATGAAACGTTAGTACAGCAACAACAAACAATTAACGGTTTCACAAATGAAATTAGTCAGTTAAAGAAAACAGACGGCGAATTAAAAGAAACAACTGTTAAACAGCAACAAACAATTAACGGTATTTCAAATTCTATTGCTGAAGTCAATAAAAATATTAGTGGCCAGTCACAAAAGATCAATACATTAGAAAGTACAGTTGACGGAAACAAACGATTGATCCAGAGTGTAGAAAAAGATTTAACGGCAACAAAGAACGATTTCACAAAACAAACAACAGAGATAAAAGAGAAGGCTGGCGAAATATCCACAAAGTTAGAAAAGGTTGAAGCGCGCACTGTAGGTGGTGAAAACTGGTTTATTTATACAGGCCCTAACGAAAAACCGCAAACGATAGGAATGTTGGCTGGTGCATTAGTAAACAAAGCTAAATTTGCTGTACAGCCTGGTGAATATATCGTTTTAGAATGTTCGGATCATACCGACTCTTTCTATCAATTTCATTTAGATAATACGAAAATGGGCGATTATGAAAAAGGGAAAGATATGACTGTATCCCTTGATTTACAGAATGACGTTCATGTTGACTTCATTTTATTCCAGTTTATCAATGGTGCATGGAGTGAAAACGTTCAAAAGGGCATCCCTGCATCAAATGTATGGAAACGCGAGTCGTGGACATTCAACATTGACACACGCGCCACGGGTTGGGGATTAAGATTAAGATTTGCCAGAAATACAAATTCTGTAGGCAAAAGAATTCGTATGAAAAAAACTAAACTTGAAAAGGGATCAGTACCGACAGACTTTTCAAAGTCAACTTATGAACTAGAACAAAGTTTCAACGGCGTAAAAGAGCGTATTGAGAAAACGGAATCCATCGTTAATGACGCTGGAGATCGCAATTATGTACGAAACGGGGATTTTACACACTATTGGGCTGACAATGGCCTGGGATGGGACAAGGCCCTAAACGGTAATTTACGTGCTGGCAATTGGGGAACAGGCTATAACGCTGGCGTTGTCAATGCTACAAAGGGTTACCATATGCATGTTAACGATAAAAAGTTCGGTTATCCTGTAATAGCTGTAATTAACAAGAACGCTCCAATTGTAGGCGCTAAAAGGTGGCTAGGTATAGCGCAAGAAATGCCACCTAGCTTTAAAAACGATTTCCAGCCAGGTGATAACGTCACAATATCTTTAGATGTTTGGACAGAAACGACAAACAATAAACTGGCGGTAGGGTTACACCACTTTATAGAGGGTAACAATTCACAAAGTTTCCATAGTGGAGGTACACCAGAGTTAACGATCAACCCTATTAAAAAGTGGGTTCGCGTTCATACTACAGTAAAACTACACGCTAAAACAGAAATGAAAAAAGCATTTAGTTTATACGTTTACGGCGATAGATCACCAGACGGTCATGAGTGTTACTTCAAAAATGTTTCTATTATAAAAGGATCAATGCCGAAAGCGTTCGCGCCGTCACCAGAAGATGGAGTGAAAGAAGTATTATTCAATCAAAAAGTAGTAGAGATCACGAAGGACGCTGACGGCATCAAGTCGAACGTGAAAAACTTGACTGATCTAACAACTAAGCATGGCCAACAGATAACGAGTTCAGAAACAAAAATAAAACAATTGTCTGATGAAGTGAGCGCAAAAATGACGTCTAAACAGGTTCAAGACTACGTTGCGGGCGTTGGCGCTACTAACATTCTACGTAACGCGGGATTACGAACGGACATGAAAACATTGTATTTCGGTTTGACGAGCGGAACTGTAGTTGATGTGAACAGCAAGTTTGGTGGTCAAAATACTTTCTGGAGCGTAAAAACGGGCCGTACCGCTGACGATTGGCAAGGTGCTATTTCTAATAGATACCCGTGTCAAGGCGGTGAAAACTTTGTAGCGTCTGGTTGGTTTTCTACAGATAACGCAAGCACTATTGACAACGGTGTTTTCATGGAAGTGGAACATTTTGACGCTAAAGGAACTAGAGTGAAAACAGATCGCGTACAAGTGCAAGGTATAAGCCCTACATGGCAAAAAGTTGTATTACCGTTCACGATGCACGCTAACGCTGTTAATGTTACATGGAGATTCTATGTTCAAAGAAACGGCCGTGCGCGTGTAGCGTTACCGATGTTACAACGCGGTAAGGTTGCTAGTGAATTCCAATTAAACCCTGCTGATATTTCTGATGTTGACGCACTAAGGGAAGATATTGCACAACGTATTGCAACGGAACAATTCAACAAGGTTGTAACAGAGATCAACAGAGAGATCAAGGCCAACAAAGACGGAATTTTGTTAAAGGCGGACGCGAGCAAGGTCTACACAAAACAACAGTCAGACGGAACGTTTGCTAAAGAATCACATGTAAAAACGTTAGAAGGTAAAATTTCTGTCAATGAAAAAAATATCAATCTATCAGTAAAAGAGAATAACATCATTGCAAAGATCAACGTGACAAAAGAAACGATCTTACTTGATGCAAAAAGAATTAATTTAGTCGGTGCGATCACGGCCCAACATTTCCAGGCTAACACTATCAAAGGTGTTAAATACGAAAGCCACAACCCAAAAGACGCGACAAACAGAGTTGTGATAGAAAATAGCGTCGTTAAAAGTTTTGGCCCACTGGACAAAGCAAGAAACGTACAAAATTACGCCGAATTAAAAGAAGGTGGCCTACACGTTTACGAAGTAGCGCCGAACGGTTCACCTTATGGCGGGAAGCACGTTGAAGTATTGCCAGGCCGTTTAAACGTTACTAGCGATCGTTGGTCATCTGCTATAGAGCCTAGTGAGTTTAGAATCTGGGCCCCAGGTAATCTAATGACAATTGCATTGGGTGAAGTGCCACTAGGTGAAAATGGTTACGGTATGAGATTAACTGCTCCAGAGGGTATCTTTGTTAAATCCACACTCGGAAACACTCGTCCAACAATTCAATTCGAGCCATCTGACGCCATTTACTTTGATGGGTTTGGAAACATTGTAGGCGGTAAGTATTCGAAAGATTGGGCTACATTTTCTATCAAAGACGGACAAGGCCGTACTAAATATATAACAGGTATCGGCAACGGATCAGCACAAACAACGGAATACAATTCATACGGTGGAGGTCACGCATTCAACCACAACGGAACACGCCTTTTCGCAACATGGATTCAAGGTGCTAACTTCATTCAACAATTTGGGGGACACGCAATTTTCAAGTGGCAACACAGCGCCAATCGTTTTGAATTCCGAACAGGTAACGACGGCGGTTGGGTTAACGCGTCGGCGGGATCGTTCCAGAACGCGTCCTCACTAGTTTGGAAGAAAGATATTAATAATTTTGAAGGATCAGCGTTAGAAATAATTATGGGTACTAACATCATGACTTACCGCTATAAGAATGTTGAGTTAGAGCCGTTTGTCGATGTGGATGGGAAAGTAATTGAATCTAATCATGAAATGGGTGAAGCTGTCGGCCCTGTTCGTGTAGGTGTTATTTCTGAATTCGCGCCAAAGTTGATCACTAATGAAGATGGTTCTGCTGTTGATCTTTACGCTATGATCTCTCTAGGTTGGAAAGGAATACAGGAGAATCAAAAAGCTATACAAGATAAAGACAAACGTTTAAATGATCAAGAAACTAGAATAAAAGATCAAGAAGTTACTATAAAAAATCAAAGCGATAGAATTTCCAATCTAGAAACAAAGTTAAACCAGGTGTTAGAATTATTAGGAAAGGAATGA

Genome Context

Genome Context

Tertiary structure

PDB ID
eaf7b591e74fe660e2d6ba259c633104838b66b8963a0aeb96fa4f94842c2e3a
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,6800
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequence of Bacillus cereus bacteriophage vB_BceS_KLEB30-3S Simoliunas,E., Simoliuniene,M., Meskys,R. and Sulcius,S. 2020 32409544 GenBank