Genbank accession
QMP19250.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
Protein sequence
MPIINFLIKMEVHNNFSPLAFRKKESKATYEKWYAFGKNYAIPASANTLTPFQFTELNIPVFDPDTIEVEAVNEETGEMTKTGVYVSFDVMPEHGGVLYVSPGKNSFREALPQGTYRARFAIGDEVYISTPFCVIPGIETSSKYLLIEYWNDEKIAYPGGFITTGANNDFRYQMYVPATICKPKYEFEEELTKRAGYKFLELQTSTKVYAFTFVAPEFICDAMRLIRLSDYIRISHDGEYYNALNFEFDVDWQEQLYLAAVDCQFETDSIIQKLPSFNRRDKASFYNALLANIDTPIMFSPDTVGLYYKEYRETEPVVKGKLIRELSPIDLIDENTTIAVDLGTGEARKFNLYRMLQDYISKTHEDATDFLLHLRGGATFGEGITGSAASINAVGDAEVQGLNARVTKVKSLDSEDYVTVNKTAFTVNKQGDTALNALNARGDSHLQQDVYTGNNTGKITKEGQLQYLSAVIQEFITSPTFVPGFLGEGFKIWVENGNWHIECDNLTVRQTMNIFELLIQKIRSVNGALVVSQSNGKLSAVEEVGTQYKLTTGEEFSTFQEGDLVRCQTFAGYQGAGLAFDFTQFAKYDYSGGAFDSSLIDVTPDSISFNLNDTGNPGFAFYKFSESSPTPIEIPSFTLTLEGGYPGMMAFAAGLDSNDSPVEGVGVLLQNGDNVIPTIKSEQGIHNFAITITGDSGHGDGKVTVKQKKAAGSAPNNSLVKFYWVEVKAVDGTSFFVDKAEFNGVVPAVGDEVVQMGNTKNPERQALIYITAQESGHPYIEILNGVKTKSLSGTNRTRLGDLSNIQDSAFPEGQQPSGSGLYCDNAFLRGIFLLRNGKSVEDEVNQAKQDAANAATEAERAQQTAQEAKDRLNKWADDGFISPTEKPALIDEGKRIQAEFLQIKNNADKYGVSVTEYTKAYEDYLNELRYHSAQQPEDIAVRPELAQSQTAYYDKRNGALNAIATASKEYVDNADKKLKEYLDTEITAIPGKIELAVRSLKTANYNLLLDSNHTLSENPYRLGSYKYDVHLVKGKSYTLTVCYKCADSDDVVAYNNPSFGYLVILPKSAEETIVSTKITPSNDDAAYFYFYKTPQKETTQTYVKWAVITEGDIGVAAWIPSRTEAKTGIRNLFPISRMQTATNKHLNYFDITGWVATVYSEEEFKSRFKPSTKYTITGKYTILGKPTSGTGYKDSIVAFCMYNNSNLIDLWRKMVEYEAVGASGEISNTFTTPSNLDGYKIVVYTMYNTGNLGEFRFTDLMVSEGIEAVGWTQAPEDIEYDYRKYTDTQILAVDGKIELSVKTKVENLGIGANNLYSYTSSMIEQMNPEPMTITRLINEHGFHFVGASNGRSAVRIYYVIPPIPGKYTVSGWIKGNQNATPGITIDVCDSDQFRVLATADNKWSYFKHTFDVTSNTEEQSGIYNFVDIQDISWANIWIKDFKVEYGEIATAWSPNEADSVYFSKEYTTSQINIVEGKITSTVEKINAVDGKVTGLASRVEQTEKSITSVVGDINVLNSTTNRRVTKQIDLTGWDNNKFFPLAISLPVYYKTKVVINRPLYSSYGKPSYGTHDGGFSMNLSFEMSGSGWGSLPAVTNIFDYTKAWTSAGAKIVVDLGQIRETSTCVMGIRGGSKYDVTVYDTTDSNVINVYQTDYHGSYNTSFPVRTDGTEPVRTYGYYTEIKQTQESIALTANKVDDQGRRLSAAELTLSSDHAKLSVVEQTANSANSLAGTANNKAEAADGRVTATQNGLVETGINIQSRKIVLKSDNVLFQNNAGQQTAAINANGKLTANAIEVGEVVAGGFAAQRITTGNLTVTDGAVIGGMTITGGVLTGKNINIQDGAKIGSFTIESGILSANGMVAGMQMRLSNNLVEISSSGLRIDHNSGGYAVNVTGNGRCYMQGVESYRKFGVYEFAGATQWKAPGVHFACTISSAAQVRQTWGNPSIGASAVKHSTGRYTVKFTGVHSQGFIPMVMALNATKWVNACVEDIVSTTQFTVKLMDVNTGMVDSDFAVYICGFV
Physico‐chemical
properties
protein length:2021 AA
molecular weight: 222654,81950 Da
isoelectric point:5,12599
aromaticity:0,10737
hydropathy:-0,28971

Domains

Domains [InterPro]
DC_0204
STR
2–2021
Coil
Unmapped
837–878
QMP19250.1
1 2021
Architecture
STR
STR 2-2021
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacteroides phage vB_BfrS_23
[NCBI]
2733869 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Bacteroides fragilis
[NCBI]
817 cellular organisms > Bacteria > Pseudomonadati > FCB group > Bacteroidota/Chlorobiota group > Bacteroidota

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QMP19250.1 [NCBI]
Genbank nucleotide accession
MT630433.1 [NCBI]
CDS location
range 9397 -> 15462
strand -
CDS
GTGCCTATAATCAATTTTTTAATCAAAATGGAAGTACATAACAACTTTAGTCCTTTGGCGTTTAGAAAGAAAGAATCTAAAGCCACATACGAAAAATGGTACGCTTTCGGGAAGAACTACGCTATTCCTGCAAGCGCAAACACGCTAACTCCTTTCCAGTTTACAGAGTTGAACATACCAGTCTTTGATCCCGACACGATCGAAGTAGAGGCGGTTAACGAGGAAACGGGAGAGATGACAAAAACGGGTGTATATGTTAGCTTCGATGTTATGCCAGAACATGGCGGTGTCTTGTATGTGTCACCCGGCAAGAACTCGTTTAGGGAGGCTTTGCCACAGGGGACGTATAGAGCACGTTTTGCAATCGGTGATGAAGTATATATTTCGACTCCTTTTTGCGTTATACCCGGCATAGAAACGAGTAGCAAATATCTATTGATTGAATATTGGAACGATGAAAAGATTGCCTATCCGGGTGGATTTATTACAACGGGTGCGAACAATGACTTCCGGTATCAGATGTATGTTCCTGCAACGATCTGCAAACCTAAATACGAGTTTGAAGAAGAGCTAACCAAACGTGCAGGATACAAGTTTTTGGAACTGCAAACGTCTACGAAGGTGTACGCCTTTACATTTGTTGCACCGGAATTTATTTGTGACGCTATGCGACTGATTCGCCTATCTGACTATATCCGAATTTCGCACGATGGCGAATATTACAACGCTCTCAACTTCGAATTTGATGTTGATTGGCAGGAGCAATTGTACTTGGCGGCTGTTGACTGCCAGTTTGAGACGGACTCAATCATACAAAAACTCCCTTCTTTCAATAGACGAGATAAAGCGTCTTTTTATAATGCCCTATTAGCGAACATTGATACACCTATAATGTTCTCTCCCGATACCGTAGGGCTGTATTACAAAGAGTATCGGGAAACAGAGCCAGTAGTCAAGGGTAAATTGATACGGGAGTTATCCCCTATTGACTTGATAGATGAAAATACAACTATTGCCGTTGATTTGGGTACAGGTGAGGCGAGAAAGTTTAACTTATATCGAATGTTGCAGGACTACATTTCTAAAACCCATGAAGATGCAACAGACTTTTTGTTACACCTTCGTGGAGGCGCAACGTTCGGTGAGGGCATAACTGGTTCTGCCGCTTCTATCAACGCAGTAGGAGATGCGGAGGTTCAAGGGCTAAACGCACGTGTAACCAAAGTTAAATCGCTTGATTCGGAAGATTATGTAACTGTTAATAAAACAGCATTCACCGTAAACAAACAAGGTGATACGGCTTTAAATGCGCTTAATGCGAGGGGAGATTCCCACTTGCAGCAAGATGTGTATACCGGAAACAATACCGGAAAGATCACCAAAGAAGGACAATTGCAGTACCTATCAGCCGTTATACAGGAGTTTATCACATCACCCACCTTTGTTCCCGGTTTTTTGGGTGAGGGTTTTAAAATATGGGTTGAGAATGGCAATTGGCATATAGAATGCGACAATTTGACAGTAAGACAGACTATGAATATATTTGAGCTACTTATCCAAAAGATAAGGAGTGTTAACGGTGCATTGGTCGTGTCCCAATCAAACGGCAAATTGTCAGCTGTTGAAGAAGTAGGAACGCAATATAAGCTAACCACAGGAGAGGAATTTTCCACTTTTCAAGAGGGCGATTTAGTCAGGTGTCAGACGTTTGCAGGCTACCAAGGTGCGGGACTTGCCTTTGACTTTACTCAGTTTGCAAAATATGACTATTCCGGTGGTGCTTTTGATAGCAGCTTGATTGATGTTACACCCGACTCTATTAGCTTTAACTTGAATGATACTGGTAATCCCGGTTTTGCATTCTATAAATTTTCAGAGTCAAGCCCTACACCAATTGAAATACCTTCATTTACCTTGACTTTGGAGGGAGGCTATCCTGGTATGATGGCTTTTGCTGCCGGACTTGATTCAAATGACAGTCCGGTAGAGGGTGTAGGCGTGTTGCTGCAAAACGGTGATAATGTTATTCCGACTATTAAATCAGAGCAAGGTATACACAACTTTGCTATAACAATAACTGGTGATTCCGGTCACGGTGATGGTAAGGTTACAGTAAAGCAAAAGAAAGCGGCAGGAAGCGCACCAAACAATAGCTTAGTTAAATTCTATTGGGTGGAAGTTAAAGCGGTTGACGGGACTTCTTTCTTTGTAGATAAAGCAGAGTTCAACGGTGTTGTTCCGGCTGTCGGTGATGAAGTCGTTCAGATGGGAAATACGAAGAACCCCGAACGGCAGGCTTTAATTTATATCACAGCGCAGGAAAGCGGACACCCGTACATAGAGATATTGAACGGAGTTAAAACAAAATCGTTATCCGGTACGAATAGGACACGTCTTGGCGATTTAAGTAACATACAGGACTCTGCGTTTCCGGAAGGACAACAGCCATCCGGTAGCGGCTTGTATTGCGATAACGCTTTTCTTCGTGGTATATTCTTGCTGAGAAACGGCAAGTCAGTTGAGGATGAAGTAAACCAAGCGAAGCAAGATGCAGCCAACGCAGCGACAGAGGCGGAGAGAGCACAACAGACAGCGCAGGAGGCTAAAGATCGGCTTAATAAATGGGCTGACGATGGTTTTATATCTCCTACTGAAAAGCCCGCTTTGATTGATGAAGGAAAGCGCATACAGGCAGAGTTTTTGCAGATAAAAAATAACGCTGACAAATACGGTGTATCCGTTACTGAATATACCAAGGCTTATGAAGATTATTTAAATGAACTTAGATACCATTCCGCCCAACAGCCGGAAGATATTGCAGTGCGTCCAGAATTGGCACAGAGCCAAACGGCTTACTACGACAAACGTAACGGAGCGTTGAATGCAATTGCTACGGCTTCAAAAGAATATGTAGATAATGCTGACAAAAAGTTAAAGGAATACTTAGATACTGAGATAACTGCTATTCCCGGTAAGATTGAACTTGCTGTACGGAGTTTGAAAACGGCAAATTACAACTTGCTGTTAGATAGTAACCACACTCTTAGCGAAAACCCGTATCGGCTTGGATCATACAAATATGATGTTCATTTGGTGAAAGGTAAATCTTATACGTTGACTGTTTGTTACAAGTGTGCAGATTCGGACGATGTTGTAGCGTATAATAACCCTTCGTTCGGCTATTTGGTTATATTACCGAAAAGCGCAGAGGAAACAATTGTTTCGACTAAAATAACGCCTTCGAATGATGATGCAGCGTATTTCTATTTCTATAAAACCCCACAGAAAGAAACAACCCAAACGTATGTAAAATGGGCTGTAATTACTGAGGGTGATATTGGTGTAGCCGCATGGATACCGTCACGAACTGAGGCTAAAACAGGCATTAGGAACTTATTTCCAATATCACGGATGCAGACAGCGACTAACAAGCATTTGAACTATTTTGATATTACAGGATGGGTAGCAACTGTATACAGTGAAGAAGAATTTAAGTCAAGGTTTAAACCATCTACGAAATATACCATAACAGGGAAATATACTATTCTTGGAAAGCCAACATCAGGAACCGGATACAAAGATAGTATCGTAGCTTTTTGTATGTATAATAACTCTAATTTAATAGACCTTTGGCGTAAAATGGTCGAGTATGAAGCAGTAGGAGCTTCGGGAGAAATATCTAATACATTTACTACACCTTCGAATCTCGATGGGTATAAGATAGTAGTGTATACCATGTACAATACAGGAAATTTAGGAGAGTTCCGTTTTACTGATTTGATGGTATCAGAAGGAATTGAGGCAGTAGGGTGGACACAAGCACCGGAAGATATAGAATACGACTACCGGAAGTACACCGATACGCAGATACTTGCCGTTGACGGAAAAATAGAACTATCTGTAAAGACTAAGGTAGAAAATTTGGGAATAGGAGCTAACAATTTGTATAGCTACACGAGCTCAATGATTGAACAAATGAATCCTGAGCCAATGACTATAACAAGGCTTATAAATGAACACGGTTTTCATTTTGTGGGTGCAAGTAACGGTCGGTCCGCTGTAAGAATATATTATGTTATACCGCCTATACCCGGAAAATACACTGTTTCCGGATGGATTAAAGGTAATCAAAATGCAACTCCCGGTATAACCATTGATGTATGTGATTCTGACCAATTTCGTGTTTTGGCTACTGCTGATAATAAATGGAGTTATTTTAAGCACACTTTCGATGTTACGAGTAATACAGAAGAGCAAAGCGGTATATATAATTTTGTTGATATACAAGATATATCATGGGCCAATATATGGATTAAAGACTTTAAAGTCGAATACGGTGAAATAGCAACCGCATGGAGTCCAAACGAGGCTGATTCGGTGTATTTTTCAAAAGAATATACAACGTCACAAATAAACATTGTTGAAGGTAAGATAACATCCACCGTTGAAAAGATTAATGCGGTTGACGGTAAAGTAACTGGTCTTGCTTCACGCGTCGAACAGACCGAAAAAAGTATAACGTCCGTTGTTGGTGATATTAATGTTCTTAATAGCACTACAAATAGACGCGTTACTAAGCAAATAGATTTGACCGGATGGGATAATAATAAGTTTTTCCCTCTCGCTATAAGTCTCCCTGTTTACTACAAAACTAAGGTTGTTATAAACCGTCCCTTATATTCATCATACGGAAAACCTTCATACGGTACACATGATGGCGGTTTTTCTATGAACTTATCATTTGAAATGTCCGGTTCGGGTTGGGGTTCGTTGCCAGCAGTAACCAATATCTTTGACTATACTAAAGCATGGACTTCTGCGGGTGCAAAGATAGTTGTTGATTTGGGACAAATAAGAGAAACCTCTACTTGCGTAATGGGTATTCGTGGTGGGTCTAAGTATGATGTAACCGTTTACGACACAACAGACTCCAATGTGATAAACGTTTATCAAACAGATTATCACGGTTCGTATAATACATCGTTCCCCGTTCGCACCGATGGAACTGAACCCGTCCGCACATACGGATACTATACCGAAATAAAGCAGACGCAGGAAAGCATAGCTTTAACTGCAAACAAAGTGGACGATCAAGGTAGGCGATTAAGTGCGGCTGAGTTAACTCTAAGTTCAGACCACGCAAAATTAAGCGTAGTAGAACAAACGGCAAATTCCGCCAATTCATTAGCAGGCACAGCCAATAACAAAGCCGAAGCCGCAGACGGTCGAGTCACAGCCACGCAGAACGGTTTGGTCGAGACAGGAATAAACATACAGTCCCGCAAAATCGTGCTAAAGTCTGATAACGTCCTTTTCCAAAACAACGCAGGACAGCAGACAGCCGCTATCAATGCGAACGGAAAACTTACTGCAAACGCAATTGAAGTTGGTGAGGTTGTTGCCGGAGGTTTTGCGGCTCAGAGAATCACTACCGGGAACTTGACTGTGACGGATGGGGCTGTTATCGGTGGAATGACTATCACAGGGGGAGTGTTGACCGGAAAGAACATCAATATACAAGATGGTGCAAAGATCGGTAGCTTCACGATAGAAAGCGGTATTCTATCCGCTAATGGGATGGTAGCCGGGATGCAAATGCGATTAAGTAATAACCTTGTGGAAATAAGTAGCTCAGGACTTCGCATAGATCATAATTCCGGTGGTTACGCTGTCAATGTTACAGGCAACGGACGTTGTTATATGCAGGGTGTGGAGTCCTACCGTAAATTCGGTGTATACGAGTTTGCGGGTGCGACACAATGGAAAGCACCCGGAGTTCATTTTGCGTGTACTATTTCCTCGGCAGCACAAGTACGCCAAACGTGGGGAAACCCCTCTATTGGAGCGAGTGCCGTAAAACATTCTACCGGAAGATATACGGTTAAGTTTACCGGAGTTCATTCACAGGGTTTTATCCCTATGGTAATGGCTTTAAATGCTACCAAGTGGGTAAACGCTTGTGTAGAGGATATTGTTAGTACGACACAGTTTACCGTCAAACTTATGGACGTTAATACTGGAATGGTAGACAGCGACTTTGCTGTATACATTTGCGGCTTTGTTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
66a5d9e1dd608a71f9ac0c5396c6d79056f393cc1b510d4d3d22a790f9b0f696
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,6886
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Genome characterisation of a novel wastewater Bacteroides fragilis bacteriophage (vB_BfrS_23) and its host GB124 Tariq,M.A., Newberry,F., Haagmans,R., Booth,C., Wileman,T., Hoyles,L., Clokie,M.R.J., Ebdon,J. and Carding,S.R. 2020-10-23 GenBank