Genbank accession
QBZ71416.1 [GenBank]
Protein name
tail fibers protein
RBP type
TSP
Evidence GenBank
Probability 1,00
TSP
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MATTPTSLPIPSEDPRDLKFNAGKFDEVMTSDAHYYVDRFGVKRWTIAGFQYTAEEAIRAYGYITMDSFEDGATLTLPNQVLRYEATGEYYRWDGAFPKAVAAGSTPASTGGVGLGAWISVGDAAFRQEANKKFKYSVKLSDYSTLQEAATAAVDGVLIDRDYTFTDNETVDFGGKVLTIDCKAKFIGDGNLTFTNLGAGSLVNSPYMESATTPWMIFPWNGDGSWITEAAAVAATLAQTRDRGYQPTVSDYTKFPGIEALLPSYAKDQHIHSTLRIFNCTGITVKNAKGSVGCYLFDTCFYCKAVDSDLAVAGGDAGITFMNLSGNKGVGNYCIGGRIAYGSVSSVQFLRQDGGVDHDGGVIGFTSFRPGESGVKTWQGTVGSTSARCYNLQFRKSLSMYPVWDGFDLGADIGNETDRPGDYTLAEYPVHQLPTNHIIDDLVAIGSLGVGIGMDGKGGYVSNVLMQDCAGSGALWFTYGKTFTNVSVIDTNTLDFNGNQVYIQGDCIVNGLRLVGIKPTPSNGLIVDAPNTTISGITGNVDSRKVNAANIVDPMLGNSRINSYQDTGILDIRLHKLSTTMDAVSIKAHSNGAGSGSAWASLGAASGSVSDAVSIKVNYTDNRAAEIPFSPTVVSDSAVKDNSCFVPYWEGSSLKALVKKADGYLVRVTLATV
Physico‐chemical
properties
protein length:673 AA
molecular weight: 71783,48550 Da
isoelectric point:5,01913
aromaticity:0,10253
hydropathy:-0,10594

Domains

Domains [InterPro]
DC_1559
ATT
1–175
G3DSA:2.10.10.80
ATT
62–126
IPR040775
RBD
64–123
IPR012332
STR
127–673
IPR015331
RBD
129–671
QBZ71416.1
1 673
Architecture
ATT
STR
ATT 1-175 | STR 176-673
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QBZ71416.1
1 673
Domain Start End Length (AA) Confidence
N-terminal 1 145 145 0,9853
Central domain 146 568 424 0,9864
C-terminal 569 673 104 0,8754
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-145
Central
146-568
C-terminal
569-673

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage Akira
[NCBI]
2562461 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Salmonella enterica subsp. enterica
[NCBI]
59201 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Salmonella

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QBZ71416.1 [NCBI]
Genbank nucleotide accession
MK599416.1 [NCBI]
CDS location
range 8557 -> 10578
strand -
CDS
ATGGCTACCACACCGACTAGCTTACCAATCCCGTCAGAAGACCCGCGCGACCTGAAGTTTAACGCTGGTAAATTTGATGAAGTCATGACATCTGATGCACATTACTATGTGGACAGATTTGGCGTAAAACGCTGGACTATTGCTGGATTCCAGTACACTGCGGAAGAGGCCATTCGTGCTTATGGATATATCACAATGGATAGCTTTGAAGATGGCGCGACGTTGACGCTACCAAATCAGGTGCTACGTTACGAGGCAACCGGAGAATATTACCGATGGGATGGTGCATTTCCTAAGGCTGTAGCTGCTGGTTCAACTCCTGCATCAACTGGTGGCGTTGGTTTAGGCGCGTGGATTAGTGTTGGTGACGCAGCATTTAGACAGGAAGCCAACAAAAAATTCAAATATTCAGTAAAATTATCAGATTATTCTACCTTGCAGGAAGCAGCAACAGCAGCAGTTGACGGAGTGTTGATTGACCGCGACTATACATTCACCGACAACGAGACAGTTGATTTTGGCGGCAAAGTACTAACCATCGACTGTAAAGCTAAATTTATCGGAGATGGTAATCTTACATTTACTAATCTTGGCGCGGGTTCTTTAGTAAACTCTCCGTATATGGAAAGTGCCACAACTCCGTGGATGATTTTTCCATGGAATGGAGATGGAAGTTGGATTACGGAGGCCGCGGCAGTTGCGGCAACGCTGGCACAAACCAGGGATAGGGGTTATCAACCAACCGTAAGCGACTACACCAAATTTCCTGGAATTGAGGCATTGCTGCCTAGTTATGCGAAAGACCAACATATCCATTCCACACTTCGTATTTTTAACTGTACTGGTATTACTGTAAAAAATGCTAAAGGGTCGGTCGGTTGCTACCTGTTTGATACTTGCTTTTATTGTAAAGCTGTTGATTCTGATTTGGCGGTAGCAGGTGGGGATGCGGGAATTACCTTTATGAATCTATCCGGTAATAAGGGGGTTGGTAACTACTGTATAGGTGGGAGAATTGCTTACGGTTCTGTTAGCTCAGTTCAATTCCTGCGCCAAGATGGCGGGGTTGACCATGATGGCGGTGTTATAGGTTTTACGTCATTCCGTCCTGGGGAGTCAGGTGTTAAGACATGGCAGGGAACGGTCGGAAGTACATCTGCCCGTTGTTACAATCTTCAGTTTAGAAAATCATTATCAATGTACCCTGTGTGGGATGGGTTTGATTTAGGCGCTGATATCGGCAATGAAACTGACAGGCCAGGTGATTATACGTTGGCTGAGTATCCAGTACATCAATTACCGACCAACCACATAATTGATGACCTTGTAGCTATTGGCTCACTAGGTGTTGGCATAGGAATGGATGGTAAAGGCGGCTATGTATCAAACGTCTTGATGCAAGATTGCGCAGGCTCTGGAGCACTATGGTTTACATATGGAAAGACATTCACCAATGTTTCAGTAATAGATACAAATACGCTGGATTTCAATGGAAATCAGGTATACATACAAGGAGATTGTATTGTTAATGGTTTGCGTTTAGTTGGTATAAAGCCAACCCCATCTAACGGACTGATAGTAGACGCGCCAAACACTACAATATCAGGTATTACTGGTAATGTTGACAGTAGAAAGGTTAATGCTGCTAACATTGTTGACCCAATGCTGGGGAATTCCAGGATTAACAGTTACCAAGATACTGGCATATTAGATATCAGGCTGCATAAGCTGAGCACTACAATGGATGCCGTTAGTATTAAGGCACATTCAAATGGCGCTGGAAGTGGGTCGGCATGGGCGTCTTTGGGGGCTGCGTCTGGAAGTGTTAGTGATGCCGTATCAATAAAGGTTAACTACACAGACAACAGGGCAGCAGAAATACCTTTCAGCCCAACCGTCGTTAGCGATAGCGCAGTAAAAGATAACTCTTGCTTCGTTCCATACTGGGAAGGAAGCTCACTAAAAGCACTTGTCAAGAAAGCTGATGGTTATTTAGTTAGGGTTACATTAGCAACTGTGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
a6072fe63d5b9f74dc1e092d87e3e0f12f7b2d3cfb88e76b801ef2b1043490f5
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6793
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
A New High-Throughput Screening Method for Phages: Enabling Crude Isolation and Fast Identification of Diverse Phages with Therapeutic Potential Olsen,N.S., Hendriksen,N.B., Hansen,L.H. and Kot,W. 2020 GenBank