Genbank accession
ASZ78212.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MSSGCGDVLSLNDLQIAKKHQIFEAEVITGKQGGVAGGADIDYATNQVTGQTQKTLPAVLRDAGFSPASFNFTTGGTLGVNDANKAVLWPKEDGGDGNYYAWRGSLPKVIPAASTPLTTGGISYSAWVAFGDITFRAEADKKFKYSVKLSDFTTLQQLADAAVDSVLIDRDYTFSNNETVNFSGKTLTIDCKAKFIGDGNLVFTQLGKGSIVIAPFMESATTPWVIKPWTDDNQWITDPAAIVATLKQSKTDGYQPTVNDYAKFPGIESLLPPEAKGQSISSTLEIRECTGVEVHRASGLMACFLFRGCHFCKMVDADNPSGGAHGVITFENLSGDWGKGNYVIGGRTSYGSVSSAQFLRNNGGFARDGGVIGFTSYRAGESGVKTWQGTVGSTTSRNYNLQFRDSAVLYPVWDGFDLGADTDMNPEDDRPGDFPISQYPVHMLPLNHLIDNLFVRGSLGVGFGMDGQGLYVSNITVEDCAGSGAYILAHETVFTNIAIIDTNTKNFPANQIYISGACRVNGLRLVGIRSTTEQGMTVDAPNSTVSGLTGFVDPSRINVADLMEGGLGNSRINSFDNDSAALRFRIHKLSKTLDSGSVYSHINGGPGSGSAWTEITAIAGSLPDAVSLKINRGDYRAVEIPVATTVLPDNAVRDNGSISLYLEGDNLKALVKRADGSYTRLTLA
Physico‐chemical
properties
protein length:684 AA
molecular weight: 72918,69000 Da
isoelectric point:5,15128
aromaticity:0,09064
hydropathy:-0,15673

Domains

Domains [InterPro]
G3DSA:2.10.10.80
ATT
65–135
G3DSA:2.10.10.80
ATT
65–130
IPR040775
RBD
71–132
IPR015331
RBD
138–684
ASZ78212.1
1 684
Architecture
ATT
STR
ATT 65-135 | STR 136-684
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
ASZ78212.1
1 684
Domain Start End Length (AA) Confidence
N-terminal 1 154 154 0,9938
Central domain 155 591 438 0,9849
C-terminal 592 684 92 0,8737
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-154
Central
155-591
C-terminal
592-684

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage ST1
[NCBI]
2025822 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Salmonella typhimurium
[NCBI]
90371 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
ASZ78212.1 [NCBI]
Genbank nucleotide accession
MF001366.1 [NCBI]
CDS location
range 12806 -> 14860
strand -
CDS
ATGTCCAGCGGTTGCGGTGATGTATTGTCACTTAATGATTTACAAATAGCTAAAAAACACCAGATTTTCGAAGCCGAGGTGATCACCGGTAAACAAGGCGGTGTAGCTGGTGGTGCGGATATCGACTACGCCACTAACCAGGTAACCGGGCAGACGCAGAAGACGCTTCCCGCAGTCTTACGTGATGCTGGTTTCTCCCCGGCATCTTTTAACTTTACGACCGGGGGTACTCTCGGCGTAAACGACGCCAATAAAGCGGTTCTTTGGCCGAAAGAAGATGGTGGAGACGGTAACTACTACGCATGGCGTGGCTCCCTGCCGAAAGTTATCCCTGCGGCGTCGACACCCCTTACGACAGGCGGCATTTCGTATTCCGCTTGGGTCGCGTTCGGAGATATTACCTTTCGCGCGGAAGCGGATAAGAAATTTAAATACTCCGTTAAGCTGTCCGACTTTACTACGTTACAACAATTGGCGGATGCCGCCGTTGATAGCGTTCTTATCGACCGCGATTACACTTTCAGTAATAACGAGACCGTTAACTTCAGCGGGAAGACCCTGACCATCGACTGTAAAGCGAAGTTTATCGGCGACGGAAACCTGGTATTTACGCAATTAGGTAAAGGTTCCATTGTAATAGCCCCCTTTATGGAGAGTGCTACAACGCCGTGGGTGATTAAACCGTGGACTGACGATAATCAATGGATAACCGACCCCGCGGCAATCGTGGCCACACTTAAACAGTCTAAAACAGATGGATACCAGCCGACGGTAAACGATTACGCCAAGTTCCCTGGCATAGAATCCCTTCTCCCTCCGGAAGCTAAAGGGCAAAGCATATCTTCTACCCTGGAAATTCGGGAATGTACAGGCGTCGAGGTTCACCGGGCGAGTGGTCTTATGGCGTGTTTCCTGTTCCGTGGATGCCATTTCTGTAAGATGGTAGACGCTGACAACCCGAGCGGCGGTGCACACGGCGTAATCACCTTCGAAAACTTAAGCGGAGATTGGGGCAAAGGTAACTATGTTATCGGCGGGCGCACAAGTTACGGTTCGGTAAGTAGCGCGCAATTCTTACGCAACAATGGCGGTTTCGCGCGCGATGGCGGGGTCATCGGGTTTACCTCGTATCGTGCAGGGGAAAGTGGTGTTAAGACGTGGCAAGGTACGGTAGGTTCTACGACATCTCGTAACTACAACCTGCAATTCCGGGATTCGGCGGTACTGTACCCTGTATGGGACGGCTTCGATTTAGGCGCAGATACTGACATGAACCCCGAAGATGACCGCCCAGGGGATTTCCCCATTTCTCAGTACCCGGTACATATGCTCCCTTTAAACCATTTGATAGACAATCTATTTGTTAGAGGTTCGCTGGGGGTAGGATTCGGTATGGACGGGCAAGGTCTGTATGTCTCTAACATAACCGTCGAGGATTGCGCTGGTTCTGGGGCTTATATTCTTGCCCACGAAACAGTATTCACTAATATCGCAATAATCGACACCAATACTAAAAACTTCCCTGCGAACCAGATATATATCTCGGGGGCCTGTCGTGTAAACGGCCTTCGTTTGGTCGGCATCCGTTCAACTACCGAACAGGGCATGACGGTAGACGCACCTAACTCCACTGTAAGCGGACTAACGGGCTTCGTGGACCCCTCAAGGATTAACGTAGCCGATTTGATGGAGGGAGGTCTTGGTAACTCTCGCATAAACAGTTTCGATAATGATTCTGCGGCGCTTCGGTTTCGTATTCATAAACTGTCAAAAACCCTTGATAGTGGGTCCGTGTACTCCCACATTAACGGCGGGCCGGGTTCTGGCTCAGCATGGACCGAAATTACCGCTATTGCGGGGAGCTTGCCCGATGCCGTATCATTAAAAATAAATAGGGGCGATTATCGTGCTGTTGAGATACCGGTAGCGACGACCGTCCTACCAGACAACGCTGTCAGGGATAACGGGTCTATATCACTGTATCTGGAGGGCGATAACCTTAAAGCGTTAGTTAAGCGGGCCGACGGAAGCTATACAAGATTAACTTTGGCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
2f2c71e77623602ea619d2f25ada29544dbc235cf46e6ccd6dcf48984085164a
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6888
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete Genome Sequence of Lytic Bacteriophage ST1 Infecting Salmonella Typhimurium Isolates Kim,D., Kim,Y.J., Han,B.K. and Kim,H. 2012-01-15 GenBank