Genbank accession
YP_010746878.1 [GenBank]
Protein name
tail spike protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TSP
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,96
TSP
Evidence UniProt/TrEMBL
Probability 1,00
Protein sequence
MSSGCGDVLSLNDLQIAKKHQIFEAEVITGKQGGVAGGADIDYATNQVTGQTQKTLPAVLRDAGFSPASFNFTTGGTLGVNDADKAVLWPKEDGGDGNYYAWRGPLPKVIPAASTPLTTGGISDSAWVAFGDITFRAEADKKFKYSVKLSDFTTLQQLADAAVDSVLIDRDYTFSNNETVNFGGKTLTIDCKAKFIGDGNLVFTQLGKGSIVIAPFMESATTPWVIKPWTDDNQWITDPAAIVATLKQSKTDGYQPTVNDYAKFPGIESLLPPEAKGQSISSTLEIRECTGVEVHRASGLMACFLFRGCHFCKMVDADNPSGGKDGVITFENLSGDWGKGNYVIGGRTSYGSVSSAQFLRNNGGFARDGGVIGFTSYRAGESGVKTWQGTVGSTTSRNYNLQFRDSAVLYPVWDGFDLGADTDMNPGDDRPGDFPISQYPVHMLPLNHLIDNLFVRGSLGVGFGMDGQGLYVSNITVEDCAGSGAYILAHETVFTNIAIIDTNTKNFPANQIYISGACRVNGLRLVGIRSTTEQGLTIDAPNSTVSGITGFVDPSRINVANLMEEGLGNSRINSFNNDSAALRLRIHKLSKTLDSGSVYSHINGGPGSGSAWTEITAISRSLPDAVSLKINRGDYRAVEIPVATAPLPDNAVRDNGAISLYLEGDSLKALVKRADGSYTRLTLA
Physico‐chemical
properties
protein length:684 AA
molecular weight: 72886,71310 Da
isoelectric point:5,16339
aromaticity:0,08772
hydropathy:-0,17047

Domains

Domains [InterPro]
G3DSA:2.10.10.80
ATT
65–135
IPR040775
RBD
71–132
IPR012332
STR
136–684
IPR015331
RBD
138–684
YP_010746878.1
1 684
Architecture
ATT
STR
ATT 65-135 | STR 136-684
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_010746878.1
1 684
Domain Start End Length (AA) Confidence
N-terminal 1 154 154 0,9947
Central domain 155 602 449 0,9873
C-terminal 603 684 81 0,8183
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-154
Central
155-602
C-terminal
603-684

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage vB_SenS_S532
[NCBI]
2886209 Uroviricota > Caudoviricetes > Sarkviridae > Jerseyvirus > Jerseyvirus S532
Host Salmonella enteritidis
[NCBI]
149539 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_010746878.1 [NCBI]
Genbank nucleotide accession
NC_073188.1 [NCBI]
CDS location
range 28252 -> 30306
strand +
CDS
ATGTCCAGCGGTTGCGGTGATGTATTGTCACTTAATGATTTACAAATAGCTAAAAAACACCAGATTTTCGAAGCCGAGGTGATCACCGGTAAACAAGGCGGTGTAGCTGGTGGTGCGGATATCGACTACGCCACTAACCAGGTAACCGGGCAGACGCAGAAGACGCTTCCCGCAGTCTTACGTGATGCTGGTTTCTCCCCGGCATCTTTTAACTTTACGACCGGGGGTACTCTCGGCGTAAACGACGCGGATAAAGCGGTTCTTTGGCCGAAAGAAGATGGCGGGGACGGTAACTATTACGCATGGCGTGGCCCCCTGCCGAAAGTTATCCCTGCGGCGTCGACACCTCTTACGACAGGCGGCATTTCGGATTCCGCTTGGGTCGCGTTCGGAGATATTACCTTTCGCGCGGAAGCGGATAAGAAATTTAAATACTCCGTTAAGCTGTCCGACTTTACTACGTTACAACAATTGGCGGATGCCGCTGTTGATAGTGTTCTTATCGACCGCGATTACACTTTCAGCAATAACGAGACCGTTAATTTTGGCGGTAAGACCCTGACCATCGACTGTAAAGCGAAGTTTATCGGCGACGGAAACCTGGTATTTACGCAATTAGGTAAAGGTTCCATTGTAATAGCCCCCTTTATGGAGAGTGCTACAACGCCGTGGGTGATTAAACCGTGGACCGACGATAATCAGTGGATAACCGACCCCGCGGCAATCGTGGCCACACTTAAACAGTCTAAAACAGATGGATACCAGCCGACGGTAAACGATTACGCCAAGTTTCCTGGTATAGAATCCCTTCTCCCTCCGGAAGCTAAAGGGCAAAGCATATCTTCTACCCTGGAAATTCGGGAATGTACAGGCGTCGAGGTTCACCGGGCGAGTGGTCTTATGGCGTGTTTCCTGTTCCGCGGATGCCATTTCTGTAAGATGGTAGACGCTGACAACCCGAGCGGCGGAAAAGATGGCGTAATTACCTTTGAAAACCTGAGCGGCGATTGGGGCAAGGGTAACTATGTTATTGGCGGGCGCACAAGTTACGGTTCGGTAAGTAGCGCTCAATTCTTACGAAACAATGGCGGTTTCGCGCGCGATGGCGGGGTCATCGGGTTTACTTCGTATCGTGCGGGGGAAAGTGGTGTTAAGACGTGGCAAGGTACGGTAGGTTCTACGACCTCTCGTAACTACAACCTGCAATTCCGGGATTCAGCAGTGCTATACCCTGTATGGGACGGCTTCGATTTAGGCGCAGATACTGACATGAACCCCGGAGATGACCGCCCAGGGGATTTCCCCATTTCTCAGTACCCGGTACATATGCTCCCATTAAACCATTTGATAGACAATCTATTTGTTAGAGGTTCGCTGGGGGTAGGTTTCGGTATGGACGGGCAAGGTCTGTATGTCTCTAACATAACCGTCGAGGATTGCGCTGGTTCTGGGGCTTATATTCTTGCCCACGAAACAGTATTCACTAATATCGCAATAATCGACACCAATACTAAAAACTTCCCCGCGAACCAGATATATATCTCAGGGGCCTGCCGTGTAAACGGCCTTCGTTTGGTCGGCATCCGGTCAACTACCGAACAGGGTCTTACGATAGACGCGCCTAACTCCACGGTAAGTGGGATAACCGGCTTCGTAGACCCCTCAAGGATTAACGTAGCCAATTTGATGGAGGAAGGTCTTGGTAACTCTCGCATAAACAGTTTCAATAATGATTCTGCGGCGCTTCGGTTACGGATACATAAACTGTCAAAAACTCTTGATAGCGGTTCTGTGTACTCCCACATAAACGGTGGCCCTGGTTCGGGTTCAGCATGGACCGAAATTACCGCTATTTCAAGGTCACTACCGGATGCCGTGTCGTTGAAAATAAATAGGGGCGATTATCGTGCTGTTGAGATACCGGTAGCGACGGCCCCCCTACCAGACAACGCTGTCAGGGATAACGGGGCTATATCACTGTATCTGGAAGGCGATAGCCTTAAGGCGTTAGTTAAGCGGGCCGATGGAAGCTATACAAGATTAACTTTGGCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
afeb5522d0bd9758cca978215ea14dc20e6b931606123424bba5240e30be1fc9
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6900
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50