Genbank accession
YP_008239481.1 [GenBank]
Protein name
tail spike protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence GenBank
Probability 1,00
TSP
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
TSP
Evidence UniProt/TrEMBL
Probability 1,00
Protein sequence
MNELFSQGGKGSTGILTNKQAVARHFGVKQNEVIYFAVGADLGGYKVIYDKENQQAYTLPVGIAPGTTAVSMSSTGNLVHSSGAVDLSDLAVKRREFITLQGDFVSGATLTRKHEVITYSNSRYRWTGTLPKVVAPDSLPDSSEWLNVDANPALSELAKAVGASMIGYKPTGTTTTTGTVKTKLDSFIDFANDYCGGPITGQPDLSDQLQQAIIDAFNSGVGDIKIVGDFYISKMILWYPGVRLLGGRYDTTLIRAATTFPVGDTMFRSYRPPLWNAGCHGLSMENLYLVGRSTKNLHAIDINDASYFNLEGVRLDLFNKGISFNRWIDETRVESGGIITYPNAHTPAIGGQSYFGTVTRCYAGSCVTCVDFNGVVNRCTFTSNTWTSSDLAYNFSNPRGVYETNTFITCNIEGVKIVWEWFFSINSPYHNVWINTSIDNGNPDITCLAKDGGRQTFIGLAIFPYGNTDLVNWYGINPNGYRSTVIGTDNGELLPENQLKTQVREELHTLTGIANKQWAGQQITETIPANGYKSYNITVTGLKGNAAVIASLSQIYHGITVNAASNNTGTVQVIISNYTAADIAINSYLSVTGIAKSFL
Physico‐chemical
properties
protein length:599 AA
molecular weight: 65078,32270 Da
isoelectric point:6,02052
aromaticity:0,10518
hydropathy:-0,12120

Domains

Domains [InterPro]
G3DSA:3.30.2020.50
ATT
1–100
IPR040775
RBD
92–143
YP_008239481.1
1 599
Architecture
ATT
RBD
ATT 1-159 | RBD 440-598 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_008239481.1
1 599
Domain Start End Length (AA) Confidence
N-terminal 1 206 206 0,9932
Central domain 207 490 285 0,9923
C-terminal 491 599 108 0,9733
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-206
Central
207-490
C-terminal
491-599

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage FSL SP-058
[NCBI]
1173761 Uroviricota > Caudoviricetes > Schitoviridae > Ithacavirus > Ithacavirus SP058
Host Salmonella enterica
[NCBI]
28901 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales
Host Salmonella enterica subsp. enterica serovar Dublin
[NCBI]
98360 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Salmonella

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_008239481.1 [NCBI]
Genbank nucleotide accession
NC_021772.1 [NCBI]
CDS location
range 58820 -> 60619
strand -
CDS
ATGAACGAACTGTTCTCACAAGGCGGTAAAGGTTCAACTGGAATCTTAACCAATAAACAAGCAGTAGCTAGACACTTTGGTGTTAAGCAAAACGAGGTAATTTACTTTGCTGTTGGTGCTGATTTGGGTGGATATAAAGTAATTTATGATAAGGAAAATCAACAAGCTTATACATTACCTGTCGGTATTGCACCAGGAACAACTGCTGTATCAATGAGTTCAACAGGCAATCTGGTTCATTCATCCGGTGCAGTTGACCTAAGTGACTTGGCTGTTAAGCGCAGAGAGTTTATTACTCTTCAGGGGGATTTCGTTAGTGGTGCAACTCTTACCCGTAAGCATGAAGTTATTACTTACAGTAATAGTCGATATCGCTGGACTGGAACATTACCCAAAGTTGTTGCCCCAGACTCTTTACCTGATAGTTCTGAGTGGCTCAATGTGGATGCTAACCCTGCTTTGTCTGAATTAGCCAAAGCCGTTGGTGCTTCTATGATTGGGTATAAACCAACAGGGACTACCACCACTACGGGTACTGTTAAAACCAAACTGGATAGTTTTATAGATTTTGCCAATGATTACTGCGGTGGGCCAATTACGGGGCAACCGGACCTTTCCGACCAATTGCAACAAGCGATTATTGATGCCTTTAACTCAGGTGTTGGTGATATTAAAATCGTTGGAGATTTCTATATCTCTAAGATGATTTTATGGTATCCCGGTGTGCGTTTGCTTGGTGGGCGTTATGATACTACCTTAATTCGAGCAGCTACTACCTTCCCTGTCGGCGATACTATGTTCCGTTCTTATCGTCCTCCTTTGTGGAATGCAGGCTGCCATGGATTGTCCATGGAGAACTTGTATCTGGTAGGTCGTTCTACTAAGAACCTACATGCAATAGATATTAATGATGCCTCCTATTTTAACCTGGAAGGTGTACGGTTAGACCTGTTTAATAAGGGTATTTCTTTTAACAGATGGATTGATGAAACTCGCGTCGAATCTGGTGGAATTATTACTTATCCTAATGCCCATACACCAGCTATTGGAGGTCAATCCTACTTTGGTACGGTAACCCGTTGCTACGCTGGTAGCTGTGTTACTTGTGTGGATTTTAATGGTGTAGTTAACCGTTGTACCTTTACTAGTAACACTTGGACCTCTAGTGACTTAGCATATAACTTCAGTAATCCTCGTGGTGTATATGAAACAAATACGTTCATCACTTGTAATATCGAAGGTGTAAAAATTGTTTGGGAATGGTTCTTCTCAATCAACTCTCCTTATCACAACGTGTGGATTAACACTAGTATTGATAATGGTAATCCAGATATCACTTGTCTGGCTAAAGATGGTGGTAGACAAACCTTTATTGGTTTAGCCATTTTCCCTTATGGTAATACTGACTTAGTTAATTGGTATGGTATAAATCCAAATGGATATCGTAGTACTGTTATTGGTACTGATAATGGAGAATTGTTACCAGAAAACCAGTTAAAAACTCAGGTACGAGAAGAGTTGCATACTCTTACTGGTATTGCTAATAAACAATGGGCTGGGCAGCAGATAACAGAGACTATTCCTGCTAATGGGTATAAGTCTTACAACATTACTGTTACTGGTTTAAAAGGTAATGCTGCTGTTATTGCGTCATTATCTCAGATTTATCATGGCATTACTGTAAATGCTGCTAGTAATAATACAGGTACTGTTCAGGTTATTATTAGTAATTACACTGCGGCAGATATTGCTATTAATTCATATTTAAGTGTTACTGGTATTGCTAAATCATTCCTTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
c26e544b93ab76a04c46c7b058c2f464ad81c37a288c9315e2245476bcc970ff
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7494
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50