Genbank accession
XIF73301.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,76
Protein sequence
MGYLQMTRNVESIFGAVVTAPHQIPYTYTATGGEKFISLPFYPVTGIVTINGGMQVPLDNFEIDGNTLNLGCALSKGDVVFCLFDKILSPEDYKTGIRIYKFQAIGGETEFTPDYTSYGVQSLYIGGEYKTPEIEYSYDSTTGKVSLQTALTAGVWVVAEMSVKQPNISPLFDRSIQEIARATNVKDSEVILSSDTSQSLNGKKVVYSVSEQKAYGLPTLPSNVYIHSVANGKLTYNPGSVIVDLLPVPGSVEEFKDNLTLNVGASTIGTESGKTVQEELGTLEETSVILKNSIYKPIPVKYSPDYSQVMVASVNPQGLAQDATYWYITEDTSSGGAYTCTLSRINKVTNAKETFPGTFGTHGQGIGILSSGEVFIGGATNSSITVINFTAGTSSQVACIGFMKDFPFCYDSKTDLIYQLQDADGTTANITRIAVLSRTAGFISDNSIDRKLVKPGYPQGITTDGSFLYVTCGNSWSAASTGTWNDYWACFKVSLTGQVIERAMFRRNSMGVLAGGITVTSHEPQAVSWFEGKLSFLQYIGSSSATNAVIFTEDSEGSAIRAIPKNLWVSYYSLDELGINTASLVAGSALSTIAAAMPDNSDVTFSISNEAALLADTGIGFGVCKITRVNANRINAVTTEASSGLTPSQVCAVSYVGIYGSVQSAPKFLRGVKPVALAYEGTIVATAPSTITVSGIANCNELVIHITHTSGDNPVTPYKFTRDEISYYVTNATTLYIGDGTGYMSCRFTATGLSITGVTGSLIVRRVLTM
Physico‐chemical
properties
protein length:770 AA
molecular weight: 82240,78410 Da
isoelectric point:5,00742
aromaticity:0,09610
hydropathy:0,04870

Domains

Domains [InterPro]
DC_0983
STR
249–355
XIF73301.1
1 770
Architecture
ATT
ATT
STR
RBD
ATT 1-96 | ATT 160-251 | STR 252-476 | RBD 477-770
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
XIF73301.1
1 770
Domain Start End Length (AA) Confidence
N-terminal 1 277 277 0,9541
Central domain 278 671 395 0,9531
C-terminal 672 770 98 0,9031
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-277
Central
278-671
C-terminal
672-770

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage vB_CECAV_050
[NCBI]
3373739 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Salmonella enterica subsp. enterica serovar Copenhagen
[NCBI]
486990 Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Salmonella > Salmonella enterica

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XIF73301.1 [NCBI]
Genbank nucleotide accession
PQ306799.1 [NCBI]
CDS location
range 120390 -> 122702
strand -
CDS
ATGGGGTATCTTCAAATGACCAGAAACGTCGAGAGCATCTTTGGAGCGGTCGTAACAGCTCCGCACCAGATTCCATACACTTACACAGCAACGGGCGGAGAGAAGTTTATCTCCCTCCCTTTCTACCCGGTCACGGGTATAGTCACAATCAACGGTGGTATGCAAGTTCCGTTAGACAACTTTGAAATCGATGGAAATACGTTGAATCTCGGGTGTGCATTATCCAAAGGTGACGTTGTGTTCTGTCTGTTTGACAAGATTCTGTCTCCAGAAGATTATAAAACCGGGATTCGAATCTATAAGTTTCAGGCTATAGGAGGTGAAACCGAGTTCACTCCTGATTACACATCTTATGGAGTCCAATCTCTTTATATCGGTGGTGAGTACAAAACACCCGAAATTGAATATTCCTATGACAGCACGACAGGGAAAGTGTCTTTACAAACTGCGCTGACTGCAGGCGTTTGGGTAGTCGCTGAAATGTCTGTTAAACAACCGAATATCAGTCCGTTGTTTGACCGAAGTATTCAAGAAATCGCTCGTGCTACTAACGTTAAAGATAGTGAAGTAATTCTTAGTTCTGATACTTCTCAGTCCCTCAATGGTAAGAAGGTTGTTTACTCTGTTAGTGAGCAGAAGGCATATGGATTACCAACATTACCCTCTAACGTATATATCCATTCTGTTGCCAATGGTAAGCTGACTTATAATCCCGGTTCAGTGATTGTAGACCTTTTACCGGTCCCAGGCTCTGTAGAAGAGTTTAAAGATAATCTCACTTTAAATGTAGGGGCTTCCACTATTGGAACTGAGTCTGGTAAGACTGTTCAAGAAGAGCTGGGTACACTAGAAGAAACATCAGTGATTCTAAAGAATAGTATCTATAAACCAATACCTGTTAAGTATTCCCCAGACTATTCCCAGGTAATGGTAGCATCAGTTAATCCACAAGGATTAGCCCAGGATGCCACTTATTGGTACATTACAGAAGATACTTCTTCTGGTGGTGCTTACACTTGTACCCTAAGCCGCATTAATAAAGTTACCAATGCCAAAGAAACATTCCCAGGTACGTTTGGTACACACGGCCAAGGTATTGGTATTCTTTCGTCTGGTGAAGTATTTATTGGGGGAGCTACTAACAGTTCTATTACTGTAATTAACTTCACAGCAGGCACTTCTTCCCAAGTAGCCTGTATTGGCTTTATGAAAGATTTTCCTTTCTGCTATGACAGTAAAACAGATTTGATTTACCAGTTGCAGGATGCTGATGGTACAACAGCTAATATTACTCGTATTGCTGTACTTAGCCGTACCGCTGGTTTTATCTCTGATAACTCTATTGACCGTAAGTTAGTTAAGCCAGGGTATCCACAAGGTATTACTACAGATGGAAGTTTTTTGTACGTTACCTGTGGTAATTCTTGGTCTGCTGCCTCTACTGGTACATGGAATGATTACTGGGCTTGTTTTAAAGTTTCCTTAACTGGTCAAGTTATAGAGCGAGCAATGTTCCGTAGGAACTCTATGGGCGTTTTGGCTGGAGGTATTACAGTTACTTCACATGAACCACAAGCAGTGTCTTGGTTTGAAGGTAAGCTGTCTTTCTTACAGTATATCGGTAGTTCTTCTGCAACTAATGCCGTAATCTTTACTGAAGATTCTGAGGGGAGTGCAATACGTGCTATACCAAAAAACCTTTGGGTTAGCTACTACTCTCTTGATGAGCTTGGCATTAATACAGCATCGTTGGTTGCTGGTTCTGCTCTATCCACAATTGCAGCAGCAATGCCTGATAACTCTGATGTAACCTTCTCCATAAGCAACGAAGCAGCCTTACTTGCTGATACAGGTATTGGGTTTGGTGTATGTAAGATTACTCGCGTAAATGCTAACCGAATTAATGCAGTAACTACAGAAGCCAGTTCTGGTTTAACTCCGTCGCAGGTATGTGCTGTATCATACGTTGGTATCTACGGGTCTGTGCAGAGTGCTCCTAAGTTTTTACGTGGCGTTAAACCAGTAGCACTTGCTTATGAGGGGACTATTGTTGCAACAGCACCCTCTACAATAACAGTTTCCGGTATTGCAAACTGTAATGAGTTGGTAATCCACATCACTCATACCAGTGGGGATAACCCAGTAACCCCATATAAATTCACAAGAGATGAGATTAGCTATTACGTTACAAATGCTACAACTCTCTATATTGGCGATGGTACTGGTTATATGTCCTGTCGGTTTACTGCCACAGGACTGTCTATTACTGGCGTTACTGGTTCTCTGATTGTTAGACGTGTGCTAACTATGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
7bcdb822e5c9ee6dceb13076d1c3f179db23c7598caaa152861d72b7367799ed
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6010
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50