Genbank accession
YP_010582462.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,96
Protein sequence
MSSGCGDVMSLNDLQVAKKHQIFEAEVITGKQGGVAGGADIDYATNPVTGQTQKTLPAVLRDAGFSPASFNFTTGGTLGANDADKAVLWPKEDGGDGNYYAWRGSLPKVIPAASTPLATGGISDFAWDAFGDITFRAEADKKFKYSVKLSDFTTLQQLADAAVDSVLIDRDYTFTNGETVNFGGKVLTIDCKAKFIGDGALIFTNMGSGSIIEKPFMESATTPWVIYPWTEDGKWITDAQAVAATLKQSKTEGYQPGVNDWVKFPGLEALIPQNVKDQHVASTLDIRECVGIEVRSAGGLMAAYLFRNCHHCKVIDSDTIIGGKEGIITFENLSGEWGIGNYAIGGRVHYGSGSGVQFLRNNGGASHNGGVIGVTSWRAGESGFKTWQGSVGAGTARNYNLQFRDSVALSPVWDGFDLGSDPGMAPEDDRPGDLPVSQYPMHQLPNNHMVDNILVMNSLGVGLGMDGRDGYVSNVTVQDCAGAGMLAHTFNRTFSNITVIDCNYMNFDSDQIIIIGDCIVNGIRAAGIKPQPSKGMVISAPNSTLSGVVGNVPPDRILAGNIIDSALGQTRINGFNGDSVEMGLRVHKLTKTLDSGAIRSTLNGGPGSGSAWTEITAISGSLPDAVSLKINRGDYHAVEIPVAVTVLPDAAVRDNGSIALYLEGDSLKALVKRANGSYTRLTLA
Physico‐chemical
properties
protein length:684 AA
molecular weight: 72316,43120 Da
isoelectric point:5,08660
aromaticity:0,07895
hydropathy:-0,10629

Domains

Domains [InterPro]
G3DSA:2.10.10.80
ATT
69–128
G3DSA:2.10.10.80
ATT
69–130
IPR040775
RBD
71–131
IPR015331
RBD
138–684
YP_010582462.1
1 684
Architecture
ATT
STR
ATT 69-130 | STR 131-684
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_010582462.1
1 684
Domain Start End Length (AA) Confidence
N-terminal 1 155 155 0,9942
Central domain 156 597 443 0,9867
C-terminal 598 684 86 0,8867
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-155
Central
156-597
C-terminal
598-684

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage vB_SenS_SE1
[NCBI]
2530161 Uroviricota > Caudoviricetes > Sarkviridae > Cornellvirus > Cornellvirus SE1
Host Salmonella enterica subsp. enterica
[NCBI]
59201 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Salmonella

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_010582462.1 [NCBI]
Genbank nucleotide accession
NC_069151.1 [NCBI]
CDS location
range 16268 -> 18322
strand -
CDS
ATGTCCAGTGGTTGCGGTGATGTAATGTCACTTAACGATTTACAGGTAGCCAAGAAACACCAGATTTTCGAAGCCGAGGTTATCACCGGTAAACAAGGCGGTGTAGCCGGCGGTGCAGATATCGACTACGCCACTAACCCGGTAACCGGGCAGACGCAGAAGACGCTTCCCGCAGTCTTACGTGACGCCGGTTTCTCTCCGGCATCTTTTAACTTCACAACCGGTGGAACCCTGGGGGCTAACGACGCAGATAAAGCGGTTCTTTGGCCGAAAGAAGATGGTGGGGACGGTAACTATTACGCATGGCGTGGCTCCCTGCCGAAAGTTATCCCTGCGGCGTCGACACCTCTTGCGACAGGCGGCATTTCGGATTTCGCTTGGGACGCGTTCGGAGATATTACCTTTCGCGCGGAAGCGGATAAGAAATTTAAGTACTCCGTTAAGCTTTCCGACTTCACTACGTTACAGCAACTAGCGGATGCCGCTGTTGACAGCGTTCTTATCGACCGCGATTACACCTTTACCAATGGTGAAACTGTTAACTTCGGAGGGAAAGTCTTAACCATTGACTGTAAAGCTAAGTTTATTGGTGATGGGGCTTTGATTTTCACTAATATGGGTAGTGGTTCTATAATAGAAAAGCCTTTCATGGAGAGCGCTACGACCCCGTGGGTTATTTACCCCTGGACAGAAGATGGGAAGTGGATTACAGATGCACAAGCTGTCGCTGCTACACTTAAACAATCTAAGACTGAGGGGTATCAACCGGGAGTTAATGATTGGGTCAAGTTCCCTGGTCTTGAGGCATTGATACCACAGAATGTAAAAGACCAGCATGTAGCGTCCACGCTGGATATCCGTGAGTGTGTAGGTATTGAGGTCAGAAGTGCTGGTGGACTTATGGCTGCTTACTTGTTCCGCAACTGTCATCATTGTAAGGTGATTGATTCTGACACCATCATTGGTGGTAAAGAAGGCATCATCACCTTTGAAAACTTAAGTGGTGAGTGGGGCATCGGCAACTATGCCATAGGTGGCCGTGTGCATTATGGCTCAGGTAGTGGTGTGCAGTTCCTTCGAAACAACGGAGGTGCGTCGCACAATGGTGGGGTTATTGGTGTGACGTCATGGCGCGCGGGTGAGTCTGGGTTTAAAACATGGCAAGGCTCTGTAGGTGCCGGTACAGCTCGCAACTATAACCTTCAGTTCCGCGACTCAGTTGCATTATCTCCAGTGTGGGACGGCTTTGACTTAGGCTCAGACCCGGGAATGGCGCCGGAAGACGATAGACCGGGAGATTTACCTGTATCTCAATATCCTATGCATCAGCTACCTAATAACCACATGGTTGATAACATCCTTGTTATGAACTCATTAGGTGTAGGTTTAGGCATGGATGGTCGTGATGGTTATGTGTCGAATGTTACCGTGCAGGATTGTGCAGGCGCTGGTATGCTTGCTCACACATTCAACCGTACCTTCTCTAACATTACGGTGATTGACTGCAACTATATGAACTTTGATTCAGACCAGATAATCATCATTGGTGACTGTATTGTAAATGGCATCCGAGCCGCAGGCATTAAGCCTCAGCCATCCAAAGGTATGGTCATCAGCGCACCTAACTCGACCCTAAGTGGTGTTGTAGGTAACGTGCCACCAGACCGTATTCTTGCTGGTAACATTATTGACTCTGCGTTAGGACAGACAAGGATTAATGGGTTTAATGGTGACTCGGTGGAAATGGGTTTAAGAGTCCACAAGCTTACCAAAACCTTGGATAGTGGTGCTATTCGCTCTACGCTGAATGGGGGCCCCGGTTCTGGTTCCGCTTGGACTGAAATTACGGCTATATCTGGGTCATTACCGGATGCAGTATCGCTAAAAATTAACCGCGGCGACTATCACGCGGTAGAAATACCAGTAGCCGTTACCGTGCTACCCGATGCTGCCGTTAGAGATAATGGCAGCATCGCACTATACCTAGAAGGCGATAGTCTTAAAGCGTTAGTTAAGCGCGCAAATGGTAGCTACACAAGATTAACTTTGGCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
4b60a9df93ae552b43e8b73e615c10a1adee64977b08c36c2ecaea65bef4e1b3
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6971
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50