Genbank accession
ANN87205.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect
Probability 0,82
TF
Evidence RBPdetect2
Probability 0,88
Protein sequence
MKKDQNLADVANINTARTNLKVDKVVQGASYSDFLSANGAMRLRVQDNNTWGGWNGQWIALSIGNGGTGAADASNARKNLSAFYESSGNLGNTDLNTLTGTKSGIYMQVAVASATPELNYPERTAGTLVVLRNSANSVECCIQFYYPYNNTTNYYARYYNFIGEVSQWTAWNRWVMPRSDDPFRTFIGLGYSSAVRFSSITSRGTSGIFADGENLNLTGSSFISRLYNSNSELVSQAEFRAGASNLQILNRSPGTSGGVAVWEFDKSGRFWSPEGITTATSMNWNNGNATVNRGLFMAGQANAPVDLVHGGIHVGYSNSYAMQIAARDNGFYGRCMENNSWKEWKKFALENTDIVDFLAAGYTADEVYTTKAISYINGRKTHILPATYGVLAAFGTGNTAAAGCYVGHLCWDKDSGRLYTRVRDDGKKVWKDWLKVTTAAVSDESLKDIKGNLNVEGALDNINRMEFKLFRYLNDSPERSTRRGVIAQQVRWIDREYTTKVGDKLHLDTTPMLLDGLAAIQALTKRDNENKEKISRLQKEIEELKAVVDNLLKLHGTSPEDSNMS
Physico‐chemical
properties
protein length:565 AA
molecular weight: 62385,87570 Da
isoelectric point:8,35280
aromaticity:0,10265
hydropathy:-0,43416

Domains

Domains [InterPro]
DC_0195
STR
3–555
cd19958
STR
86–173
IPR030392
CHP
442–534
ANN87205.1
1 565
Architecture
STR
STR 3-555 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
ANN87205.1
1 565
Domain Start End Length (AA) Confidence
N-terminal 1 173 173 0,2683
Central domain 174 372 200 0,1044
C-terminal 373 565 192 0,9793
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-173
Central
174-372
C-terminal
373-565

Taxonomy

  Name Taxonomy ID Lineage
Phage Shigella phage SHSML-45
[NCBI]
1863010 Uroviricota > Caudoviricetes > Demerecviridae > Tequintavirus > Tequintavirus SHSML45
Host Shigella sonnei
[NCBI]
624 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)

No CDS data available.

Genome Context

Genome Context

Tertiary structure

PDB ID
c381b18ef805afae24b0b5f87cd49c92f695662ef02f9b1035688aa9ee3df67e
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7637
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50