UniProt accession
P49714 [UniProt]
Protein name
Tail spike protein
RBP type
TSP
Evidence UniProt/Swiss
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MIQRLGSSLVKFKSKIAGAIWRNLDDKLTEVVSLKDFGAKGDGKTNDQDAVNAAMASGKRIDGAGATYKVSSLPDMERFYNTRFVWERLAGQPLYYVSKGFINGELYKITDNPYYNAWPQDKAFVYENVIYAPYMGSDRHGVSRLHVSWVKSGDDGQTWSTPEWLTDMHPDYPTVNYHCMSMGVCRNRLFAMIETRTLAKNELTNCALWDRPMSRSLHLTGGITKAANQRYATIHVPDHGLFVGDFVNFSNSAVTGVSGDMKVATVIDKDNFTVLTPNQQTSDLNNAGKNWHMGTSFHKSPWRKTDLGLIPRVTEVHSFATIDNNGFVMGYHQGDVAPREVGLFYFPDAFNSPSNYVRRQIPSEYEPDAAEPCIKYYDGVLYLITRGTRGDRLGSSLHRSRDIGQTWESLRFPHNVHHTTLPFAKVGDDLIMFGSERAENEWEAGAPDDRYKASYPRTFYARLNVNNWNADDIEWVNITDQIYQGDIVNSSVGVGSVVVKDSFIYYIFGGENHFNPMTYGDNKDKDPFKGHGHPTDIYCYKMQIANDNRVSRKFTYGATPGQAIPTFMGTDGIRNIPAPLYFSDNIVTEDTKVGHLTLKASTSANIRSEMQMEGEYGFIGKSVPKDKPTGQRLIICGGEGTSSSSGAQITLHGSNSSNAKRITYNGNEHLFQGAPIMPAVDNQFAAGGPSNRFTTIYLGSDPVTTSDADHKYGISSINTKVLKAWSRVGFKQYGLNSEAERNLDSIHFGVLAQDIVAAFEAEGLDAIKYGIVSFEEGRYGVRYSEVLILEAAYTRHRLDKLEEMYATNKIS
Physico‐chemical
properties
protein length:811 AA
molecular weight: 90523,23000 Da
isoelectric point:6,32757
aromaticity:0,11221
hydropathy:-0,46843

Domains

Domains [InterPro]
IPR023366
STR
214–300
IPR001724
Unmapped
288–311
P49714
1 811
Architecture
ATT
STR
RBD
CHP
ATT 2-102 | STR 103-705 | RBD 706-777 | CHP 778-808 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
P49714
1 811
Domain Start End Length (AA) Confidence
N-terminal 1 47 47 0,9613
Central domain 48 281 235 0,7889
C-terminal 282 811 529 0,5729
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-47
Central
48-281
C-terminal
282-811

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage K1E
[NCBI]
344022 Uroviricota > Caudoviricetes > Autographivirales > Molineuxvirinae > Vectrevirus
Host Escherichia coli IHE3034
[NCBI]
714962 Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Escherichia > Escherichia coli

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAA55120.1 [NCBI]
Genbank nucleotide accession
X78310 [NCBI]
CDS location
range 1180 -> 3615
strand +
CDS
ATGATTCAAAGACTAGGTTCTTCATTAGTTAAATTCAAGAGTAAAATAGCAGGTGCAATCTGGCGTAACTTGGATGACAAGCTCACCGAGGTTGTATCGCTTAAAGATTTTGGAGCCAAAGGTGATGGTAAGACAAACGACCAAGATGCAGTAAATGCAGCGATGGCTTCAGGTAAGAGAATTGACGGTGCTGGTGCTACTTACAAAGTATCATCTTTACCTGATATGGAGCGATTCTATAACACCCGCTTCGTATGGGAACGTTTAGCAGGTCAACCTCTTTACTATGTGAGTAAAGGTTTTATCAATGGTGAACTCTATAAAATCACGGATAACCCTTATTACAATGCTTGGCCTCAAGACAAAGCGTTTGTATATGAGAACGTGATATATGCACCTTACATGGGTAGCGACCGTCATGGTGTTAGTCGTCTGCATGTATCATGGGTTAAGTCTGGTGACGATGGTCAAACATGGTCTACTCCAGAGTGGTTAACTGATATGCATCCAGATTACCCTACAGTGAACTATCATTGTATGAGTATGGGTGTATGTCGCAACCGTCTGTTTGCCATGATTGAAACACGTACTTTAGCCAAGAACGAACTAACCAATTGTGCATTGTGGGATCGCCCTATGTCTCGTAGTCTGCATCTTACTGGTGGTATCACTAAGGCTGCAAATCAGAGATATGCAACAATCCATGTACCTGATCACGGACTCTTCGTTGGTGATTTTGTTAACTTCTCTAACTCTGCGGTAACAGGTGTATCTGGTGATATGAAGGTTGCAACAGTAATAGATAAGGACAACTTCACGGTTCTTACACCTAACCAGCAGACTTCAGATTTGAATAACGCTGGAAAGAATTGGCACATGGGTACTTCTTTCCATAAGTCTCCGTGGCGTAAGACAGATCTTGGTCTAATCCCTCGTGTCACAGAGGTGCATAGCTTTGCTACTATTGATAACAATGGCTTTGTTATGGGCTATCATCAAGGTGATGTAGCTCCACGAGAAGTTGGGCTTTTCTACTTCCCTGATGCTTTCAATAGCCCATCTAATTATGTTCGTCGTCAGATACCATCTGAGTATGAACCAGATGCGGCAGAGCCATGCATCAAGTACTATGACGGTGTATTATACCTTATCACTCGTGGTACTCGTGGCGACCGACTAGGAAGCTCTCTGCATCGTAGTAGAGATATAGGTCAGACTTGGGAGTCACTAAGATTTCCACATAATGTGCATCATACTACTTTACCGTTTGCTAAGGTAGGAGATGACCTTATTATGTTTGGTTCAGAACGTGCAGAAAATGAATGGGAAGCAGGTGCACCAGATGATCGTTACAAGGCATCTTATCCTCGTACCTTCTATGCACGATTGAATGTAAACAATTGGAATGCAGATGATATTGAATGGGTTAACATCACAGACCAAATCTATCAGGGTGACATTGTGAACTCTAGTGTAGGTGTAGGTTCTGTTGTAGTTAAAGACAGCTTCATTTACTATATCTTTGGTGGTGAAAACCATTTCAACCCAATGACTTATGGTGACAACAAAGACAAAGACCCATTTAAAGGTCATGGACACCCTACTGATATATACTGCTATAAGATGCAGATTGCAAATGACAATCGTGTATCTCGTAAGTTTACATATGGTGCAACTCCAGGTCAAGCTATACCTACTTTCATGGGTACTGATGGAATACGAAATATCCCTGCACCTTTGTATTTCTCAGATAACATTGTTACAGAGGATACTAAAGTTGGACACTTAACACTTAAAGCAAGCACAAGTGCCAATATACGATCTGAAATGCAGATGGAAGGTGAGTATGGCTTTATTGGCAAGTCTGTTCCAAAGGACAAACCAACAGGTCAACGTTTGATTATTTGTGGTGGAGAAGGGACTTCATCATCTTCAGGTGCACAGATAACTTTGCACGGTTCTAATTCAAGTAATGCTAAGCGTATCACTTATAACGGAAACGAGCACCTATTCCAAGGTGCACCAATCATGCCTGCTGTAGATAACCAGTTTGCTGCTGGTGGACCTAGTAACCGATTCACTACCATCTACCTAGGCAGTGACCCTGTTACAACTTCAGATGCTGACCACAAGTACGGTATCTCTAGTATTAATACCAAGGTGTTAAAGGCTTGGAGCAGGGTTGGTTTTAAACAGTATGGTTTGAATAGTGAAGCAGAGAGGAACCTTGATAGCATACACTTCGGTGTCTTGGCTCAGGATATTGTAGCTGCTTTTGAAGCTGAAGGGTTGGATGCCATTAAGTATGGAATTGTGTCCTTCGAAGAAGGTAGGTATGGTGTGAGATATAGTGAAGTTCTAATCCTAGAGGCTGCCTATACTCGCCATCGTCTTGATAAATTAGAGGAGATGTATGCCACTAATAAAATCAGTTAA

Genbank protein accession
CAA85449.2 [NCBI]
Genbank nucleotide accession
Z36986 [NCBI]
CDS location
range 243 -> 2678
strand +
CDS
ATGATTCAAAGACTAGGTTCTTCATTAGTTAAATTCAAGAGTAAAATAGCAGGTGCAATCTGGCGTAACTTGGATGACAAGCTCACCGAGGTTGTATCGCTTAAAGATTTTGGAGCCAAAGGTGATGGTAAGACAAACGACCAAGATGCAGTAAATGCAGCGATGGCTTCAGGTAAGAGAATTGACGGTGCTGGTGCTACTTACAAAGTATCATCTTTACCTGATATGGAGCGATTCTATAACACCCGCTTCGTATGGGAACGTTTAGCAGGTCAACCTCTTTACTATGTGAGTAAAGGTTTTATCAATGGTGAACTCTATAAAATCACGGATAACCCTTATTACAATGCTTGGCCTCAAGACAAAGCGTTTGTATATGAGAACGTGATATATGCACCTTACATGGGTAGCGACCGTCATGGTGTTAGTCGTCTGCATGTATCATGGGTTAAGTCTGGTGACGATGGTCAAACATGGTCTACTCCAGAGTGGTTAACTGATATGCATCCAGATTACCCTACAGTGAACTATCATTGTATGAGTATGGGTGTATGTCGCAACCGTCTGTTTGCCATGATTGAAACACGTACTTTAGCCAAGAACGAACTAACCAATTGTGCATTGTGGGATCGCCCTATGTCTCGTAGTCTGCATCTTACTGGTGGTATCACTAAGGCTGCAAATCAGAGATATGCAACAATCCATGTACCTGATCACGGACTCTTCGTTGGTGATTTTGTTAACTTCTCTAACTCTGCGGTAACAGGTGTATCTGGTGATATGAAGGTTGCAACAGTAATAGATAAGGACAACTTCACGGTTCTTACACCTAACCAGCAGACTTCAGATTTGAATAACGCTGGAAAGAATTGGCACATGGGTACTTCTTTCCATAAGTCTCCGTGGCGTAAGACAGATCTTGGTCTAATCCCTCGTGTCACAGAGGTGCATAGCTTTGCTACTATTGATAACAATGGCTTTGTTATGGGCTATCATCAAGGTGATGTAGCTCCACGAGAAGTTGGGCTTTTCTACTTCCCTGATGCTTTCAATAGCCCATCTAATTATGTTCGTCGTCAGATACCATCTGAGTATGAACCAGATGCGGCAGAGCCATGCATCAAGTACTATGACGGTGTATTATACCTTATCACTCGTGGTACTCGTGGCGACCGACTAGGAAGCTCTCTGCATCGTAGTAGAGATATAGGTCAGACTTGGGAGTCACTAAGATTTCCACATAATGTGCATCATACTACTTTACCGTTTGCTAAGGTAGGAGATGACCTTATTATGTTTGGTTCAGAACGTGCAGAAAATGAATGGGAAGCAGGTGCACCAGATGATCGTTACAAGGCATCTTATCCTCGTACCTTCTATGCACGATTGAATGTAAACAATTGGAATGCAGATGATATTGAATGGGTTAACATCACAGACCAAATCTATCAGGGTGACATTGTGAACTCTAGTGTAGGTGTAGGTTCTGTTGTAGTTAAAGACAGCTTCATTTACTATATCTTTGGTGGTGAAAACCATTTCAACCCAATGACTTATGGTGACAACAAAGACAAAGACCCATTTAAAGGTCATGGACACCCTACTGATATATACTGCTATAAGATGCAGATTGCAAATGACAATCGTGTATCTCGTAAGTTTACATATGGTGCAACTCCAGGTCAAGCTATACCTACTTTCATGGGTACTGATGGAATACGAAATATCCCTGCACCTTTGTATTTCTCAGATAACATTGTTACAGAGGATACTAAAGTTGGACACTTAACACTTAAAGCAAGCACAAGTGCCAATATACGATCTGAAATGCAGATGGAAGGTGAGTATGGCTTTATTGGCAAGTCTGTTCCAAAGGACAAACCAACAGGTCAACGTTTGATTATTTGTGGTGGAGAAGGGACTTCATCATCTTCAGGTGCACAGATAACTTTGCACGGTTCTAATTCAAGTAATGCTAAGCGTATCACTTATAACGGAAACGAGCACCTATTCCAAGGTGCACCAATCATGCCTGCTGTAGATAACCAGTTTGCTGCTGGTGGACCTAGTAACCGATTCACTACCATCTACCTAGGCAGTGACCCTGTTACAACTTCAGATGCTGACCACAAGTACGGTATCTCTAGTATTAATACCAAGGTGTTAAAGGCTTGGAGCAGGGTTGGTTTTAAACAGTATGGTTTGAATAGTGAAGCAGAGAGGAACCTTGATAGCATACACTTCGGTGTCTTGGCTCAGGATATTGTAGCTGCTTTTGAAGCTGAAGGGTTGGATGCCATTAAGTATGGAATTGTGTCCTTCGAAGAAGGTAGGTATGGTGTGAGATATAGTGAAGTTCTAATCCTAGAGGCTGCCTATACTCGCCATCGTCTTGATAAATTAGAGGAGATGTATGCCACTAATAAAATCAGTTAA

Genbank protein accession
CAJ29458.1 [NCBI]
Genbank nucleotide accession
AM084415 [NCBI]
CDS location
range 42222 -> 44657
strand +
CDS
ATGATTCAAAGACTAGGTTCTTCATTAGTTAAATTCAAGAGTAAAATAGCAGGTGCAATCTGGCGTAACTTGGATGACAAGCTCACCGAGGTTGTATCGCTTAAAGATTTTGGAGCCAAAGGTGATGGTAAGACAAACGACCAAGATGCAGTAAATGCAGCGATGGCTTCAGGTAAGAGAATTGACGGTGCTGGTGCTACTTACAAAGTATCATCTTTACCTGATATGGAGCGATTCTATAACACCCGCTTCGTATGGGAACGTTTAGCAGGTCAACCTCTTTACTATGTGAGTAAAGGTTTTATCAATGGTGAACTCTATAAAATCACGGATAACCCTTATTACAATGCTTGGCCTCAAGACAAAGCGTTTGTATATGAGAACGTGATATATGCACCTTACATGGGTAGCGACCGTCATGGTGTTAGTCGTCTGCATGTATCATGGGTTAAGTCTGGTGACGATGGTCAAACATGGTCTACTCCAGAGTGGTTAACTGATATGCATCCAGATTACCCTACAGTGAACTATCATTGTATGAGTATGGGTGTATGTCGCAACCGTCTGTTTGCCATGATTGAAACACGTACTTTAGCCAAGAACGAACTAACCAATTGTGCATTGTGGGATCGCCCTATGTCTCGTAGTCTGCATCTTACTGGTGGTATCACTAAGGCTGCAAATCAGAGATATGCAACAATCCATGTACCTGATCACGGACTCTTCGTTGGTGATTTTGTTAACTTCTCTAACTCTGCGGTAACAGGTGTATCTGGTGATATGAAGGTTGCAACAGTAATAGATAAGGACAACTTCACGGTTCTTACACCTAACCAGCAGACTTCAGATTTGAATAACGCTGGAAAGAATTGGCACATGGGTACTTCTTTCCATAAGTCTCCGTGGCGTAAGACAGATCTTGGTCTAATCCCTCGTGTCACAGAGGTGCATAGCTTTGCTACTATTGATAACAATGGCTTTGTTATGGGCTATCATCAAGGTGATGTAGCTCCACGAGAAGTTGGGCTTTTCTACTTCCCTGATGCTTTCAATAGCCCATCTAATTATGTTCGTCGTCAGATACCATCTGAGTATGAACCAGATGCGGCAGAGCCATGCATCAAGTACTATGACGGTGTATTATACCTTATCACTCGTGGTACTCGTGGCGACCGACTAGGAAGCTCTCTGCATCGTAGTAGAGATATAGGTCAGACTTGGGAGTCACTAAGATTTCCACATAATGTGCATCATACTACTTTACCGTTTGCTAAGGTAGGAGATGACCTTATTATGTTTGGTTCAGAACGTGCAGAAAATGAATGGGAAGCAGGTGCACCAGATGATCGTTACAAGGCATCTTATCCTCGTACCTTCTATGCACGATTGAATGTAAACAATTGGAATGCAGATGATATTGAATGGGTTAACATCACAGACCAAATCTATCAGGGTGACATTGTGAACTCTAGTGTAGGTGTAGGTTCTGTTGTAGTTAAAGACAGCTTCATTTACTATATCTTTGGTGGTGAAAACCATTTCAACCCAATGACTTATGGTGACAACAAAGACAAAGACCCATTTAAAGGTCATGGACACCCTACTGATATATACTGCTATAAGATGCAGATTGCAAATGACAATCGTGTATCTCGTAAGTTTACATATGGTGCAACTCCAGGTCAAGCTATACCTACTTTCATGGGTACTGATGGAATACGAAATATCCCTGCACCTTTGTATTTCTCAGATAACATTGTTACAGAGGATACTAAAGTTGGACACTTAACACTTAAAGCAAGCACAAGTGCCAATATACGATCTGAAATGCAGATGGAAGGTGAGTATGGCTTTATTGGCAAGTCTGTTCCAAAGGACAAACCAACAGGTCAACGTTTGATTATTTGTGGTGGAGAAAGGACTTCATCATCTTCAGGTGCACAGATAACTTTGCACGGTTCTAATTCAAGTAAGGCTAAGCGTATCACTTATAACGGAAACGAGCACCTATTCCAAGGTGCACCAATCATGCCTGCTGTAGATAACCAGTTTGCTGCTGGTGGACCTAGTAACCGATTCACTACCATCTACCTAGGCAGTGACCCTGTTACAACTTCAGATGCTGACCACAAGTACGGTATCTCTAGTATTAATACCAAGGTGTTAAAGGCTTGGAGCAGGGTTGGTTTTAAACAGTATGGTTTGAATAGTGAAGCAGAGAGGAACCTTGATAGCATACACTTCGGTGTCTTGGCTCAGGATATTGTAGCTGCTTTTGAAGCTGAAGGGTTGGATGCCATTAAGTATGGAATTGTGTCCTTCGAAGAAGGTAGGTATGGTGTGAGATATAGTGAAGTTCTAATCCTAGAGGCTGCCTATACTCGCCATCGTCTTGATAAATTAGAGGAGATGTATGCCACTAATAAAATCAGTTAA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0098024 virus tail, fiber Cellular Component IEA:UniProtKB-KW (UniProt)
GO:0016996 endo-alpha-(2,8)-sialidase activity Molecular Function IEA:UniProtKB-EC (UniProt)
GO:0098671 adhesion receptor-mediated virion attachment to host cell Biological Process IEA:UniProtKB-KW (UniProt)
GO:0098994 symbiont entry into host cell via disruption of host cell envelope Biological Process IEA:UniProtKB-KW (UniProt)
GO:0098996 symbiont entry into host cell via disruption of host cell glycocalyx Biological Process IEA:UniProtKB-KW (UniProt)

Tertiary structure

PDB ID
b551d916cc1db3c5441e31a7903600a6805918434292e21eafd57c2ab0509f96
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6748
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
— — 11994155 PubMed