Genbank accession
CAL9991846.1 [GenBank]
Protein name
tail spike protein with colonic acid degradation activity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,86
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MFYNAMSRWSNTTIRDLHFDGSNNYPTDKSVYYGDVAINNVMIRKSGACTDVTIQDCYFTKASTSSIYVSDGDHTTSLKIINNKFNDGNYKLKTIGIYGSNNVSDAKAPRGIEVSGNVINGGGSRIHKDGRIEGFTSSTDAIHLDNCRHSIISKNIIRENSGDAIRVEQSKYIMVSDNSIYRSGSAGITVYHSSQRCSIIGNTIDGWGYTIQAYCIRSHGGKYYICREFPDATHAVLPTDPSTVSWIIECPYNLTGIDTSTILPYSSTDYYSSGSSTGILPFRGSSAISVTSSSYAVKIIGNICNGNTSKDASNKYHTASEHGYSNKHTVNSPVGVTGDSNTVSGNAFSNCQGHELYAGEYQDPINQRGKSGLQYISDDNSYSAHRGHGKNTDKYYTIHDNLSITSGGGEFTPTLTPSTSGSITLTGAYNALSWYRVGQMVTISGQIRVGSVSSPVGGVKIEGLPFTQLNLADGAERVAGVALCNNVEAATPPITQFFVSGAGNVMWISGTTGTTTRNIGDLIKSGTVIDVNFTYRTQI
Physico‐chemical
properties
protein length:539 AA
molecular weight: 57994,41740 Da
isoelectric point:6,93177
aromaticity:0,09091
hydropathy:-0,34082

Domains

Domains [InterPro]
IPR012334
STR
2–233
IPR012334
STR
2–225
IPR006626
Unmapped
9–35
IPR011050
STR
10–212
CAL9991846.1
1 539
Architecture
STR
STR 2-539
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
CAL9991846.1
1 539
Domain Start End Length (AA) Confidence
N-terminal 1 10 10 0,0044
Central domain 11 210 201 0,9963
C-terminal 211 539 328 0,5945
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-10
Central
11-210
C-terminal
211-539

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage K474
[NCBI]
3105742 Viruses > unclassified bacterial viruses >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAL9991846.1 [NCBI]
Genbank nucleotide accession
OZ195913.1 [NCBI]
CDS location
range 87001 -> 88620
strand -
CDS
ATGTTCTATAATGCCATGTCTCGTTGGTCGAATACTACAATTCGAGACTTACATTTTGATGGTAGTAATAATTACCCTACCGACAAAAGCGTATATTACGGCGACGTGGCCATAAACAATGTTATGATTCGAAAATCTGGAGCGTGTACAGATGTTACTATCCAAGACTGCTATTTCACAAAGGCGTCAACTAGTAGCATTTATGTATCGGACGGTGACCACACCACTAGTTTGAAAATCATCAATAACAAATTCAATGACGGTAACTATAAACTGAAAACTATAGGAATTTATGGTTCTAACAACGTGTCTGACGCTAAAGCCCCTCGCGGTATTGAGGTTAGTGGTAATGTTATCAATGGAGGCGGGTCACGAATACACAAAGACGGGCGTATTGAGGGGTTCACTTCGTCAACTGATGCTATCCACTTAGACAACTGTAGACATTCAATAATCAGTAAGAATATCATTCGTGAGAATAGCGGTGATGCAATTCGGGTTGAACAATCGAAGTATATCATGGTATCTGACAATAGCATTTACCGTTCTGGTTCTGCTGGTATCACAGTGTACCATTCATCACAACGTTGTTCTATTATAGGAAACACTATCGATGGTTGGGGTTACACTATCCAAGCGTATTGTATCCGATCGCACGGCGGGAAGTATTACATATGTCGAGAGTTCCCCGACGCAACTCACGCAGTATTACCTACTGACCCTAGTACTGTGTCTTGGATTATAGAGTGCCCATACAACCTCACAGGGATTGATACGTCGACTATTTTACCTTATAGTTCTACTGATTATTACTCTAGCGGTTCGTCCACTGGTATCCTCCCGTTCCGAGGGTCAAGTGCTATATCAGTAACAAGTTCATCTTACGCAGTGAAAATTATAGGTAATATATGTAATGGTAACACGAGCAAAGATGCTAGTAATAAGTACCACACCGCGAGCGAACATGGATACTCAAATAAACATACAGTGAATAGTCCGGTTGGCGTTACAGGTGATTCGAATACTGTGTCAGGTAATGCGTTTTCTAATTGTCAAGGGCATGAACTATACGCGGGTGAATATCAAGACCCCATAAACCAACGCGGGAAATCAGGCTTGCAATATATCAGTGATGATAATTCATACAGCGCACATCGCGGCCATGGTAAGAATACTGACAAATATTATACGATTCATGACAACTTATCAATAACATCAGGCGGGGGTGAGTTCACCCCAACATTGACGCCGTCAACATCAGGTAGCATTACATTGACGGGGGCGTACAACGCTTTATCGTGGTATCGTGTCGGACAGATGGTGACAATATCAGGCCAAATACGCGTGGGGAGTGTTAGCTCGCCAGTAGGCGGCGTCAAGATTGAAGGTCTACCATTTACACAATTGAACCTTGCTGATGGGGCTGAACGCGTGGCGGGTGTGGCGTTATGCAATAATGTAGAAGCGGCCACGCCGCCTATCACCCAATTCTTTGTATCGGGAGCGGGTAATGTTATGTGGATATCAGGAACAACAGGAACAACAACACGCAACATCGGCGATTTGATAAAATCTGGAACCGTCATCGATGTGAACTTCACATATCGTACACAGATATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
6c1efb1f218c67215fa7ffd3080a4a8c19ab072b61c5d8b295d2967ccba24d73
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6995
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50