Genbank accession
CAM8750971.1 [GenBank]
Protein name
tail spike protein with colonic acid degradation activity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MLTDFNRPQGSTASLLRNGADIDSAIRYVTPEMFESKITSDSDWSDALIAADAFATDNNLQLRGNGGVYPVSRFITFNCADVDGINIIPTTGSVNAGCQFYINQSTGVCKIRNFSANGFYRYGGRVWRKNFVGQAKVILENCEFSNNGKLQRTTCVNAIDTSTDYVVSVTDSTGFAANDLIWIGDSKFKILSISGNAITLVNDGTKPTLQDGGTGTYDAGQYFTKDQNGNNGFVIGNAEEAWSIEFIGRNKFNNNGWSGLFCYSKSHSAGIVNVSNAEASGNGYIGLGFGYADAGEIRNNICCYNSNNGIDMFEGSSQVVFINNKSNYNGVDGLFASGNGTGPLITGNDCRNNKRIGILAYGRGTAASGMNITNNLVDGNYRNGMNLMGVYTSVIEGNTFSSPNGQALRIEGKNGLLNPQGIIVSKNYFLTSSTGGDIRAFIGGYTSGGDNGGIMVVDNYYFGRKPDVVITGLNHPRSIFRPAGYLGFTASLTATTGSAISVSLSFFKPNNTAVIDSSAGIVEMQLFSDTAQTNLTTVNVATRTSGVEISNGGSTNGHIIASAAYGSLSYNFTNNTAGTKYLFVKSDYGNAVITLIWS
Physico‐chemical
properties
protein length:598 AA
molecular weight: 63605,71790 Da
isoelectric point:5,57434
aromaticity:0,10535
hydropathy:-0,16572

Domains

Domains [InterPro]
IPR012334
STR
246–478
IPR039448
ENZ
247–400
CAM8750971.1
1 598
Architecture
ATT
STR
RBD
ATT 1-61 | STR 193-478 | RBD 479-598
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
CAM8750971.1
1 598
Domain Start End Length (AA) Confidence
N-terminal 1 41 41 0,9326
Central domain 42 484 444 0,9929
C-terminal 485 598 113 0,9869
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-41
Central
42-484
C-terminal
485-598

Taxonomy

  Name Taxonomy ID Lineage
Phage Klebsiella phage vB_KpM_Centimanus
[NCBI]
3369487 Viruses >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAM8750971.1 [NCBI]
Genbank nucleotide accession
OZ240615.1 [NCBI]
CDS location
range 292678 -> 294474
strand -
CDS
ATGTTGACCGATTTTAACAGGCCGCAGGGTAGTACAGCTTCCTTATTAAGGAACGGCGCAGATATTGATAGTGCAATACGTTACGTCACTCCTGAAATGTTCGAAAGTAAAATAACTTCAGATTCAGATTGGTCAGACGCCCTCATTGCAGCAGACGCCTTTGCTACGGATAACAACTTACAATTACGAGGAAACGGTGGGGTCTACCCAGTTAGTCGTTTTATAACCTTTAACTGTGCGGATGTCGACGGAATTAATATTATACCCACCACTGGGAGCGTTAATGCCGGTTGTCAATTTTACATCAATCAAAGCACCGGTGTGTGTAAAATACGCAATTTCTCAGCGAATGGGTTTTATCGGTACGGTGGACGTGTTTGGCGAAAGAATTTTGTAGGACAGGCAAAGGTTATATTAGAAAACTGTGAATTTTCCAATAACGGAAAGTTACAAAGAACAACTTGCGTCAACGCTATTGATACTTCAACAGACTACGTTGTCAGCGTTACTGATTCAACGGGATTTGCAGCTAATGATCTTATTTGGATTGGTGACTCTAAATTTAAAATACTATCGATTTCTGGTAACGCCATTACTTTAGTAAATGACGGAACTAAACCAACATTACAAGACGGTGGTACGGGTACGTACGATGCCGGTCAATATTTTACTAAAGATCAGAACGGTAATAACGGTTTCGTAATCGGGAACGCCGAAGAAGCTTGGTCTATTGAATTTATAGGGAGAAACAAATTCAATAATAATGGATGGTCCGGGTTGTTTTGTTACTCGAAATCCCATTCGGCAGGAATTGTTAATGTTTCAAATGCTGAAGCGAGTGGTAATGGTTATATCGGATTAGGTTTTGGCTATGCCGATGCCGGGGAAATTAGAAATAATATTTGTTGCTATAACAGTAATAACGGCATTGACATGTTTGAAGGATCTTCTCAGGTTGTGTTTATAAACAACAAGTCCAATTATAACGGTGTCGACGGTTTATTCGCATCGGGTAATGGTACAGGTCCTTTAATCACAGGTAACGACTGTAGAAATAATAAGCGTATAGGCATTCTTGCTTACGGTCGAGGTACGGCAGCAAGTGGAATGAACATTACCAACAACCTTGTTGATGGTAATTACCGTAACGGTATGAACCTAATGGGTGTATACACGTCGGTTATTGAAGGAAATACATTCTCTTCACCTAATGGCCAGGCATTAAGAATAGAAGGTAAAAATGGACTCCTCAACCCTCAAGGGATAATCGTTTCGAAAAACTATTTCCTGACCTCCAGTACCGGTGGTGACATCCGAGCTTTTATCGGTGGTTATACATCTGGTGGCGATAATGGCGGCATTATGGTTGTCGATAATTACTATTTTGGTAGAAAACCTGACGTAGTGATTACCGGTTTAAACCATCCGCGGTCTATTTTTAGACCGGCTGGGTACTTAGGTTTTACTGCCAGCCTCACTGCAACAACAGGGAGTGCAATTAGCGTTTCTCTGTCTTTCTTCAAACCGAACAACACCGCTGTTATCGATTCTAGTGCGGGAATAGTCGAAATGCAACTCTTTTCTGACACCGCACAAACTAATCTGACGACAGTTAATGTAGCAACAAGAACATCGGGGGTTGAAATTTCCAACGGTGGGTCGACTAATGGGCACATCATCGCTTCCGCGGCCTATGGATCTTTGTCTTATAACTTCACTAATAATACGGCAGGGACTAAATATTTATTCGTTAAGAGTGATTACGGCAATGCAGTTATTACGTTAATTTGGAGTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
d3dce380cc1d1c53a8cd49e448d88b8e667c15602e43826fa805fd46eb48b7fe
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7735
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50