Genbank accession
CAB4202353.1 [GenBank]
Protein name
tail spike protein with colonic acid degradation activity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MSVTPSPLGGFAAQFFDNNGVILSGGKIYTYSAGTTTPQATYTSASGATPHANPIVLDSAGRVPGGEIWLTKGLDYKFIIKTSTGVLTGTYNNLQVTSDAVDAVDASLVSYEPPFTGSVATNVENKLAQYVSVKDFGAVGNGVADDTAAIQNAIDYSDSTAIAITGTAEVYFPAGVYKVTSGLTVSRSLRFIGGGWPIIKVAHNTDAITLTGIPSAVIFPRNVQTFEGLVFNTQSGFTPTSIIRLGTSSGLTPTYINSINDVKIVNCVFDQITAAYVIDNNRGFGLVIQNCAFTAITATAVLKMRQTQTEIPYWTYAVNIYASDFTNITGKAIEADGGDLTVFGSIIEGCSAGAVDVGINTAYTGAQPTNFYGTYFEANQVFHYRSNNSRVISNFNGCKFVKGPAATTRIFLASASACTFTACSTPNQAPTITGGNLSFSGCNYMQGTTTATDSVQTDRYIAYTSTPTTAYSLNGVSGYEPIVFGNSPGPGGGGVIMLCSHSGFPASGNSVVETYMIAKRLSGAAVDAVSLGRYENGDTSTFSFGVDASGFLTVTSSQVGKASYALVSQSRYPVALPG
Physico‐chemical
properties
protein length:578 AA
molecular weight: 60254,58090 Da
isoelectric point:5,17987
aromaticity:0,10554
hydropathy:0,11367

Domains

Domains [InterPro]
DC_0138
STR
1–578
IPR012334
STR
90–514
IPR011050
STR
128–441
IPR024535
ENZ
130–353
CAB4202353.1
1 578
Architecture
STR
STR 1-578
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
CAB4202353.1
1 578
Domain Start End Length (AA) Confidence
N-terminal 1 145 145 0,9855
Central domain 146 447 303 0,9926
C-terminal 448 578 130 0,9764
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-145
Central
146-447
C-terminal
448-578

Taxonomy

  Name Taxonomy ID Lineage
Phage uncultured Caudovirales phage
[NCBI]
2100421 Uroviricota > Caudoviricetes > Peduoviridae > Maltschvirus maltsch >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAB4202353.1 [NCBI]
Genbank nucleotide accession
LR797326.1 [NCBI]
CDS location
range 11229 -> 12965
strand +
CDS
ATGTCAGTAACTCCGTCCCCGCTTGGTGGGTTCGCAGCTCAGTTTTTTGACAACAACGGCGTCATTCTGTCGGGCGGTAAGATTTACACCTACTCCGCCGGCACCACTACGCCGCAGGCAACATACACCAGTGCGTCCGGCGCTACGCCGCACGCAAACCCAATCGTCCTGGACAGCGCAGGACGTGTACCGGGCGGCGAGATTTGGTTGACTAAAGGCCTGGACTACAAGTTTATCATTAAGACATCGACAGGCGTCCTAACCGGCACTTATAACAATCTACAGGTTACTTCCGACGCAGTGGACGCAGTGGACGCGTCGCTTGTTAGCTATGAGCCGCCGTTTACCGGCAGCGTGGCTACCAACGTAGAAAACAAGCTGGCCCAATACGTATCGGTCAAAGATTTCGGCGCTGTTGGCAACGGCGTGGCTGATGACACAGCAGCTATTCAGAATGCTATTGATTACTCTGATAGCACGGCAATCGCCATAACAGGTACGGCTGAAGTATATTTTCCCGCGGGAGTTTATAAAGTAACTTCTGGGCTGACCGTTTCACGATCTTTGCGCTTTATTGGCGGTGGCTGGCCCATCATAAAAGTAGCGCATAATACAGACGCTATAACGCTCACGGGTATACCAAGCGCAGTAATATTTCCGCGAAATGTTCAGACTTTTGAAGGGTTAGTTTTTAACACCCAAAGCGGGTTTACACCGACATCAATTATACGGCTCGGCACAAGTTCGGGGTTAACTCCAACTTACATAAACTCAATTAACGATGTTAAAATTGTAAATTGTGTTTTTGACCAAATTACGGCGGCGTATGTTATTGATAACAACCGCGGGTTTGGTTTGGTTATCCAAAATTGCGCGTTTACGGCTATTACCGCTACTGCGGTTCTAAAAATGCGGCAGACACAAACGGAAATACCGTATTGGACTTATGCCGTAAACATTTATGCATCTGATTTTACCAACATTACAGGCAAGGCCATCGAAGCTGACGGCGGCGATTTGACTGTTTTTGGATCAATTATTGAAGGTTGTTCAGCGGGCGCTGTTGATGTCGGTATAAATACTGCGTATACTGGCGCTCAGCCAACCAATTTTTACGGCACGTATTTCGAAGCTAATCAGGTTTTTCATTACCGCTCAAACAATAGCCGTGTCATATCAAATTTTAATGGCTGCAAATTCGTAAAAGGACCGGCGGCTACAACTAGAATTTTCCTAGCTTCAGCATCAGCGTGTACTTTTACTGCTTGCTCAACACCTAACCAGGCCCCCACAATTACCGGCGGAAACTTAAGTTTTAGCGGTTGCAACTATATGCAAGGTACAACAACTGCCACAGACAGCGTTCAAACTGACCGATATATAGCTTACACATCTACACCAACTACAGCTTACTCCTTAAATGGGGTTAGCGGCTATGAGCCGATTGTTTTTGGTAACTCTCCCGGCCCCGGCGGCGGCGGCGTCATCATGCTTTGCTCTCATTCAGGGTTCCCTGCCTCAGGCAATTCGGTCGTAGAAACATATATGATCGCCAAAAGGCTGAGCGGAGCTGCGGTTGATGCTGTAAGTTTAGGTAGATATGAAAACGGGGACACAAGTACGTTTTCGTTCGGCGTAGATGCTAGTGGATTTTTAACTGTCACATCCAGCCAAGTGGGTAAAGCAAGCTATGCCTTGGTATCTCAATCAAGATATCCAGTCGCTTTACCGGGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
33ddd0b305b0f39012edc7ad906ef6b55bcd534cccfce12af38680fa0aba38bf
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7782
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50