Genbank accession
AXF41888.1 [GenBank]
Protein name
polygalacturonase tail fiber hydrolase
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,90
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MIYVKDFSGITEAVKIQNAINAAALPTSSSKTVMLEEKDYYLESSLTLLNDVELLFGYRSRLVIGGNFPVLLIGRNASVTNPFIAIDAPTFDSPVFYLDGKNKYYSTWNKTAIKDGVVLNWTGSHKGVGIRFYSGGIDHEISFVDTSNIKLVGLRKGIELEAKAPATGMAWVNANRFNNISIEDCVEMITIDSSETIPNECSGNIFSGLQLQPSTATTKVLKVSGQHNRFDGMLWDISLIPTSKFVDITANSSYTKIDFNRSLPSTKVQDNGASTILL
Physico‐chemical
properties
protein length:278 AA
molecular weight: 30470,29590 Da
isoelectric point:5,67790
aromaticity:0,09353
hydropathy:-0,03165

Domains

Domains [InterPro]
IPR011050
STR
15–204
AXF41888.1
1 278
Architecture
STR
RBD
STR 15-204 | RBD 213-278
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AXF41888.1
1 278
Domain Start End Length (AA) Confidence
N-terminal 1 12 12 0,8737
Central domain 13 267 256 0,9933
C-terminal 268 278 10 0,2567
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-12
Central
13-267
C-terminal
268-278

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage Saddex
[NCBI]
2282402 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Bacillus thuringiensis serovar kurstaki
[NCBI]
29339 Bacteria > Firmicutes > Bacilli > Bacillales > Bacillaceae > Bacillus

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AXF41888.1 [NCBI]
Genbank nucleotide accession
MH538193.1 [NCBI]
CDS location
range 33855 -> 34691
strand +
CDS
ATGATATATGTGAAGGATTTTAGTGGGATTACCGAGGCTGTCAAGATACAGAATGCTATCAATGCAGCAGCTTTACCAACTTCTTCATCAAAGACCGTAATGCTAGAAGAGAAAGATTATTACCTAGAGTCATCTCTTACTTTGTTAAATGATGTAGAATTACTGTTCGGCTATCGCTCAAGATTAGTTATTGGTGGTAATTTCCCAGTCCTATTAATAGGGCGTAATGCTTCTGTTACAAATCCATTCATAGCTATCGATGCTCCGACTTTCGATTCACCTGTATTTTATCTAGATGGTAAAAATAAATATTACAGTACATGGAATAAGACCGCGATAAAAGATGGAGTAGTTCTCAACTGGACAGGTTCTCATAAAGGTGTAGGTATCCGATTCTACTCTGGAGGAATTGACCATGAGATTTCATTTGTAGATACATCGAATATCAAACTAGTAGGTTTAAGAAAAGGTATAGAACTAGAAGCTAAGGCTCCAGCTACTGGAATGGCATGGGTGAACGCTAACCGATTCAATAACATCTCTATAGAAGACTGTGTAGAAATGATTACGATTGACAGTAGCGAAACAATACCGAACGAATGTAGCGGTAACATCTTCTCAGGTTTGCAACTACAACCATCTACTGCAACTACAAAAGTCTTAAAGGTAAGTGGACAGCATAACCGATTCGATGGTATGCTCTGGGATATATCTTTAATACCTACATCTAAGTTTGTAGATATTACAGCGAACAGCTCCTACACAAAAATAGACTTCAATCGTTCATTACCTAGTACGAAAGTACAAGATAATGGAGCAAGCACAATTCTACTGTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
109eba7495e9bb0acc0ed4e1fcdeb5ee815a23f1b792da9213ec14cb1569011d
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,9209
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50