Genbank accession
AXF42220.1 [GenBank]
Protein name
polygalacturonase tail fiber hydrolase
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MINVKDFSGITPAVQIQNAINAAALATSPSKTVLLEEKDYYLESSLTLLNDVELLFGYRSRLVIGGNFPVLLIGRNASVTNPFIAIDSPNFDSLVFSFDGKNKYYNTWNKTAIKDGVVVNWTGSHKGVGIRLFSGGTDHEISFVDISNVKLVGLRKGIELEAKAPTTGMAWVNANRFNNISIEDCVEMITIDSSETIPNECSGNIFSGLQLQPSIATTKVLKVSGQHNRFDGMLWDISLIPTSKFVDITANSSYTKIDFNRSLPSTKVQDSGASTILL
Physico‐chemical
properties
protein length:278 AA
molecular weight: 30322,11730 Da
isoelectric point:5,66340
aromaticity:0,08633
hydropathy:0,01151

Domains

Domains [InterPro]
IPR012334
STR
2–272
IPR011050
STR
2–201
AXF42220.1
1 278
Architecture
STR
STR 2-278
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AXF42220.1
1 278
Domain Start End Length (AA) Confidence
N-terminal 1 12 12 0,9114
Central domain 13 267 256 0,9902
C-terminal 268 278 10 0,2773
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-12
Central
13-267
C-terminal
268-278

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage Maceta
[NCBI]
2282408 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Bacillus thuringiensis serovar kurstaki
[NCBI]
29339 Bacteria > Firmicutes > Bacilli > Bacillales > Bacillaceae > Bacillus

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AXF42220.1 [NCBI]
Genbank nucleotide accession
MH538296.1 [NCBI]
CDS location
range 42678 -> 43514
strand -
CDS
ATGATAAATGTGAAGGACTTTAGTGGAATAACACCTGCCGTACAGATACAGAATGCTATCAATGCAGCAGCATTAGCAACATCTCCATCAAAGACCGTACTGCTAGAAGAGAAAGATTATTATCTTGAATCATCTCTTACATTGCTAAATGATGTAGAGTTATTGTTTGGCTACCGTTCAAGACTAGTTATCGGTGGTAATTTCCCTGTTTTATTAATAGGGCGAAACGCTTCTGTCACAAATCCATTTATAGCTATCGATTCCCCGAATTTTGATTCACTTGTCTTTTCCTTTGATGGTAAGAATAAATATTACAATACATGGAATAAGACAGCTATAAAAGATGGTGTAGTCGTTAACTGGACAGGTTCTCACAAAGGTGTTGGTATCCGACTCTTTTCTGGAGGAACTGACCATGAGATTTCATTCGTGGATATATCGAATGTCAAATTAGTCGGTCTAAGAAAAGGTATTGAGCTAGAGGCTAAAGCGCCAACAACAGGAATGGCGTGGGTAAATGCTAATAGATTCAATAACATTTCCATAGAAGACTGCGTAGAAATGATTACGATTGACAGTAGTGAGACAATCCCAAATGAATGTAGTGGTAACATTTTCTCAGGACTTCAACTACAACCATCTATAGCAACAACAAAAGTCTTGAAAGTAAGTGGGCAGCATAACCGATTCGATGGTATGCTCTGGGACATCTCATTAATACCTACATCTAAATTCGTAGATATTACAGCGAACAGTTCCTACACTAAAATAGACTTTAATCGTTCCTTACCTAGTACGAAAGTACAAGATAGTGGGGCGAGTACAATATTACTATAG

Genome Context

Genome Context

Tertiary structure

PDB ID
7cc622ca7b9be7b1172a8fb6ec9343c51ee3128185df57f02e3ae1abc10daf77
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8980
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50