Genbank accession
AGO49026.1 [GenBank]
Protein name
structural protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
Protein sequence
MAEQILTDRDEIVNVSDDDYIHVVDVSDTTDDPTGTSKKVKKVNFLTSLVVPAKYVWVKYADLPDGTGLYSTPTQNTAYIGIATNKDTEVPSIDKADYSWSRFKGEDGSSNINLGFIFTSNIVLDSSQNKVTRLSGSGWDAQVYSSLSYLGGCSVQSSPTTKMSSFMFGLSDNPTSSISFDHIDYAILLRSNGSKAIYESGSAVGEFGTYEIGDKFNIEYDNQTIKYYQNGNLLRTLSTTENRTFHFGSSFGTSAQNITEYITFIPIGAKGSDGTNGTNGTNGTNGAKGDKGDIGPTGPSGISGPSIVYRGLFANGTTYYNNTQRRDVVKYGSVFYIYKGTNGANNTSWSSSNWENFGVQFESVATNLLLAESANIADWIISNGKITSQNQSTGRANAVLNGVDGRITFNGRTYVLASSGSGGTTVDSFTVIDNEGLLIERASGSSQQASNVQIKPDQININAAAPLDASSYGSPRVAIYSSVNVNSNNIGTGINFVAAVLGKVNNTSSSPAPSYGGYFEGLYAEGVHVRSRSITSTTYLDDMDYYVDCVNSSDITVYLPSSPNNGRIVRICRGRDDVLVNGNGKTIKFRNDNLSTINVSYDGNTAELIYVQSGNYWRYSELSRKF
Physico‐chemical
properties
protein length:626 AA
molecular weight: 67507,18160 Da
isoelectric point:4,99753
aromaticity:0,10383
hydropathy:-0,37109

Domains

Domains [InterPro]
DC_1260
STR
7–474
AGO49026.1
1 626
Architecture
STR
STR 7-474 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AGO49026.1
1 626
Domain Start End Length (AA) Confidence
N-terminal 1 115 115 0,9959
Central domain 116 314 200 0,4248
C-terminal 315 626 311 0,3276
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-115
Central
116-314
C-terminal
315-626

Taxonomy

  Name Taxonomy ID Lineage
Phage Cellulophaga phage phi13:1
[NCBI]
1327992 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Cellulophaga baltica
[NCBI]
76594 cellular organisms > Bacteria > Pseudomonadati > FCB group > Bacteroidota/Chlorobiota group > Bacteroidota

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AGO49026.1 [NCBI]
Genbank nucleotide accession
KC821625 [NCBI]
CDS location
range 7573 -> 9453
strand +
CDS
ATGGCTGAACAAATTTTAACAGATAGAGATGAGATTGTTAATGTTTCTGATGATGATTACATTCATGTTGTCGACGTTTCGGATACGACAGATGATCCAACAGGAACATCGAAAAAAGTAAAAAAAGTAAATTTTTTAACAAGCTTAGTTGTTCCAGCAAAATATGTTTGGGTTAAGTATGCAGATCTTCCAGATGGAACTGGATTGTATTCAACGCCTACTCAAAATACAGCATATATTGGAATAGCTACAAATAAAGATACTGAAGTTCCAAGTATAGACAAAGCAGATTATTCTTGGAGTAGATTTAAAGGTGAAGATGGAAGCTCAAATATAAATTTAGGATTTATTTTCACTAGTAATATTGTACTAGATTCGAGCCAAAACAAGGTAACTAGATTATCTGGTTCAGGATGGGATGCTCAAGTTTACTCATCATTAAGTTATTTGGGTGGATGTAGTGTTCAATCTTCACCAACAACCAAAATGTCATCTTTTATGTTTGGACTTAGTGATAATCCAACGAGCTCAATATCTTTTGATCATATTGATTATGCTATTTTGTTGAGAAGTAATGGTTCGAAAGCTATATACGAAAGTGGTTCAGCGGTTGGTGAATTTGGAACTTATGAAATTGGTGATAAATTCAATATAGAGTACGATAATCAAACTATAAAATACTATCAAAATGGTAATTTATTAAGAACATTATCTACAACAGAAAATAGAACATTTCATTTCGGAAGTTCATTCGGAACAAGTGCACAAAACATTACTGAATACATAACATTTATTCCAATTGGAGCAAAAGGTTCTGATGGAACTAATGGAACGAATGGAACGAATGGAACGAATGGAGCAAAAGGCGATAAAGGTGATATTGGACCAACTGGACCAAGTGGTATTTCTGGACCTTCTATAGTTTATAGAGGTTTGTTTGCAAATGGAACAACTTATTATAATAATACACAACGAAGAGATGTTGTAAAATATGGAAGCGTATTTTATATTTATAAAGGAACTAATGGTGCAAATAATACATCTTGGTCAAGCTCTAATTGGGAAAATTTTGGAGTTCAATTTGAATCAGTTGCGACAAATCTATTATTAGCAGAAAGTGCAAATATAGCAGATTGGATTATTTCAAATGGCAAAATAACTAGTCAAAATCAATCAACTGGTAGAGCGAATGCTGTATTAAATGGAGTTGATGGAAGAATTACTTTCAATGGAAGAACTTATGTTTTAGCTTCAAGTGGTTCAGGTGGCACAACTGTAGATAGTTTTACAGTAATAGATAATGAAGGGTTACTCATAGAGAGAGCATCAGGATCTAGTCAACAAGCATCGAACGTTCAAATAAAACCAGATCAAATTAATATAAATGCAGCCGCTCCATTAGATGCATCTTCATATGGATCACCAAGAGTTGCTATTTATTCGAGCGTAAACGTTAATTCAAATAATATCGGAACAGGTATTAATTTCGTTGCAGCCGTTTTAGGTAAAGTTAACAATACATCTTCTAGCCCAGCACCTTCTTATGGAGGTTATTTTGAAGGCTTATATGCTGAAGGTGTGCATGTTAGATCAAGATCTATAACGTCAACAACTTATTTAGATGATATGGATTATTATGTTGATTGTGTCAATTCATCAGATATTACAGTATACTTACCTTCTAGTCCTAATAATGGACGAATAGTTCGTATATGTAGAGGTCGCGATGATGTTTTAGTAAATGGTAACGGAAAGACTATAAAATTTAGAAATGATAATTTAAGTACTATAAATGTCTCTTATGATGGTAATACAGCAGAATTGATATATGTTCAATCTGGAAATTACTGGAGATATTCTGAATTATCTAGAAAATTTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
6d46ff0133e031f2ce37dc20d32a4658ea210e55ebc3b525c609bd7ea58788c8
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7476
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50