Genbank accession
CBX44539.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,90
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MAEQKVKLTQLPAANDTSDTAQLLVNQNQTDQRLPVTHFLRAKNNLSDIQDNVQARANLGATSPDEVDNKIKNLFDGKATFLNGGSLASKKDLIWDDSSKSWYFWSGNLPKQVPAASSPQDTGGVSSGAWVSVGNSTLSSTEEGLGDALIGVKQPYAGAVARTQHDKNSDALSVKDFGAKGDGVTDDTNAIQALIDLAKEKNIAGFPLAVYLPPGTYIVDSLTIYAHTVMYGAGRATIIRRKPGGSKSVIYGVNSSSLWGTTSSNATEFAYNFTLSDFVVDGGVDGKNVPFSSSLTGHGIAIWGSRYRMFNIDIINCAEKGIYTDYIDQNLDYLAPWFESSIFSIRINNCGKEGWHCAGPHDAAIHDVGIINGSRIGNALYDGFYVTKTMSGNIGNLHVSNAEDNTGTGESIRHRYAGNIEGPCRFYGGTTFEGAKDCVRIASSGIQFDDSCTFYIPWGDGYNGTVMWIEAGVAFCIIRGKFGGAGSFRPQNNWGIRLRPGTGSASNNDIEVLMEGIQIPISFGNSTTSPDADGGKNRFKITAYYSASSGNGSPSSYGVPNTANGTELDMIFSGNSNSRIKSAIQTKVTTMASGASYTWNYKYPFLESPAVSIAIVGIGGTPTGQLYSAGVSSTQAVFHNGTGQSLTLHATATMRVSE
Physico‐chemical
properties
protein length:658 AA
molecular weight: 70067,93600 Da
isoelectric point:5,81539
aromaticity:0,09574
hydropathy:-0,26778

Domains

Domains [InterPro]
G3DSA:2.10.10.80
ATT
78–131
IPR024535
ENZ
173–273
CBX44539.1
1 658
Architecture
ATT
RBD
ATT
STR
ATT 1-42 | RBD 67-77 | ATT 78-131 | STR 132-412 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
CBX44539.1
1 658
Domain Start End Length (AA) Confidence
N-terminal 1 186 186 0,9928
Central domain 187 574 389 0,9881
C-terminal 575 658 83 0,9869
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-186
Central
187-574
C-terminal
575-658

Taxonomy

  Name Taxonomy ID Lineage
Phage Erwinia phage phiEt88
[NCBI]
925984 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Erwinia tasmaniensis
[NCBI]
338565 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Erwinia

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CBX44539.1 [NCBI]
Genbank nucleotide accession
FQ482085.1 [NCBI]
CDS location
range 20276 -> 22252
strand +
CDS
ATGGCAGAACAAAAAGTAAAACTAACTCAACTACCCGCAGCAAATGACACGTCAGATACAGCACAACTCCTCGTAAATCAGAATCAAACAGACCAGAGATTGCCGGTTACTCATTTTCTGCGCGCCAAAAACAATCTTTCAGACATTCAGGATAATGTTCAGGCAAGGGCCAACCTTGGCGCGACTTCACCCGACGAAGTTGATAATAAAATCAAAAACCTTTTCGACGGGAAGGCAACTTTCCTAAACGGCGGTTCTCTGGCATCAAAGAAAGATTTAATCTGGGATGATTCAAGTAAATCTTGGTACTTCTGGTCTGGCAATCTTCCTAAGCAGGTTCCGGCAGCGTCCTCCCCGCAGGATACTGGTGGCGTATCGTCGGGCGCATGGGTTAGCGTTGGTAATTCTACGCTATCCAGCACTGAAGAAGGCCTTGGCGATGCCCTGATCGGCGTAAAACAGCCTTATGCCGGAGCCGTTGCGCGAACTCAACATGACAAGAATTCAGACGCACTAAGCGTCAAAGACTTCGGGGCGAAAGGGGATGGAGTTACAGATGACACAAACGCAATTCAGGCGCTAATTGATTTAGCTAAAGAAAAAAATATTGCTGGATTTCCTTTAGCTGTATACCTGCCACCAGGTACGTATATTGTAGATTCTCTTACCATATACGCACATACAGTGATGTATGGAGCGGGCAGGGCAACAATAATCAGGCGGAAACCAGGAGGAAGTAAAAGTGTCATATATGGTGTCAACTCATCTTCTCTCTGGGGAACAACAAGCAGTAACGCCACTGAATTTGCATACAACTTTACATTGTCTGATTTTGTTGTAGATGGCGGCGTGGACGGTAAGAATGTTCCATTTTCCAGCAGTCTTACGGGGCATGGTATAGCAATATGGGGATCTCGCTATCGAATGTTCAACATTGACATTATAAACTGCGCAGAGAAAGGAATTTACACGGATTACATTGACCAAAACCTAGACTATCTGGCCCCGTGGTTTGAGTCTAGCATTTTCAGCATCAGAATAAACAATTGCGGAAAAGAGGGTTGGCACTGTGCAGGGCCACATGATGCAGCTATCCACGATGTTGGAATTATTAATGGCTCAAGAATTGGAAACGCTCTATACGATGGCTTCTATGTAACTAAAACCATGTCAGGAAATATCGGAAATTTGCATGTTTCTAATGCAGAGGATAATACTGGGACTGGAGAGTCAATTAGACATAGGTATGCTGGTAACATTGAGGGGCCGTGTAGATTTTACGGCGGAACCACATTTGAGGGAGCTAAGGATTGTGTAAGAATCGCATCTAGCGGAATTCAGTTTGATGATAGTTGCACGTTTTATATACCGTGGGGAGATGGCTATAATGGCACCGTGATGTGGATAGAGGCAGGTGTCGCCTTTTGCATAATTCGCGGAAAATTTGGTGGCGCGGGTTCATTTAGACCACAAAACAATTGGGGAATACGACTACGCCCAGGCACGGGCTCAGCGTCTAATAATGATATTGAAGTTCTGATGGAGGGCATTCAGATACCCATCAGCTTCGGAAACAGTACGACATCCCCCGATGCAGATGGTGGAAAAAATCGCTTTAAGATAACCGCATACTATTCAGCTTCCAGCGGAAATGGGTCGCCATCTTCCTACGGTGTTCCGAACACAGCTAACGGAACAGAGCTTGATATGATTTTTTCTGGAAACAGTAATAGCAGGATAAAGTCTGCCATTCAGACGAAAGTAACAACAATGGCTTCAGGCGCATCATACACATGGAACTACAAATACCCTTTCCTAGAATCTCCCGCTGTCTCAATCGCGATTGTTGGCATCGGAGGCACTCCAACTGGACAGCTGTACTCTGCCGGAGTTAGTAGCACGCAGGCAGTTTTTCACAATGGAACAGGACAAAGCTTGACGCTTCATGCAACCGCTACAATGCGTGTATCAGAGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
b3a501202aeb1cd0ab860c5199e290001618ce83c9614a7bbbd103170e4d8f0a
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7365
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50