Genbank accession
WPH66458.1 [GenBank]
Protein name
tail fiber protein with depolymerase domain
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MDQDIKTVIQYPVGATEFDIPFDYLSRKFVRVSLVSDDNRRLLSNITEYRYVSKTRVKLLVATTGFDRVEIRRFTSASERIVDFSDGSVLRANDLNVSQLQSAHIAEEARDAALLAMPEDDAGNLDARNRKIVRLAPGETGTDAVNKNQLDTTLGEAGGILSEVKDLQKDIEDYLQNWGDDTTAIRGVLWVYNQGSAVGGETSFVITKEGPVLAVPYIEINGSRQYRGWHYEYDLGSKTITLAKPLSAGDLVVCTTSETTLPLADSLAGPTGASQIGTANGLNVQMALDNLRSGVNVLDFMTFAERAAVLNYTGTNDNSEAFRKAFATGTRQIIVPPGRYHVKDVVIPAKVKLFGTYSYKPYNVTSDASFGTDGTIIRKVAGADNMFLWNTACAAEGVMFDGRDRTSPAIQSQSGGKITVGFFKCGFYRFDRVGNRRGAYLGCSFQFCNFNQNNIGIYNTVDGNHIGCTINANKSHGVMLETGANSNTFTNCRNEWNEGDNWNFYGATSIQVINELCDRAFGYGFRISNSSVTLINVNIRRSARTAASGAASAQIYFESSTLKMIGVNSSVGGDDTGGSITEPSPDYFFRMAGTSEGRLEISDSRLTGYTVGLISGTARPSVIRVINSPGWEDTINEGVARISGGRPYIGAMPTATGPANTSPAVLGLSCGGVNTYDNDMFDIHLTIRNTNNGGHNGAILTVLLYREGGAARATIVRVDSRSNAVGEGDINSTSADPQQVYQVSVEVTSNDASTFNLLVSTKSDNNASYRFRAKVKP
Physico‐chemical
properties
protein length:777 AA
molecular weight: 84034,68040 Da
isoelectric point:5,63606
aromaticity:0,08623
hydropathy:-0,25959

Domains

Domains [InterPro]
DC_0778
STR
1–776
IPR005604
ATT
3–127
IPR011050
STR
313–567
WPH66458.1
1 777
Architecture
ATT
STR
ATT 1-127 | STR 128-776 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WPH66458.1
1 777
Domain Start End Length (AA) Confidence
N-terminal 1 315 315 0,9945
Central domain 316 650 336 0,9906
C-terminal 651 777 126 0,9872
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-315
Central
316-650
C-terminal
651-777

Taxonomy

  Name Taxonomy ID Lineage
Phage Klebsiella phage vB_KpnP_KpV763
[NCBI]
1882400 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Klebsiella pneumoniae
[NCBI]
573 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WPH66458.1 [NCBI]
Genbank nucleotide accession
OR639934.1 [NCBI]
CDS location
range 35821 -> 38154
strand +
CDS
ATGGACCAAGACATTAAAACAGTCATTCAGTACCCAGTAGGGGCCACTGAGTTCGACATCCCGTTCGACTACCTGTCCCGCAAGTTTGTCCGTGTGTCGTTGGTGTCAGACGACAATCGAAGACTGCTGAGCAACATCACTGAGTACCGCTACGTGTCCAAGACCAGAGTCAAACTGCTGGTGGCAACCACTGGTTTCGACCGTGTAGAGATTCGGCGGTTCACGTCAGCGTCAGAACGCATCGTAGACTTTAGTGACGGTTCTGTATTACGCGCCAACGACCTTAACGTCTCACAGCTGCAATCTGCACATATCGCCGAAGAAGCACGTGATGCGGCACTTCTGGCAATGCCGGAGGATGATGCTGGTAACCTAGACGCCCGTAACAGAAAGATTGTTCGACTGGCTCCCGGAGAGACTGGTACAGACGCTGTCAACAAGAACCAACTGGACACAACCTTAGGTGAGGCTGGCGGTATTCTCAGTGAAGTTAAGGACCTCCAGAAAGACATTGAGGATTACCTACAGAACTGGGGAGATGACACCACAGCTATTCGCGGCGTTCTCTGGGTGTACAACCAAGGGTCCGCAGTGGGCGGTGAGACCTCCTTCGTGATTACCAAAGAGGGGCCTGTCCTTGCGGTTCCGTACATCGAGATTAACGGCAGCCGTCAATACCGTGGGTGGCACTACGAGTATGACTTAGGGTCCAAGACAATCACGCTGGCGAAACCACTTTCTGCTGGGGACCTAGTTGTGTGCACTACCTCCGAGACTACGCTACCGCTGGCCGACTCTCTAGCGGGCCCCACTGGTGCTTCTCAGATTGGTACCGCCAACGGTCTGAATGTGCAGATGGCGTTGGATAATCTCCGCTCCGGTGTTAACGTTCTGGACTTTATGACCTTTGCTGAGCGGGCAGCCGTCCTGAACTACACAGGAACCAATGACAACTCTGAGGCGTTCCGAAAGGCATTCGCCACCGGGACACGCCAAATAATTGTCCCTCCGGGAAGATATCACGTAAAAGACGTTGTAATACCCGCTAAGGTGAAACTGTTTGGTACGTACTCCTACAAGCCTTACAACGTGACAAGTGATGCGTCCTTTGGTACAGACGGTACGATTATTCGCAAAGTGGCTGGTGCAGATAACATGTTTCTGTGGAATACCGCATGTGCTGCTGAGGGTGTCATGTTCGATGGTCGTGACCGCACGTCCCCGGCCATTCAGTCACAGTCTGGTGGTAAAATAACCGTAGGGTTCTTCAAGTGCGGGTTCTATCGCTTCGACCGAGTAGGTAACCGCCGGGGCGCATACCTCGGGTGCTCCTTCCAGTTCTGTAACTTCAACCAGAACAACATTGGGATTTACAATACGGTAGATGGGAACCACATAGGGTGTACCATCAACGCCAACAAGTCCCACGGTGTTATGCTCGAAACAGGTGCGAACTCCAACACGTTCACTAACTGTCGAAACGAGTGGAACGAAGGCGACAACTGGAACTTCTATGGTGCCACTTCGATTCAGGTAATCAATGAACTGTGCGACCGTGCGTTCGGCTATGGGTTCCGTATCAGCAACTCCTCAGTGACGCTCATCAACGTCAACATTAGGCGTTCTGCGAGAACAGCCGCATCGGGAGCGGCAAGTGCTCAGATTTACTTCGAGTCGTCTACCCTCAAGATGATTGGGGTGAACAGCTCCGTGGGAGGTGATGACACTGGCGGTTCTATCACAGAGCCTTCGCCTGATTACTTCTTCCGGATGGCGGGTACCAGCGAGGGCCGCCTTGAGATTAGCGACAGTCGACTCACAGGTTATACTGTTGGACTAATCTCAGGTACAGCACGTCCTTCGGTTATCCGCGTGATAAACTCTCCGGGTTGGGAGGACACGATTAACGAGGGGGTCGCTCGCATATCAGGAGGCAGGCCATACATCGGTGCGATGCCGACAGCGACTGGTCCAGCAAACACTAGTCCGGCCGTATTAGGACTGTCCTGTGGTGGAGTAAACACCTACGATAACGACATGTTCGATATTCACTTGACTATCCGTAATACCAACAACGGCGGACACAACGGTGCAATCCTCACTGTGTTGCTTTACCGTGAGGGTGGGGCAGCGCGTGCGACAATCGTTCGAGTAGACAGTCGGTCCAACGCTGTGGGTGAGGGTGACATTAACAGCACCTCGGCAGACCCTCAGCAGGTCTATCAAGTGTCCGTAGAGGTGACGTCAAACGATGCGTCTACGTTCAACCTACTGGTATCCACCAAGTCGGACAACAACGCATCCTACCGCTTCAGGGCGAAAGTTAAACCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
43f3ab2eabc3105e93d42fb747080eff9ab75d5c13e602ff4a37977eae7ea653
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7367
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50