Genbank accession
WPK34719.1 [GenBank]
Protein name
side tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,76
TF
Evidence RBPdetect2
Probability 0,93
Protein sequence
MATLKQIQFKRSKVAGVNPTAAQLAEGELAINLKDRTLFTKDDLGNIISLGFAKGGDINGNVTQNGDYLQNGTYNLNGNQFVYAGKYIEFLPKTAGNGAWANQHTNKAPIFTDLSSTTSTSEYHPLIKQRYKNGTFSAGTLVSEGSFKIHYIDETGDSKYWTFNRNGSFIVDNGNIEVRAGNISASGNINSASGVVSAPRVNTKNINLSSKTFIPNNDAGYDIVSLPTWIYNPPADGSDRDTNGLNYMRKMRASNTSSIFHEIVDCRKDKPQEISWWTGVGPSSFQWSFDTTGRIAAGKSISVGLPDNGVNGRYPLESAISIGIAIGDNDTGIKWVRDGVIDFMANGISSATILNNGINSTKKLMVGYSRDSGTTWDFPNNNQAMFTARTDIDGNNNGDGQTHIGYSSNSKMYHYFRGTGRMAIGMAEGLIVEPGILDIKTSSNTLSLRADGTVASVQTLKLNNGLYFNGDGTNASLVFKAASGIDGTKQIMWEGGTRAGQNKSYVTVKAWGNSFNASGDRTRETVFEVADGQGYYFYSQRVAPTGSETVGPVVTQINGQLNARGSIITDGSLRVNGLSTLSGQVTMDNGLVLSGGGSITGQVKIGNTADAFRIYNAEYGAIFRRSEASLYIIPTPKDAGESGGISNLRPLTIELNTGTVKMSHDVHLGDSGSGTGLLQVSNSLKTIKMICPVTINERNAALTLDSPSSSSANYLQGSKAGTRSWYVGLGGSGNDLSLYSQSYGHGLVISDNFVSITKPFKVGNAQLGTDGNITGGSGNFANLNTTINNLKTDIVSSYPIGAPIPWPTDTPPNGYAIMEGQTFDKSAYPKLAVAYPSGVIPDMRGQTIKGKPSGRAVLSAEADGVKSHSHSASASSTDLGTKTTSSFDYGSKTTSSFDYGTKTSSTTGNHNHTVSGNTSSAGAHQHARSGPQIQGGVPASIFYDGYNSAGPNGNAKITGSVSGATASSNMAKTSSDGAHTHSWSGTTSATGNHAHTVGIGAHTHSVGIGAHTHTVAIGSHGHTITVNATGNTENTVKNVAFNYIVRLA
Physico‐chemical
properties
protein length:1048 AA
molecular weight: 110353,55660 Da
isoelectric point:8,72671
aromaticity:0,07920
hydropathy:-0,36574

Domains

Domains [InterPro]
DC_0538
STR
1–1046
IPR048388
ATT
702–775
IPR037053
ATT
796–849
IPR011083
ATT
801–848
WPK34719.1
1 1048
Architecture
STR
ATT
STR
ATT
STR
ATT
STR
STR 1-580 | ATT 581-653 | STR 654-701 | ATT 702-775 | STR 776-795 | ATT 796-849 | STR 850-1047 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WPK34719.1
1 1048
Domain Start End Length (AA) Confidence
N-terminal 1 851 851 0,0461
Central domain 852 1037 187 0,0871
C-terminal 1038 1048 10 0,9962
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-851
Central
852-1037
C-terminal
1038-1048

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage AV113
[NCBI]
3077258 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Escherichia coli
[NCBI]
562 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WPK34719.1 [NCBI]
Genbank nucleotide accession
OR352943.1 [NCBI]
CDS location
range 56410 -> 59556
strand +
CDS
ATGGCTACATTAAAACAGATACAATTTAAAAGAAGCAAAGTAGCAGGAGTTAATCCTACTGCAGCACAATTAGCCGAAGGCGAATTAGCGATAAACTTAAAAGATCGAACTCTTTTTACTAAAGATGACCTCGGTAATATTATTAGCCTAGGCTTTGCTAAGGGCGGGGATATTAACGGTAATGTAACTCAAAATGGAGATTATTTACAGAACGGTACATATAATCTCAATGGAAACCAGTTTGTTTATGCAGGAAAGTATATTGAATTCTTGCCAAAAACTGCTGGAAATGGCGCTTGGGCTAACCAACACACAAATAAAGCCCCTATCTTTACAGATTTGAGTTCAACTACTTCAACTTCTGAATACCATCCTTTGATTAAGCAACGTTATAAAAACGGTACTTTTTCAGCAGGTACATTAGTAAGCGAAGGTAGTTTTAAAATTCACTATATCGATGAAACAGGTGATTCAAAATATTGGACTTTTAACCGTAACGGTAGTTTTATTGTAGATAACGGCAATATTGAAGTCCGCGCCGGTAATATTTCGGCTTCAGGTAATATTAACTCTGCTTCAGGGGTTGTGTCTGCGCCACGCGTCAACACAAAAAATATTAACTTGAGTTCTAAAACCTTTATCCCGAATAATGACGCGGGTTATGACATTGTTTCTTTACCTACTTGGATTTATAATCCACCAGCAGATGGTTCAGACCGTGATACAAACGGATTGAACTACATGCGTAAAATGCGTGCATCAAACACATCCAGCATTTTCCATGAAATTGTCGATTGCCGTAAAGACAAGCCGCAAGAAATTTCTTGGTGGACTGGTGTAGGGCCGTCATCTTTCCAATGGTCGTTTGATACCACTGGACGTATTGCTGCCGGTAAATCAATTTCTGTAGGTCTTCCTGATAATGGTGTGAATGGTCGTTATCCGCTTGAGTCTGCAATTTCTATTGGTATTGCAATTGGTGATAACGACACCGGTATTAAATGGGTCCGCGACGGTGTTATTGATTTCATGGCTAATGGTATTTCATCCGCTACCATTTTGAATAACGGTATTAACAGTACTAAGAAATTGATGGTCGGTTATAGCCGCGATTCTGGTACTACTTGGGATTTCCCAAATAACAACCAAGCAATGTTTACTGCTCGTACTGATATTGATGGTAATAATAACGGCGATGGACAGACTCATATCGGTTATAGCAGCAATTCTAAAATGTATCACTATTTCCGTGGCACGGGTCGTATGGCTATTGGCATGGCCGAAGGACTTATTGTTGAACCAGGAATTTTAGATATTAAAACTAGTTCAAATACATTAAGTTTGCGTGCTGATGGTACCGTCGCTTCTGTTCAAACATTAAAGCTTAATAATGGATTATATTTTAATGGTGATGGAACTAATGCTTCTCTAGTTTTTAAAGCAGCTTCAGGTATTGACGGCACTAAGCAAATCATGTGGGAAGGCGGTACTCGAGCAGGTCAGAATAAGAGTTATGTAACTGTTAAAGCATGGGGTAATTCATTTAACGCATCCGGCGATCGTACTCGTGAAACAGTTTTTGAAGTAGCTGACGGGCAGGGATATTATTTTTATTCACAGCGTGTGGCTCCAACCGGTTCAGAAACTGTGGGACCTGTTGTAACACAAATTAATGGACAACTGAATGCAAGAGGGAGCATTATCACCGATGGAAGTCTTAGAGTTAATGGATTAAGTACATTATCCGGACAAGTTACTATGGATAACGGGCTTGTTTTATCCGGCGGTGGTTCTATTACCGGTCAAGTTAAAATCGGTAATACCGCAGATGCTTTCCGTATTTACAATGCTGAATATGGAGCTATTTTCCGTCGTTCTGAAGCATCTTTGTATATTATACCTACTCCTAAAGATGCCGGAGAATCAGGAGGTATAAGTAATCTTAGACCATTGACAATAGAACTGAACACTGGTACAGTTAAAATGTCACATGATGTTCATTTGGGAGATTCTGGATCCGGCACAGGATTATTACAAGTAAGTAATAGTCTTAAAACTATTAAAATGATATGTCCAGTAACTATTAATGAACGTAATGCAGCGCTTACTCTAGATTCTCCTTCATCTTCTTCTGCTAATTATTTGCAGGGTTCTAAAGCTGGAACTAGATCTTGGTATGTTGGTCTTGGTGGTTCTGGAAATGATTTATCACTTTATAGCCAATCGTATGGACATGGTCTTGTTATAAGTGATAATTTCGTGTCAATCACTAAACCCTTTAAAGTCGGAAATGCCCAACTAGGAACTGATGGTAATATCACCGGTGGTTCTGGTAATTTTGCTAACTTGAATACCACAATAAATAACCTTAAGACGGATATTGTCTCAAGTTATCCAATTGGTGCTCCAATTCCATGGCCAACGGATACTCCTCCTAATGGTTACGCTATTATGGAAGGTCAGACTTTTGATAAGTCTGCATATCCAAAGTTAGCTGTTGCATATCCTAGTGGTGTTATTCCAGATATGCGTGGGCAAACTATCAAGGGTAAACCAAGTGGTCGTGCTGTTTTGAGCGCAGAAGCAGACGGTGTTAAGTCACATAGCCATAGTGCAAGTGCATCAAGCACAGATTTAGGTACTAAGACCACTTCTAGTTTTGATTACGGTAGCAAAACGACTTCAAGCTTTGATTATGGTACTAAGACAAGTAGTACCACTGGCAACCATAACCATACAGTGAGTGGTAATACTAGTTCCGCTGGTGCTCACCAACACGCGCGTTCAGGCCCTCAGATACAAGGCGGCGTACCCGCTAGCATATTCTATGATGGATACAATAGTGCCGGTCCAAACGGCAACGCTAAAATCACTGGAAGCGTGAGCGGTGCTACTGCATCGTCGAATATGGCCAAAACTTCTTCAGACGGTGCCCACACCCATAGTTGGTCTGGTACTACTAGCGCCACAGGTAACCATGCGCATACGGTAGGTATTGGCGCTCATACCCATTCGGTAGGTATTGGTGCTCATACGCATACTGTTGCAATTGGTTCCCATGGACATACAATAACTGTAAATGCCACAGGAAATACAGAAAACACAGTTAAAAACGTTGCTTTTAACTATATCGTTCGTTTAGCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
33b83049682ad952fd5c4a08b05f409cab602b4605af3a42620ce72c558e0b54
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5150
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
A collection of diverse bacteriophages for biocontrol of ESBL- and AmpC-beta-lactamase-producing E. coli Vitt,A.R., Sorensen,A.N., Bojer,M.S., Bortolaia,V., Sorensen,M.C.H. and Brondsted,L. 2023 GenBank