Genbank accession
WAB24924.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,88
Protein sequence
MGIHLMISNNAPAKMVLNSIMTGYTLAYVQHSIYTDYDVIGRSFWLKIGESIDRRDYTGIDTFFVMINNLTPSTSYEIQGAFYDSIIDSELLEAKIGINLSNETNFRTKEKPIITAARSESEPVDVGVGAPIVVVETAGEASYCTIELKSTTSEDSEWVKYYIGALGPTIKFGGVPVGDYKIRISGQVTMPDGVTVDSSGYYEYPSVFTVAYNFVPPTAPTNIAFKAARIADGKERYDVRIEWDWERGAGANVREFLVTYINSEEYAKTGWAKAQKINVGAARAATIISFPWKVDHTFKVSSIAWGPNKQDITESAPVTFILNEDTPLDNSFVNETGIDVNYAFIKGSMKDGEIWRQTFLIDAATGAINIGLLDEEGKAPISFDPINRVVNVDGKVITRDINAANFIMTNLSGKDNPAIYTQGKSWGDNNSGIWMGMDNTSAKAKLDIGNATQWIRYDGDVLRISSGVVIGTPNGDVDIGTGMQGKQTVFVYKLATSLPAKPLEQDYPPPGWSKTPPNRTDMTQNIYATTGTLDPVTNRLLEGTSWSDVVQWSGTEGTIGHDGQRGPGMYSLGIPGLGGWDDGQANAFFQNNFGSPPVRYDVLTEFNSNAPQSAFTRQWNGSGWVNPAMVLHGNMIVNGTVTADKIVAGNAFLSQIGVNIIYDRNAALSGNPEAYYKMKIDLNSGYIHIR
Physico‐chemical
properties
protein length:690 AA
molecular weight: 75432,76710 Da
isoelectric point:4,87226
aromaticity:0,10435
hydropathy:-0,23275

Domains

Domains [InterPro]
IPR057551
STR
108–202
WAB24924.1
1 690
Architecture
STR
STR
STR
STR
STR 15-102 | STR 108-202 | STR 216-340 | STR 355-669 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WAB24924.1
1 690
Domain Start End Length (AA) Confidence
N-terminal 1 411 411 0,8386
Central domain 412 646 236 0,2959
C-terminal 647 690 43 0,7647
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-411
Central
412-646
C-terminal
647-690

Taxonomy

  Name Taxonomy ID Lineage
Phage Citrobacter phage vB_CfrD-Cit2
[NCBI]
2996123 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Citrobacter freundii
[NCBI]
546 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WAB24924.1 [NCBI]
Genbank nucleotide accession
OP745948.1 [NCBI]
CDS location
range 88078 -> 90150
strand -
CDS
GTGGGCATCCATTTAATGATTTCAAATAATGCACCAGCCAAAATGGTCTTAAATAGTATAATGACTGGATATACTTTGGCTTATGTCCAGCACTCCATTTATACTGATTATGATGTTATTGGTAGATCTTTTTGGTTAAAAATAGGAGAAAGTATAGATAGACGTGATTACACCGGTATAGATACTTTCTTCGTAATGATTAATAATCTAACCCCCTCTACCTCCTATGAGATTCAGGGGGCTTTCTATGATTCAATTATTGACTCAGAGTTATTGGAAGCTAAGATTGGTATCAACCTCTCTAATGAAACTAACTTTAGAACAAAGGAAAAGCCAATAATTACTGCAGCAAGATCTGAGTCAGAACCCGTTGACGTTGGTGTTGGAGCACCAATAGTTGTTGTAGAGACTGCTGGTGAAGCTAGTTACTGCACTATTGAATTAAAAAGTACTACATCAGAAGATAGTGAATGGGTTAAATATTATATAGGCGCACTGGGACCTACTATCAAATTTGGTGGTGTTCCTGTTGGCGACTATAAGATCAGAATATCTGGTCAAGTTACTATGCCAGATGGTGTTACAGTTGACTCATCTGGTTATTATGAATATCCTAGCGTTTTCACTGTAGCTTATAATTTTGTACCACCTACTGCACCTACTAACATTGCCTTTAAAGCTGCACGGATTGCAGATGGTAAGGAACGATATGATGTCAGAATAGAGTGGGACTGGGAACGTGGTGCGGGTGCTAATGTCCGTGAATTTCTGGTTACTTATATAAACTCTGAAGAATACGCTAAGACTGGCTGGGCTAAAGCTCAAAAGATAAACGTTGGGGCTGCTAGAGCTGCAACGATTATATCATTCCCATGGAAAGTTGATCATACTTTTAAGGTATCCTCAATTGCCTGGGGACCAAATAAGCAAGATATAACAGAATCAGCTCCTGTAACGTTTATACTTAATGAAGATACTCCTCTAGACAACAGCTTTGTCAATGAGACGGGTATTGATGTTAATTATGCCTTTATTAAGGGCAGCATGAAAGATGGAGAAATCTGGAGACAGACATTCTTAATCGACGCAGCTACTGGTGCTATTAACATTGGTCTGCTAGATGAAGAAGGAAAAGCACCTATTTCTTTTGACCCCATAAACCGTGTTGTTAACGTTGATGGTAAAGTAATTACTAGAGATATTAATGCTGCGAACTTTATCATGACTAACTTATCTGGTAAGGATAACCCGGCAATCTACACTCAAGGTAAATCTTGGGGAGATAATAACTCCGGTATTTGGATGGGTATGGACAATACCTCTGCCAAAGCTAAATTAGACATTGGTAACGCTACACAATGGATTCGTTATGATGGTGATGTGCTACGTATTTCTAGTGGAGTTGTTATTGGAACCCCTAATGGTGACGTAGATATTGGTACTGGGATGCAGGGTAAACAAACAGTATTTGTTTATAAGTTAGCAACATCTCTACCTGCTAAACCACTAGAACAAGATTATCCGCCTCCTGGTTGGTCAAAAACTCCACCTAACCGTACAGATATGACACAAAATATCTATGCCACTACAGGTACGCTTGATCCCGTTACTAATAGGCTATTAGAGGGTACTAGCTGGTCTGATGTAGTTCAGTGGAGTGGTACTGAAGGTACTATAGGACATGACGGACAACGTGGTCCTGGGATGTACTCCTTAGGTATTCCTGGTCTTGGAGGCTGGGATGATGGACAAGCTAATGCCTTCTTCCAGAATAACTTTGGTAGTCCTCCTGTTAGATATGATGTATTAACCGAATTTAATAGTAATGCTCCACAATCAGCATTTACCAGACAATGGAATGGGTCTGGGTGGGTTAACCCTGCAATGGTTCTTCACGGGAACATGATTGTTAATGGAACAGTGACGGCAGATAAAATTGTAGCAGGAAATGCTTTCTTGTCTCAAATTGGTGTTAATATCATTTATGATAGAAATGCTGCATTATCTGGGAATCCTGAGGCATACTACAAGATGAAGATAGACCTAAATAGTGGGTATATCCATATAAGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
8b46a6d0e5415d3a7e29ad0f7ef2d4bdfb8e9c6080a4460d1f957210512d93d3
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7933
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Isolation and characterization of a polyvalent enterobacteria-infecting phage with high potential as biocontrol agent Cunha,P.C., Dias,R.S., Silva,J.D., Carmo,A.J., Rodrigues,I.R., Cabral,T.V. and Paula,S.O. 2026-02-25 GenBank