Genbank accession
WQZ00377.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence RBPdetect
Probability 0,90
TF
Evidence RBPdetect2
Probability 0,52
Protein sequence
MSTITQFPSGNTQYRIEFDYLARTFVVVTLVNSSNPALNRVLEVGRDYRFLNPTMIEMLVDQSGFDIVRIHRQTGTDLVVDFSNGSVLTASDLTNSELQSIHIAEEGRDQTVDLAKEYADAAGISAGNAKDSEDEARRIASSIKASGLIGYIPRRSFEKGFNVRAWNEALLWEEDGDYYRWEGTLPKNVPAGSTPESSGGIGLGAWVSVGDILEQKVYVVVITGQSNAQGANSGGPNPASPHVKVWDGTTNTWGSSDYTQLPFSQSTPNGNGGNNNIALSFAHRLIDEHRNSKVYVIYDAVGGRPINDWVGSGTASIRYAAIKAKVEAALATPELVAAGKTKIDYLIWAQGERDALTDTITVYRDKFKTLDTQFRSEAWMENHTPMFVMGMSGLHTRYQVWQGQLSYCENQNRNCIYVNSMGLKTQYDVSGTGDYTHWLGDSLWEHGYHRIWYALQERGITHRNQLAPFYGRGTGPWDGQPDAIAMFSSLVSIDSATSQFPTNSVAATGSITWGLNCAADGNYTFAGGHTVTTDNTCNYSAAWGRGISLGPGAQYSASFGRENNVTGDYQFAVGRGHTTSSDGETCLGTFSFYASEQTNKVKLQVGVGSSSSVKKNAITAREDGAVEINVSSSHEPAQKGEMVIHAESNTSLRIKVRGTDGVVRSTVLTLA
Physico‐chemical
properties
protein length:671 AA
molecular weight: 72981,87170 Da
isoelectric point:5,51426
aromaticity:0,09538
hydropathy:-0,37019

Domains

Domains [InterPro]
DC_1280
ATT
105–290
IPR036514
STR
218–465
IPR005181
ENZ
219–428
WQZ00377.1
1 671
Architecture
ATT
STR
RBD
STR
RBD
ATT 2-290 | STR 291-465 | RBD 466-493 | STR 494-645 | RBD 646-671
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WQZ00377.1
1 671
Domain Start End Length (AA) Confidence
N-terminal 1 383 383 0,5529
Central domain 384 582 200 0,5892
C-terminal 583 671 88 0,9645
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-383
Central
384-582
C-terminal
583-671

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage Vb_SalP_792
[NCBI]
3110515 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WQZ00377.1 [NCBI]
Genbank nucleotide accession
OR978128 [NCBI]
CDS location
range 35142 -> 37157
strand +
CDS
ATGTCCACGATTACACAATTCCCTTCAGGAAACACTCAGTACAGGATTGAGTTCGACTACCTAGCCAGAACGTTTGTTGTTGTTACGCTGGTGAATAGCTCTAACCCTGCCCTGAACCGTGTACTGGAAGTTGGTCGAGATTACCGATTCCTTAATCCAACGATGATTGAGATGTTGGTTGACCAATCAGGTTTCGACATCGTTCGTATTCACCGTCAGACTGGAACTGACTTAGTGGTAGACTTCAGTAATGGCTCAGTGTTGACAGCTAGTGACCTGACCAATTCAGAGCTTCAGTCTATCCATATTGCAGAAGAAGGTCGAGACCAAACTGTTGACTTAGCGAAGGAATATGCCGATGCTGCTGGTATCTCTGCTGGCAACGCTAAGGATAGCGAGGACGAAGCACGACGAATCGCTTCGAGTATCAAGGCATCTGGACTAATTGGCTATATCCCCCGTCGCTCCTTCGAGAAAGGCTTCAACGTTAGAGCATGGAACGAGGCCCTGCTATGGGAAGAGGATGGTGATTATTACCGCTGGGAGGGTACGCTTCCAAAGAACGTTCCTGCTGGTTCAACTCCTGAATCATCTGGCGGTATTGGTCTGGGTGCTTGGGTTAGTGTTGGTGATATCCTTGAGCAGAAGGTTTACGTAGTAGTAATCACCGGGCAGTCGAATGCTCAGGGTGCTAACTCCGGTGGGCCTAATCCAGCGTCGCCTCATGTTAAAGTATGGGATGGTACTACTAATACTTGGGGTAGTAGTGATTATACGCAATTACCTTTCTCCCAAAGTACCCCTAATGGTAATGGTGGGAATAACAACATTGCTTTGTCTTTTGCTCATCGTTTAATTGATGAACATAGGAATTCCAAAGTTTACGTTATCTACGATGCTGTTGGTGGGCGGCCTATTAATGATTGGGTCGGTTCTGGCACTGCATCTATTCGTTACGCTGCAATCAAAGCTAAAGTAGAGGCTGCATTGGCTACACCTGAGCTAGTGGCTGCTGGTAAAACTAAGATTGATTACCTGATTTGGGCGCAAGGGGAAAGAGATGCACTGACTGATACCATTACGGTTTACCGTGATAAGTTTAAAACCTTGGATACACAATTCCGTTCCGAAGCGTGGATGGAGAATCATACCCCAATGTTTGTGATGGGTATGTCTGGTCTTCATACTCGTTATCAGGTATGGCAAGGACAATTGAGTTACTGTGAGAACCAGAACCGTAACTGTATTTACGTTAACTCTATGGGACTAAAGACTCAGTATGACGTATCAGGTACAGGTGATTATACACACTGGTTGGGTGATTCACTGTGGGAGCATGGTTATCATCGTATCTGGTATGCACTCCAAGAACGAGGCATTACTCACCGTAACCAACTGGCTCCGTTCTATGGACGTGGTACTGGTCCGTGGGATGGGCAGCCTGATGCAATTGCTATGTTTAGTTCTCTGGTAAGTATTGACTCAGCAACATCTCAGTTTCCAACCAATAGTGTAGCTGCTACTGGTTCCATTACTTGGGGACTGAACTGTGCAGCAGATGGTAACTACACCTTCGCAGGCGGTCATACTGTAACAACGGATAATACATGTAACTACTCTGCTGCATGGGGTAGGGGCATCTCACTGGGACCCGGTGCTCAGTATAGTGCAAGTTTCGGTAGGGAGAACAACGTAACTGGTGATTACCAGTTTGCAGTTGGTCGAGGCCACACTACCAGCAGTGACGGTGAAACCTGTCTAGGTACTTTCTCTTTCTATGCGTCAGAGCAAACAAACAAGGTGAAGCTACAGGTTGGTGTTGGTTCTTCCTCTTCTGTTAAGAAGAATGCCATCACAGCAAGGGAAGATGGTGCGGTAGAGATTAATGTATCATCTAGCCATGAGCCAGCACAAAAAGGTGAAATGGTAATCCATGCGGAATCTAATACTTCGTTACGCATCAAAGTTCGTGGTACTGATGGTGTAGTTAGGTCTACTGTTTTAACGCTGGCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
f9dbfbe7f7640c59550df5bb137de07ff8599d2e64f7d4851c9f2bf2037f855d
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7935
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Genome analysis of Salmonella phage Juliet,R., Loganathan,A., Manohar,P., Neeravi,A., Bakthavatchalam,Y.D., Veeraraghavan,B. and Nachimuthu,R. 2024-06-03 — GenBank