Genbank accession
WAX17572.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence RBPdetect
Probability 0,91
Protein sequence
MNITFTNSGETVNMTSAGTTAKYQYPIGAGISQQIRVTDVGTFTNIELKYFENGDLIKTVRVPVRQGMTLDLSIFSSLTQSLPEMLKLFTGTMKRTDTITIDAMTGSTSYGFMRVGVTNIGSTLLGGFPGLYNNGNLWTNTTSPVISGDGASNTTLAKVQTFGMGFPDAVRVKATSTSGTPSFDINPTNNARLPATLNAFSVGIWFMNDRGSGVNVKFQTFLNNQVIGEVILKPGEGGLFKYENLRVGGVSNTVFFRASGVSGKSMTVFYTRAQFNEGATLRNWSPHMSEVNNADNSKRYGFLTDYADGWKVACEECLQAFNQTTGYPFQDRIYWGSAQPNTATSHLSKYIKFDDGSTQIIDQGYRINYANPKVLAGQSVSILNRDASTVYGTIRYKRIPNLPSTNCRVCMNWLNSYGTYDTLYSTEYNVVPTLTMQGTDGNKVQHYDVRIVVPVTENNERALEILMRSQHVRCAIPNAPFQWGTAEIVGNALSFYAGGSTVKSMTIRFKAQIIGNW
Physico‐chemical
properties
protein length:517 AA
molecular weight: 56829,46960 Da
isoelectric point:9,05892
aromaticity:0,10832
hydropathy:-0,23037

Domains

Domains [InterPro]

No domain annotations available.

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WAX17572.1
1 517
Domain Start End Length (AA) Confidence
N-terminal 1 37 37 0,3787
Central domain 38 236 200 0,3672
C-terminal 237 517 280 0,9074
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-37
Central
38-236
C-terminal
237-517

Taxonomy

  Name Taxonomy ID Lineage
Phage Parabacteroides phage PM116P6
[NCBI]
2968698 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Parabacteroides merdae
[NCBI]
46503 cellular organisms > Bacteria > Pseudomonadati > FCB group > Bacteroidota/Chlorobiota group > Bacteroidota

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WAX17572.1 [NCBI]
Genbank nucleotide accession
OP172828 [NCBI]
CDS location
range 2323 -> 3876
strand +
CDS
ATGAACATTACATTCACAAACTCCGGTGAGACGGTAAACATGACGAGTGCAGGAACGACAGCAAAGTATCAGTATCCAATCGGAGCCGGGATTTCGCAGCAAATAAGGGTGACCGACGTAGGCACGTTTACAAACATTGAACTGAAATACTTCGAAAACGGAGACCTTATCAAAACGGTTAGAGTTCCTGTTCGGCAGGGTATGACGTTAGACCTTTCGATATTTTCCTCACTCACGCAGTCACTACCCGAAATGCTTAAACTATTCACCGGTACAATGAAACGTACTGACACGATCACAATAGACGCGATGACCGGCTCAACGTCATACGGCTTTATGCGTGTCGGGGTTACTAACATAGGCAGTACATTGTTAGGTGGCTTCCCCGGACTTTACAACAACGGCAATCTGTGGACAAACACAACGTCACCGGTCATTTCGGGTGACGGTGCATCTAATACAACACTTGCTAAGGTTCAGACCTTCGGCATGGGCTTCCCGGACGCGGTTAGAGTAAAGGCAACGAGCACGAGCGGGACACCGAGTTTCGACATTAACCCGACTAACAACGCGAGACTACCGGCAACGCTTAACGCGTTCAGTGTCGGAATATGGTTCATGAACGACAGGGGTAGCGGGGTTAACGTCAAGTTCCAAACGTTCCTGAACAACCAAGTCATAGGCGAGGTCATTCTTAAACCGGGTGAAGGTGGGCTGTTCAAATACGAAAACCTACGTGTAGGGGGTGTTAGTAATACTGTGTTCTTTAGGGCTTCCGGCGTGTCCGGTAAATCTATGACGGTGTTCTATACACGTGCACAGTTCAACGAGGGTGCAACACTTCGAAACTGGTCACCTCACATGAGCGAGGTTAACAACGCTGACAACTCTAAACGCTACGGGTTCTTAACGGACTACGCGGACGGTTGGAAAGTGGCATGTGAGGAATGCTTGCAAGCATTTAACCAAACAACGGGTTATCCGTTCCAAGATCGTATATACTGGGGATCAGCACAGCCGAACACGGCAACGTCGCACCTTTCTAAGTATATTAAGTTCGATGACGGATCGACACAAATCATAGACCAAGGTTATAGGATCAACTATGCAAACCCTAAAGTATTAGCCGGGCAGTCGGTCAGCATTCTTAACCGTGATGCTTCAACGGTGTACGGAACGATACGTTACAAACGTATTCCGAACCTTCCGTCGACTAATTGTAGGGTCTGTATGAACTGGCTAAACAGCTACGGAACTTATGATACGCTATACTCAACAGAGTACAACGTAGTACCTACGCTAACAATGCAGGGGACAGACGGTAACAAGGTACAACACTATGACGTGCGGATCGTGGTACCGGTAACGGAGAACAACGAAAGGGCGTTAGAAATACTTATGAGATCGCAGCATGTACGCTGTGCAATCCCGAACGCTCCGTTTCAGTGGGGCACAGCCGAGATCGTAGGCAACGCATTGTCGTTCTATGCCGGCGGATCAACCGTTAAGAGTATGACAATTAGATTTAAAGCACAAATAATAGGAAACTGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
fe720947c18c1f063c991473f8f8ea1a9ea96347d62e8e4185126fd1f1d8eab4
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4468
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50