Genbank accession
QBX18008.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,86
Protein sequence
MEILNTLNLTRISGGTKLKQGDFGSILSYSLADENGQEITSFDTKTAYINLVLDDKILFTTTTQVDISRVTFHIDKALPIGLYYLEIKIDDYVFPSDKDSIILIEEGVTAYDLIDLIPNYDIVMTITSILSDLAQKGMNITDLKNKVDAIYSNALSDHAEILTARGSQSSLDGRLDAIEAKEASDYSSLDTRITSNTSNIDSTSTRINNLVANAGNGTVPSEVIEMRTGDDGFSYATAREAVRHTGTIVENSFKVPITLTTGYYIVSANGTYASHSNQAYKATDFIDITGASIIKLDTAFSVAGDGYAFYDANKTFISGSSTFVKTVSVPANASYFRFTAYNIPDSTIRMFLVYPLTKLMPAIDKINKQDLNGKFTKLNNLPFTLTTNQYVVYNDGKTADIANTKFFVSSYINVSSIDVLSINTKFSGYGDGYAFYDVNKVYISGSNAYTTTINVPANAVYFRFSVYNIDTNLVTLTGTNSLNFLKEQISTISKQIQPPINYYYGIGKTLMIGDSLTSGAYYDDVAFKGASINQNVPFYLGKITNNEVKNAGISGSTPISWHSTEFSKYDYTQYDTFFIWLGTNAGLTDTMDADVNSKASYNDYASTNTGTYCKLIEEIKAVNPDASIHICTIFASSGNLATTNSVINQIATKYDLNIIDMSDLSPSNYPNLHLGINNVHFGKSGNIYIANRIANDLNSYFASNQLKLEFGLTPRTN
Physico‐chemical
properties
protein length:717 AA
molecular weight: 78707,02030 Da
isoelectric point:4,85606
aromaticity:0,11158
hydropathy:-0,12971

Domains

Domains [InterPro]
DC_1253
STR
55–385
DC_1253
STR
363–714
SSF52266
STR
508–699
cd00229
ENZ
510–695
IPR013830
ENZ
512–685
QBX18008.1
1 717
Architecture
STR
STR 55-714 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QBX18008.1
1 717
Domain Start End Length (AA) Confidence
N-terminal 1 260 260 0,9965
Central domain 261 550 291 0,6410
C-terminal 551 717 166 0,1723
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-260
Central
261-550
C-terminal
551-717

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage Javan389
[NCBI]
2548143 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus parauberis KCTC_11980BP
[NCBI]
1260132 Bacillota > Bacilli > Lactobacillales > Streptococcaceae > Streptococcus > Streptococcus parauberis

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QBX18008.1 [NCBI]
Genbank nucleotide accession
MK448748 [NCBI]
CDS location
range 35141 -> 37294
strand +
CDS
ATGGAAATATTAAACACATTAAATTTAACACGAATTTCAGGCGGAACTAAACTAAAGCAAGGCGACTTTGGTTCGATCTTATCTTACTCTCTTGCAGATGAAAACGGACAAGAAATCACATCGTTTGATACTAAGACAGCATATATAAACTTAGTATTAGATGATAAAATCTTGTTCACGACAACAACACAAGTAGACATTTCAAGAGTAACATTCCATATCGACAAAGCTTTGCCTATCGGTCTGTACTACCTTGAAATAAAGATAGACGATTATGTTTTTCCGTCTGATAAGGATTCAATTATCTTGATTGAAGAGGGAGTAACCGCTTATGATTTGATAGACTTAATTCCTAACTATGATATCGTGATGACTATCACATCAATTTTAAGTGACCTTGCGCAAAAAGGTATGAATATCACAGATTTAAAAAATAAAGTAGATGCTATCTACTCAAACGCCTTGTCTGATCATGCTGAGATTTTAACCGCTCGTGGTAGTCAGTCGAGTTTAGATGGTCGATTGGATGCTATCGAAGCAAAAGAGGCTAGTGATTATTCTAGTCTTGATACTCGTATTACAAGCAACACTTCCAACATTGATTCTACAAGTACACGCATTAACAATCTAGTAGCGAACGCTGGTAACGGAACTGTACCATCTGAAGTTATTGAAATGCGTACTGGCGATGACGGTTTTTCTTATGCAACAGCGAGGGAAGCGGTTAGACACACTGGAACAATTGTTGAGAACTCGTTTAAAGTGCCAATTACATTGACAACTGGTTATTACATTGTCTCAGCTAATGGTACTTATGCATCACATAGCAACCAAGCATACAAAGCAACTGATTTTATTGATATTACTGGCGCAAGCATAATCAAGTTAGATACTGCCTTTTCGGTAGCTGGTGATGGTTATGCCTTTTATGATGCGAACAAAACCTTTATTAGTGGCTCAAGTACATTCGTAAAGACTGTGTCTGTACCTGCAAATGCAAGCTATTTCCGATTTACAGCCTACAATATTCCTGATAGCACCATTCGTATGTTTTTGGTTTATCCACTAACAAAATTGATGCCTGCGATTGACAAAATCAATAAGCAAGATTTAAACGGTAAATTTACCAAGTTGAATAATTTGCCATTCACACTGACAACAAATCAGTATGTTGTCTATAATGACGGAAAAACGGCAGATATTGCTAACACCAAGTTTTTTGTTTCGTCTTATATCAATGTGTCAAGTATCGATGTTTTATCCATTAACACCAAATTCTCAGGATACGGTGACGGATATGCATTTTATGATGTGAACAAGGTCTACATTTCAGGTTCTAATGCTTATACGACTACAATCAATGTGCCTGCTAACGCGGTCTATTTCCGATTCTCAGTTTATAACATTGATACAAATCTTGTAACTCTGACTGGTACAAACTCACTCAATTTTCTTAAAGAGCAAATTTCAACAATAAGTAAACAAATTCAACCGCCGATTAACTATTATTACGGAATCGGAAAAACTTTGATGATTGGTGACAGTCTAACATCAGGTGCTTATTACGATGATGTGGCTTTTAAAGGCGCATCAATCAATCAAAATGTACCATTTTATCTTGGGAAAATAACTAATAATGAAGTTAAAAATGCTGGTATTTCAGGGTCTACGCCAATTAGTTGGCACAGCACTGAGTTTTCTAAATATGACTATACGCAGTATGACACATTCTTTATTTGGCTTGGAACAAATGCTGGTCTTACAGATACTATGGATGCGGATGTTAATTCTAAAGCTAGTTACAACGACTATGCATCAACTAACACAGGGACTTACTGTAAGTTGATTGAGGAAATTAAGGCGGTTAATCCTGATGCATCAATCCATATTTGCACTATCTTCGCATCATCAGGAAATCTTGCGACAACAAATAGCGTAATCAATCAGATTGCTACAAAATACGATTTAAATATCATTGACATGAGTGATTTATCACCCTCTAATTATCCTAACTTGCATTTAGGTATTAACAATGTCCACTTTGGTAAATCAGGTAACATTTATATCGCCAACCGTATTGCAAATGATTTAAACAGTTACTTCGCAAGCAATCAACTCAAACTCGAATTTGGCTTGACGCCTAGAACAAATTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
152385a612051b25c280f9aa32614f38955adb7d6aa46922a154c358322f1cb4
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7686
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50