Genbank accession
WZL56200.1 [GenBank]
Protein name
minor structural protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MALSGTLYTNVGAHWRLSISWSASQSISNNSSTVTAKMYWEALDGYGGVNSTAYASGTITIDGSSYSFGGNGLAGLSANQKKLLATKSKTIKHNSDGKKSFSISGVFNLPDVYLGGKKYTKVSIASKSYTLNTIPRLSTMTSSPSFTAGTNRNISISRQSSSFGHRLHIDVKGSDGNWKNIKTINFSTSETSKSTSFSVSEHREIFYRLNQRSSMDVRWNLHTLSGGNSIGYNTYSGKVSLPSLSTVSSTNGQASGTNNFYIDQEMSVGISRSNSAFTHTISIECGSFKKTLTGVSTSFKWTPTASEQASLAAQMPNTSNRAGTIHVTTYYDGDQIVGSTDHSIKFYIRESNSKPDFSATGIYYMDTNPTTLAITADDQYLIQNYSTLRVEIPKEAMATPKNGATIDYYSVSVNGVTKKANYVSNEAIAIDFGTIASSDVTTITVKAVDSRGFSTSVSKSIKMVPYSTPVVTTTAKRTNGFEPDTTLTLKGSVSPLSVNGTNRNSVEIARYRYKQAEATSFGDWQAFSLSGFPSYTATNVPLTLDTTLTFEIEVEVSDMLTSTTKRLVVPAGRPIMFMDPDRKSVGFFDFPDGEYEVKINGRVIFGSTFWQTTNQGEGIGALHLNNSDITGLNGLYFSDVAQPNNGEGLLFLKTGKTSGSSNLDDYDEFSIRDSVVTFNVPGTEIGIDNHIDMRNRQLRNVDHITINDPGGHEGIEWLNGTGWRIVEAPNNMSNNSGPLQIAVGTSRKLTISDAGNVYNTGNWFKGESGGITNFGSMGVARLISDQGGSLSVSSDAKGNRVQSVDIWNRKITTTNGVASALITNTGDLGRQGSARKYKLNIKSVDDSIFERILYLDPKSWHDKRDMELRAEYMTKVHSGEDPNLAVMPSTKRAYGLIAEELLDAGLDMFVIYGPEDEQGNAEVEGIAYDRLWVFLIPLVRSHQTKVKQLEEEVQKLKEQLGGQ
Physico‐chemical
properties
protein length:963 AA
molecular weight: 104825,43430 Da
isoelectric point:6,78739
aromaticity:0,08930
hydropathy:-0,38484

Domains

Domains [InterPro]
IPR008577
STR
238–581
DC_0284
STR
536–905
WZL56200.1
1 963
Architecture
ATT
STR
RBD
ATT 4-126 | STR 230-905 | RBD 906-962 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WZL56200.1
1 963
Domain Start End Length (AA) Confidence
N-terminal 1 138 138 0,0004
Central domain 139 337 200 0,5773
C-terminal 338 963 625 0,5704
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-138
Central
139-337
C-terminal
338-963

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage fHSPT3
[NCBI]
3139610 No lineage information
Host Bacillus subtilis subsp. subtilis str. 168
[NCBI]
224308 Bacillota > Bacilli > Bacillales > Bacillaceae > Bacillus > Bacillus subtilis subsp. subtilis str. 168

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WZL56200.1 [NCBI]
Genbank nucleotide accession
PP626411 [NCBI]
CDS location
range 88728 -> 91619
strand -
CDS
TTGGCTTTATCAGGAACGTTATACACTAACGTTGGTGCTCACTGGAGGTTGTCTATCTCATGGTCAGCTTCTCAAAGTATTTCAAACAACTCCAGTACTGTTACAGCGAAGATGTACTGGGAAGCTTTAGATGGTTATGGGGGAGTCAACTCGACTGCATACGCAAGCGGAACTATAACAATAGATGGTTCCTCGTATAGCTTTGGAGGTAATGGTCTGGCTGGACTTAGTGCAAACCAGAAAAAGCTACTTGCAACTAAATCCAAAACAATAAAGCACAATAGTGATGGTAAAAAGTCTTTCTCAATTAGCGGTGTTTTTAACCTACCAGATGTGTATTTAGGGGGTAAAAAGTACACCAAAGTAAGTATTGCCTCTAAGTCTTACACACTGAACACAATCCCAAGACTTTCTACCATGACATCTAGCCCTAGCTTTACAGCAGGAACAAACAGAAATATATCTATTTCTAGGCAGTCGTCCTCTTTTGGTCACAGACTCCACATAGACGTTAAGGGCTCTGATGGAAACTGGAAAAACATTAAAACCATTAACTTCTCTACTTCAGAGACATCTAAGTCTACGTCATTTTCTGTTAGTGAACACAGAGAGATTTTTTACAGATTGAATCAAAGGAGTTCAATGGATGTTAGGTGGAACCTACATACTCTCAGCGGAGGAAATAGTATAGGGTATAATACTTACTCAGGGAAGGTAAGTTTACCTAGCCTAAGTACAGTAAGCTCCACCAACGGTCAAGCTAGCGGCACTAACAACTTCTATATTGACCAAGAAATGTCTGTAGGTATTTCTCGATCTAACAGTGCATTTACTCACACGATTTCAATTGAGTGTGGGTCATTCAAGAAAACACTTACTGGAGTATCAACAAGCTTCAAATGGACTCCTACAGCTAGTGAGCAGGCTTCTCTAGCAGCCCAGATGCCTAACACATCGAATAGAGCAGGTACTATCCACGTTACGACTTACTACGACGGTGATCAGATTGTTGGGTCAACAGATCACAGTATTAAGTTTTATATTCGGGAAAGCAATAGTAAGCCAGACTTCTCTGCAACGGGAATCTATTATATGGATACGAATCCGACAACTTTAGCAATCACAGCAGATGATCAGTACCTTATCCAGAACTATTCCACATTACGAGTAGAGATTCCGAAGGAAGCGATGGCAACTCCTAAAAACGGAGCGACAATCGACTACTATTCAGTTTCAGTCAACGGGGTAACCAAAAAGGCAAACTATGTGTCTAACGAAGCTATAGCAATCGACTTCGGTACGATTGCGTCAAGCGATGTTACGACGATAACTGTTAAAGCAGTAGATTCCCGAGGATTTAGTACTTCGGTATCTAAAAGTATAAAAATGGTTCCTTACTCTACACCTGTAGTTACAACAACTGCAAAACGTACAAATGGTTTTGAACCTGATACCACTTTGACACTGAAAGGTAGTGTATCTCCTCTTAGTGTGAACGGAACCAATAGAAACAGCGTAGAGATTGCAAGATACAGGTACAAGCAGGCGGAAGCAACTTCTTTCGGAGACTGGCAAGCATTTAGCCTGTCTGGGTTCCCAAGCTATACCGCAACAAATGTACCACTTACATTAGATACAACTCTGACTTTTGAAATTGAAGTAGAAGTATCTGACATGTTAACCTCTACAACAAAACGTCTTGTTGTTCCTGCTGGACGGCCTATCATGTTTATGGACCCAGACAGAAAGTCTGTAGGTTTCTTCGATTTTCCAGACGGAGAGTACGAGGTAAAAATTAACGGACGTGTTATCTTCGGAAGTACTTTTTGGCAGACAACCAACCAAGGAGAAGGTATCGGAGCCTTGCACTTAAACAACTCAGATATCACAGGTCTTAACGGGTTGTACTTTAGTGATGTAGCGCAGCCGAATAATGGTGAAGGTCTTCTATTCCTTAAAACAGGTAAAACTTCGGGCTCCAGTAACTTGGATGACTATGACGAGTTCTCTATTCGAGACAGCGTAGTGACGTTCAACGTCCCCGGAACAGAGATTGGGATTGATAACCACATAGACATGCGGAACAGGCAGTTAAGGAATGTTGACCATATAACCATAAATGACCCCGGAGGTCATGAGGGTATTGAATGGTTAAACGGTACTGGATGGCGGATTGTAGAAGCTCCTAACAACATGTCTAACAACTCCGGCCCTCTTCAGATAGCCGTTGGAACATCAAGAAAGTTAACTATCTCTGATGCTGGTAACGTTTATAATACCGGAAACTGGTTTAAAGGGGAATCTGGAGGTATTACTAACTTTGGTAGTATGGGTGTTGCCAGATTAATTAGTGATCAAGGGGGAAGCCTAAGTGTATCTTCTGACGCTAAAGGAAACAGAGTACAATCAGTTGATATATGGAACAGAAAGATCACAACCACTAATGGGGTTGCATCAGCCCTAATTACAAATACAGGGGACTTGGGCAGACAGGGCTCTGCTCGAAAGTATAAATTAAATATAAAGTCTGTAGACGACTCCATTTTTGAAAGGATACTATATTTAGACCCTAAGTCGTGGCATGATAAGAGGGATATGGAACTCAGGGCGGAGTATATGACTAAAGTTCATAGTGGAGAAGACCCTAACTTAGCTGTTATGCCTAGCACTAAAAGAGCTTATGGGTTGATTGCGGAGGAGCTACTAGATGCTGGTTTAGACATGTTTGTTATATACGGCCCAGAAGACGAGCAAGGAAACGCTGAGGTAGAGGGTATAGCCTATGATAGGCTTTGGGTATTTCTGATACCGCTGGTCAGGAGCCACCAGACAAAAGTAAAGCAACTAGAAGAAGAAGTACAAAAACTTAAAGAACAACTAGGAGGACAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
731aa572d3cb9acf0387b11b351ba0f0f70c5ba7aaf20340afcd742392a781e8
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,2922
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50