Genbank accession
WNM52441.1 [GenBank]
Protein name
pre-neck appendage protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,89
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MTEGTYIISGIKMPNYTILSGEGKGITYLRIADDAPAETIGITNLNMDGTAEYIGVDNFTIDGNRTRQGNTLSPAGGSRSSNIRFAGVKHGFACSVESFSSLLHGIDVTYASDDYFYQGDGIRVNEALESKYIHIQECETYDFGDDGITTHHSRYLILQNNYSHDPVKDSGNHNGIEVDDGSQHVFVMGNKTEKCFGGLEIKAHEPTSAASDVVVSDHIDIKSIRSYNIRHIGHHRAGDVQSKTAYNIMLNNCTSLYPQYNGSYENTTPRAMVICAYRNVVVNNFTAIGDGNFMANMPVIAVQFRAENVMLNNINVSGFKNSLADVKVFGGANRPKKVSLSNINIVNSSNNRGIAGGGKIYDLRIINANLQGNGTGNGVELYNNTAEIVGVSAENYKRPAMIAGKEYFYMPTSLKGGFSGGSTGSAAIAERSAVIASTDGSFAHSNRSFVIGSGAGSIANGSRSGVISSLSSVIEPGGHTRMIINSKNMKNSENYHIKAGYGADGPPSESNTKLDISTFTGTIKTAGQVQSGQNFGDYAEYFESQSGMAIPTGNIVTLDGRFIRKAQVNDIPIGVISETAGVILGDQMFHHKDKYLKNEFGGVITESVKKNGKMMLVIGIQIQ
Physico‐chemical
properties
protein length:623 AA
molecular weight: 66918,96130 Da
isoelectric point:6,31915
aromaticity:0,08026
hydropathy:-0,28812

Domains

Domains [InterPro]
IPR011050
STR
3–331
WNM52441.1
1 623
Architecture
ATT
STR
RBD
ATT 1-205 | STR 206-481 | RBD 482-616 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WNM52441.1
1 623
Domain Start End Length (AA) Confidence
N-terminal 1 10 10 0,1656
Central domain 11 491 482 0,9901
C-terminal 492 623 131 0,7925
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-10
Central
11-491
C-terminal
492-623

Taxonomy

  Name Taxonomy ID Lineage
Phage Staphylococcus phage S-CoN_Ph7
[NCBI]
3076600 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Staphylococcus sp.
[NCBI]
29387 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WNM52441.1 [NCBI]
Genbank nucleotide accession
OR354830 [NCBI]
CDS location
range 32477 -> 34348
strand +
CDS
ATGACAGAAGGTACTTATATTATATCTGGTATTAAAATGCCTAACTACACTATTTTAAGTGGAGAAGGTAAAGGGATAACATATTTAAGAATTGCTGATGATGCTCCAGCTGAAACAATTGGTATAACTAACTTAAATATGGATGGAACAGCTGAATATATCGGTGTTGATAATTTCACAATTGATGGAAATAGAACAAGACAAGGAAACACGTTATCTCCAGCTGGTGGTTCACGTTCAAGTAATATTAGATTTGCTGGTGTTAAGCATGGTTTTGCATGTTCTGTAGAATCATTTAGTAGTTTATTACATGGTATTGATGTAACGTACGCTAGTGATGATTATTTCTATCAAGGAGACGGAATCAGAGTAAATGAAGCATTAGAAAGTAAATACATTCATATACAAGAATGTGAAACTTATGATTTCGGAGATGATGGTATCACTACTCATCATAGTAGATACTTAATTCTACAAAATAATTATTCACATGACCCAGTAAAAGATAGTGGGAACCATAACGGTATTGAAGTAGACGATGGTTCACAACATGTATTTGTTATGGGTAACAAAACAGAAAAATGTTTTGGTGGTTTAGAAATCAAAGCACACGAACCTACAAGCGCAGCAAGCGATGTTGTTGTAAGTGACCATATTGATATTAAAAGTATTCGTTCTTATAATATTCGTCATATCGGACATCATAGAGCTGGGGATGTACAATCTAAAACAGCTTATAATATTATGTTGAATAACTGTACTTCATTATATCCACAATATAATGGTTCATATGAGAACACAACACCAAGAGCAATGGTTATTTGTGCTTACAGAAATGTAGTCGTTAATAACTTTACAGCTATTGGCGATGGCAACTTTATGGCAAATATGCCAGTTATTGCTGTTCAATTCAGAGCTGAAAATGTTATGCTTAATAATATTAATGTAAGTGGTTTCAAAAATTCATTAGCTGATGTTAAAGTATTTGGTGGAGCAAATAGACCTAAAAAAGTATCATTATCTAATATCAACATTGTTAATTCATCTAACAATAGAGGTATTGCAGGCGGTGGAAAAATTTATGATTTAAGAATTATAAATGCTAACTTGCAAGGTAATGGTACAGGAAATGGTGTTGAATTATATAACAACACGGCTGAAATTGTTGGAGTAAGTGCTGAGAATTATAAAAGACCAGCTATGATTGCTGGAAAAGAGTATTTTTATATGCCCACAAGTCTTAAAGGAGGATTTAGTGGAGGGAGTACAGGTAGTGCAGCTATTGCTGAAAGAAGTGCTGTTATTGCCTCTACTGATGGTTCCTTTGCTCATAGTAACCGTTCTTTTGTTATAGGCTCTGGTGCTGGTAGTATTGCTAATGGTTCACGTTCTGGTGTTATTAGTTCATTGTCATCTGTTATTGAGCCAGGCGGACATACTAGAATGATTATTAATAGTAAAAACATGAAAAACAGTGAAAACTATCACATTAAAGCTGGTTATGGAGCTGACGGTCCACCAAGTGAATCAAATACTAAACTTGATATTAGTACATTTACTGGTACAATCAAGACAGCAGGACAAGTTCAATCTGGACAAAACTTTGGGGACTATGCCGAGTATTTTGAATCACAAAGTGGTATGGCAATTCCTACTGGTAATATAGTTACACTTGATGGCAGATTTATAAGAAAAGCACAAGTCAATGATATTCCAATCGGTGTTATATCTGAGACAGCAGGAGTTATTTTAGGGGACCAAATGTTCCATCACAAAGATAAATATCTTAAAAATGAGTTTGGCGGAGTCATTACTGAAAGCGTCAAAAAGAATGGCAAGATGATGCTGGTAATTGGTATTCAGATACAGTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
92a858279d1a5bc5aa7a0d0cdbdd29110755e872e56ad58289cb4f68d7861bc8
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7733
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50