Genbank accession
WEM34268.1 [GenBank]
Protein name
tail sheath protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MASSNLSPGVGFTETDLTNIVGSSGTSGGAFAGDFAWGPVEQIATVSSPLELEKTYHKPDDKNYTSWFSAFNFLAYTGDLKIVRAADEDAINSSDDGNGFLVKNSNHFEVVKTAPTTVQFAAKYPGALGDSIAVHMADASTFAGWQYAYLFDTAPGSSQWAESLGAANDELHIVIVDKQGKFSGVVGSVLETFSYLSKASDSKDANNGPNFYINVLNRTSKYVWALALPTGADLSAPSTGKVASVTVGAGGTGYTAAPTVTFSLPATGGVRATGTATVTAGAVTGVTITNAGSGYVTAPTITFAGAGTGATATAVVGTVTDAAEWGTPGVVAGEAQTFKRLVAVKAAPLTGGKDSTAITAGDLTRAYDLFSNQEEVDVSLIFTGDAGGETEHNVTVQSAIDNLAESRRDCVVFYSPQLSDVLNKTQSDAVNAVVSTRNLVGRASSYAVMDSGWKLQYDVYNDKYRWIPLNADLAGLCAQVDSTNDPWVSPGGYTRGRLKNVVSLAFNPNKTSRDAIYKVGINPVVTFNTDGTVLYGDKTLLGKNSAFGQIGTRRLFISLEKDISTAAKYYLFETNNDFTRNNFVNMVSPKLEQVRGRGGIEDFRVVCDTSNNTAEVIMNRQFVGSIFIKPVYSINWVQLNFVAVRQDVSFDEVVGGTF
Physico‐chemical
properties
protein length:658 AA
molecular weight: 69596,55530 Da
isoelectric point:4,92933
aromaticity:0,10030
hydropathy:-0,06596

Domains

Domains [InterPro]
G3DSA:3.40.50.11780
STR
24–155
IPR035089
TAS
358–540
WEM34268.1
1 658
Architecture
STR
ATT
STR
TAS
TAS
STR 24-45 | ATT 46-240 | STR 335-508 | TAS 509-540 | TAS 543-640 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WEM34268.1
1 658
Domain Start End Length (AA) Confidence
N-terminal 1 207 207 0,7991
Central domain 208 406 200 0,2089
C-terminal 407 658 251 0,2176
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-207
Central
208-406
C-terminal
407-658

Taxonomy

  Name Taxonomy ID Lineage
Phage Xanthomonas phage X1
[NCBI]
2511832 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Xanthomonas campestris pv. campestris str. 8004
[NCBI]
314565 Pseudomonadota > Gammaproteobacteria > Lysobacterales > Lysobacteraceae > Xanthomonas > Xanthomonas campestris

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WEM34268.1 [NCBI]
Genbank nucleotide accession
OQ427096 [NCBI]
CDS location
range 43139 -> 45115
strand +
CDS
ATGGCATCATCTAATCTAAGCCCTGGAGTTGGTTTCACTGAAACTGACCTCACCAACATTGTTGGTTCTTCTGGCACCTCGGGCGGTGCATTTGCGGGTGACTTTGCGTGGGGACCAGTCGAGCAGATTGCGACAGTGTCTTCGCCATTGGAACTCGAGAAGACCTATCACAAGCCAGATGACAAGAACTACACTTCTTGGTTCTCTGCATTCAACTTCCTCGCTTATACTGGCGACCTGAAGATTGTTCGTGCGGCTGACGAAGATGCAATCAACTCTTCGGATGACGGCAACGGCTTCCTGGTAAAGAACTCGAACCACTTTGAAGTTGTCAAGACTGCTCCTACAACTGTGCAGTTCGCTGCAAAGTATCCGGGTGCACTGGGTGACTCGATCGCTGTTCACATGGCTGACGCTTCGACGTTCGCTGGTTGGCAGTATGCGTATCTCTTCGACACCGCTCCGGGCTCCTCGCAGTGGGCTGAATCCCTTGGTGCAGCGAATGACGAACTTCACATCGTGATCGTTGACAAGCAGGGTAAGTTCTCGGGCGTGGTTGGTTCGGTGCTTGAGACCTTCTCTTACCTGTCGAAGGCTTCGGATTCCAAGGATGCGAACAACGGTCCTAACTTCTACATCAACGTCCTGAACCGTACTTCTAAGTATGTCTGGGCGCTGGCTCTTCCTACTGGCGCAGATCTGTCTGCTCCTTCGACCGGTAAGGTTGCTTCGGTAACTGTCGGCGCAGGTGGTACAGGCTACACTGCGGCACCAACCGTAACATTCTCTCTTCCAGCAACAGGCGGCGTTCGTGCTACCGGTACTGCAACTGTGACGGCTGGCGCTGTAACTGGTGTGACCATCACCAATGCAGGTTCCGGATACGTCACGGCTCCTACTATCACATTCGCAGGAGCGGGTACAGGTGCAACGGCAACTGCGGTTGTTGGCACTGTCACTGACGCTGCAGAATGGGGTACTCCAGGTGTGGTTGCAGGTGAAGCACAGACCTTCAAGCGCCTTGTCGCTGTAAAGGCTGCTCCTCTGACCGGTGGTAAGGATTCGACTGCTATCACTGCAGGTGACCTGACTCGCGCTTACGATCTGTTCTCGAACCAGGAAGAAGTCGACGTATCGTTGATCTTCACTGGCGATGCAGGTGGTGAGACTGAGCACAACGTTACTGTCCAGAGTGCAATCGACAACCTTGCTGAATCCCGTCGCGACTGCGTTGTGTTCTACTCGCCGCAGCTTTCGGACGTCCTGAACAAGACTCAGTCTGACGCAGTGAACGCTGTTGTATCGACTCGTAACCTCGTTGGACGCGCAAGCTCCTACGCTGTTATGGACTCGGGTTGGAAACTCCAGTACGACGTTTACAACGACAAGTACCGTTGGATCCCGCTGAACGCTGACCTCGCAGGTCTCTGCGCCCAGGTTGACAGCACCAATGATCCATGGGTCAGCCCAGGTGGTTACACTCGCGGTCGCCTTAAGAACGTTGTCTCGCTGGCGTTCAACCCGAACAAGACCAGCCGTGATGCGATCTACAAGGTCGGTATCAACCCAGTTGTCACGTTCAACACTGACGGAACTGTCCTCTACGGAGACAAGACCCTGCTCGGTAAGAACTCGGCATTTGGACAGATCGGTACCCGTCGCCTGTTCATCTCCCTGGAGAAGGATATCTCGACGGCTGCTAAGTACTACCTCTTCGAGACCAACAACGACTTCACACGAAACAACTTCGTGAACATGGTGTCGCCAAAGCTCGAACAGGTACGCGGACGTGGCGGTATCGAAGACTTCCGCGTTGTTTGCGATACGTCGAACAACACCGCCGAGGTCATCATGAACCGTCAGTTTGTTGGTTCGATCTTCATCAAGCCTGTCTACTCGATCAATTGGGTTCAGCTCAACTTCGTTGCGGTCCGTCAGGACGTCAGCTTCGACGAAGTGGTCGGTGGCACATTCTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
2100620d6a0ecab3ceefcafcc6dd564ab3168b535ebb95c561badcce307cf031
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8338
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50