Genbank accession
QZI86165.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MSQIIKLKNSQTPSAVPTAGDLILGEVAVNTYEGWLHYKKNDGSDEILTLDPAAIEAAQASADNALSVAQSKVAPDELGDYATYSVDSFSDLIAGLPVTLQVGDTVTTGLTVWEIVSTVTPVAIVGGLYAKPLNKLYISDFGADRTGVVEATAAWQQAYDLGDQFAPKVSVKMASGTYRVGELTMKAGVGTYGVGKNDVRLVPAGDTIQIFKLDLGTGGGANLDMVGFSIQSDTNTGVKGVLGIGCNRLNLFDIGFFGCEENFRLDLGGWNRVINCETSGGATTPSGYFWVGSSDDSEYGCVFSVIENYQIRVTGTGSADPACVFRRAVALKITNLIASSQEFTGTMALVENDCQGLMFTDCSSVGFGIGLWMRKGSGIDKSPIFNNFNNFEFDQNSTNAVLLEAGINNRFISCPVTSSFVGTDTQAIVIKPDGIQNRFFGCHVTGYFDAGGVGWLFEGADGNVLDHCVVSGCETGVTANGLGHSNNKLISCDFSNDISGFAVTGDWTNAGNKFINLQGTLPASVTAPAVPTSGVAQSNPYPVDARLFIQPNTLISFEINGGTVVPWTTPLDIVLRAGETITLFYTGIAPTWTWVASQ
Physico‐chemical
properties
protein length:598 AA
molecular weight: 63174,18280 Da
isoelectric point:4,42761
aromaticity:0,09532
hydropathy:0,09632

Domains

Domains [InterPro]
IPR011050
STR
130–519
IPR011050
STR
130–530
QZI86165.1
1 598
Architecture
STR
RBD
STR 130-530 | RBD 531-597 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QZI86165.1
1 598
Domain Start End Length (AA) Confidence
N-terminal 1 152 152 0,9914
Central domain 153 516 365 0,9927
C-terminal 517 598 81 0,9838
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-152
Central
153-516
C-terminal
517-598

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage 172P1
[NCBI]
2859291 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Vibrio crassostreae
[NCBI]
246167 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Vibrionales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QZI86165.1 [NCBI]
Genbank nucleotide accession
MW865292.1 [NCBI]
CDS location
range 19384 -> 21180
strand +
CDS
ATGTCTCAGATTATTAAACTTAAAAACTCACAGACACCAAGCGCCGTCCCTACGGCAGGTGATTTGATACTGGGGGAAGTGGCAGTCAATACTTACGAAGGCTGGCTGCACTACAAGAAAAACGATGGTAGTGACGAAATACTGACCTTAGACCCTGCGGCTATCGAAGCAGCACAAGCCTCTGCGGATAATGCACTATCAGTCGCTCAGTCGAAAGTAGCACCTGATGAGTTGGGAGATTACGCTACCTATAGCGTGGATAGTTTTTCCGATTTAATTGCAGGGCTACCGGTAACTTTGCAGGTAGGAGATACCGTGACTACAGGCCTCACTGTGTGGGAGATTGTCTCTACCGTGACCCCTGTCGCAATTGTAGGAGGGTTGTACGCAAAGCCTTTGAATAAGCTGTATATCTCTGATTTTGGTGCAGACCGAACAGGTGTCGTAGAAGCTACTGCCGCTTGGCAACAGGCTTACGACCTTGGCGACCAGTTTGCACCAAAGGTCTCCGTAAAAATGGCATCAGGGACTTATCGTGTCGGTGAGTTGACTATGAAGGCAGGGGTAGGTACTTATGGGGTAGGTAAGAACGATGTTAGGCTTGTACCAGCAGGTGATACTATCCAAATCTTCAAATTAGACCTTGGTACAGGTGGAGGTGCAAACCTAGATATGGTAGGCTTCTCTATCCAATCAGATACCAATACAGGTGTGAAAGGGGTTCTAGGTATCGGTTGTAATCGATTGAACCTTTTCGATATTGGGTTTTTCGGTTGTGAGGAGAATTTTAGACTGGACTTAGGTGGCTGGAACAGAGTCATAAACTGTGAAACGTCAGGAGGTGCAACTACTCCTAGCGGCTATTTTTGGGTAGGCTCTTCAGACGACAGCGAATACGGTTGCGTGTTCTCTGTTATTGAAAACTACCAAATTCGAGTCACAGGAACAGGTAGTGCAGACCCCGCGTGTGTTTTCCGTAGAGCGGTTGCCCTGAAAATCACCAACTTAATAGCTAGCTCCCAAGAGTTCACAGGAACAATGGCATTGGTAGAGAATGACTGTCAAGGTTTGATGTTTACCGACTGCTCTAGCGTAGGTTTTGGTATTGGGCTGTGGATGCGTAAAGGTTCGGGTATCGATAAATCACCTATCTTTAACAACTTCAACAACTTTGAATTTGACCAGAACAGCACCAACGCTGTACTCCTCGAAGCAGGTATTAATAATAGATTCATATCTTGCCCTGTTACTAGTTCTTTTGTTGGTACAGATACACAAGCAATCGTAATTAAGCCTGACGGTATCCAGAACAGGTTCTTCGGGTGTCATGTTACAGGTTACTTCGATGCAGGAGGTGTTGGTTGGTTGTTTGAAGGGGCAGATGGCAACGTCTTAGACCATTGTGTGGTTTCAGGATGCGAGACAGGTGTAACAGCTAACGGTCTGGGTCATTCTAATAACAAACTAATCTCTTGTGATTTCAGTAATGACATTTCAGGATTTGCAGTCACAGGGGATTGGACTAATGCAGGTAATAAGTTCATCAACCTTCAAGGGACTCTGCCTGCCAGTGTTACTGCACCTGCGGTTCCGACGTCAGGAGTTGCCCAATCTAACCCTTACCCTGTCGACGCTAGGTTGTTCATTCAGCCGAACACGTTAATCAGTTTCGAAATTAACGGAGGGACGGTAGTACCTTGGACGACACCTTTAGATATTGTACTTCGTGCAGGCGAGACAATCACTTTGTTCTACACAGGAATCGCTCCAACATGGACTTGGGTCGCTTCACAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
91188d4a7cab5b57a31f7daea1962e89e2389baaca674f1b440d5a6e6753f7c9
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8580
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Rapid evolution of virus immunity in the wild Piel,D., Bruto,M., Labreuche,Y., Blanquart,F., Chenivesse,S., Lepanse,S., James,A., Garcia Cruz,R., Dubert,J., Petton,B., Lieberman,E., Wegner,M.K., Hussain,F.A., Kauffman,K.K., Polz,M.F., Gandon,S., Bikard,D. and Le Roux,F. 2024-02-09 — GenBank