Genbank accession
YP_009876126.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MTTKVNNRMIEGSTINVLDFGAVGDGLTDDYDALVNAFAEFSATGGILSFEEGKTYYIDRYRDTGNTNRNLALTGVTGTTILGNGATIKFRGDFHRSGPDQRGLGLSMIDLNDVQVYNLNLEGGVQTTTRDPGVTEAGGSGFFIQGCKNMSMFECSATDFWTDGFQVTSSGTAPSLTASQGVTLHNCEAHRCARNNISLIQIRGFTANYFRASDAGRTGTYDYHLPASNTWIEPNYRPDTLPTFVDELTGEITFNQLQTDNAIGSEYGASGSLEIGRVVFEGGNLAAADDAVGGTGNPEWAVLVVGADTTFRNMTFKLDTPNAPHIHYLHNDNNGSFIIKDSVIRTNGRGIYRPSSSSSRKFIVMGCLFDCRHTTQGGSVAAPSETDMLTPSLWNMDRHCYFVNNEIRYAAAMYGNRTGRIYGGNVSALFCKENNWWSPDWNTGLTVNDYLAPVLQTRKTRDEYFRNWSSTGVRPTATSNMTSAFYESPLSADYVAT
Physico‐chemical
properties
protein length:497 AA
molecular weight: 54300,39070 Da
isoelectric point:5,11673
aromaticity:0,10664
hydropathy:-0,36579

Domains

Domains [InterPro]
IPR012334
STR
3–272
IPR011050
STR
13–432
YP_009876126.1
1 497
Architecture
STR
STR 3-432 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_009876126.1
1 497
Domain Start End Length (AA) Confidence
N-terminal 1 26 26 0,8925
Central domain 27 486 461 0,9749
C-terminal 487 497 10 0,5969
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-26
Central
27-486
C-terminal
487-497

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage vB_VspP_pVa5
[NCBI]
1913109 Uroviricota > Caudoviricetes > Schitoviridae > Galateavirus > Galateavirus PVA5
Host Vibrio splendidus
[NCBI]
29497 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Vibrionales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_009876126.1 [NCBI]
Genbank nucleotide accession
NC_049379.1 [NCBI]
CDS location
range 5604 -> 7097
strand +
CDS
ATGACTACTAAAGTAAATAATCGAATGATCGAAGGATCTACGATTAACGTATTAGACTTCGGTGCAGTGGGTGATGGTCTAACAGATGACTACGACGCTCTCGTTAATGCGTTCGCTGAGTTTTCTGCCACAGGGGGTATCCTTTCATTCGAAGAAGGGAAGACTTACTATATAGACCGTTACCGTGATACCGGGAACACTAATCGAAACCTTGCATTAACAGGTGTGACAGGTACAACCATTCTTGGTAACGGTGCCACAATAAAATTCCGTGGGGATTTCCACAGAAGTGGTCCTGATCAAAGAGGCCTAGGCCTGTCTATGATTGATCTGAATGATGTTCAGGTTTACAATCTAAACCTTGAAGGAGGCGTTCAAACAACTACGCGTGATCCGGGAGTGACTGAGGCAGGTGGCAGTGGTTTCTTTATCCAAGGATGTAAGAATATGAGTATGTTTGAATGTTCAGCAACAGACTTCTGGACCGATGGCTTTCAAGTGACTAGTTCAGGCACAGCCCCTTCACTCACAGCCAGTCAAGGTGTTACGCTTCATAACTGTGAAGCCCATAGATGCGCACGTAATAATATCTCGTTAATTCAGATTCGAGGTTTTACTGCAAACTATTTCCGAGCATCAGATGCAGGACGTACAGGCACATATGACTATCACTTACCTGCAAGTAACACATGGATCGAACCTAATTATCGTCCAGACACCTTACCTACTTTTGTAGATGAGTTAACCGGTGAGATTACCTTTAACCAGTTGCAGACAGATAATGCTATCGGATCAGAGTATGGAGCAAGTGGCTCATTGGAAATTGGTCGTGTGGTTTTTGAAGGAGGTAATTTAGCAGCCGCAGATGACGCAGTAGGTGGCACAGGTAATCCTGAATGGGCCGTGTTAGTTGTTGGGGCAGACACAACATTCCGTAACATGACATTTAAGTTAGACACACCTAACGCCCCCCATATCCACTATCTACATAACGATAACAATGGCTCTTTCATTATTAAGGACAGTGTTATCCGTACAAACGGGCGCGGTATTTATCGCCCTAGTTCAAGCTCATCGCGTAAGTTTATCGTTATGGGGTGTCTGTTTGATTGTAGACATACAACCCAAGGCGGCAGTGTAGCTGCTCCATCAGAAACTGATATGTTGACTCCTTCCCTATGGAACATGGACAGACATTGCTATTTCGTGAATAATGAAATACGTTATGCAGCTGCCATGTATGGTAATCGTACAGGTCGTATCTACGGCGGGAATGTGTCTGCATTGTTCTGTAAAGAGAACAACTGGTGGAGTCCTGATTGGAATACAGGTTTAACTGTAAATGATTACCTCGCTCCTGTGCTCCAGACAAGGAAGACACGTGATGAGTATTTCCGAAATTGGAGTTCCACTGGGGTACGTCCAACTGCAACAAGCAACATGACATCAGCATTTTACGAATCTCCATTGTCGGCAGATTATGTAGCTACCTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
cd98bcb8518670e61af5e9c4f515ec7fb93252988019393a29d1aeaa86784d9e
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6925
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50