Genbank accession
XRX03485.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MTVTTDVQSIVYDTDGSTADFPIPFYFLRAADITAELIDATDNLTVLVLGTDFAITGAGNPSGGTLIASQAFAAGYKLHVYRVVPVTQESQYQQNDPFPAKTTEKALDKLTMLVQQQKQTTDRALVVPRSDLNPDTTLPPSRLRANKALGFDQNGDVIAIDLKIGYVVAPVVDSIAMVRLVPGTVTAVFALGYDAAGDGGGGDYYPDHSDTSTPDDGGTCLISSIDGTRFKLRSHSFISSKQMGVFPTKSPAWNTQQMQNGLNTAFGKFLFDCRTNSDIIKINGPLTVPIQKEIASNTRWAGTLQQTALDQPIFVVPAGSADVSINDIHLSYDGTPVSGADAIQLNGCFAFAARNIWISSCWNGIFANLGGNHELFGLRIFGYENCAALLSACGDVNVTQFRFHANDSIKGRLGGIRLQGPVEGCTFAQGDVTLGIYGITTANFGSNARGSAPYYNRFNAVYFDSAKTNPAFLDSLCHSAFDECWFASGGHDEAVGWSTALGNPGAFINNCLHLRFNGGDFENNGGPGAQVYASSRFVSFLGATCTHNQFSRSADAAAIQFLPDASDWRVVSCNFERDPDTVTYRQRYWCETGAGVSTRFIARDNLLGGCEPNINTSASPTTYSIGDNF
Physico‐chemical
properties
protein length:629 AA
molecular weight: 67492,43840 Da
isoelectric point:4,92569
aromaticity:0,10493
hydropathy:-0,11002

Domains

Domains [InterPro]
IPR011050
STR
294–466
DC_2234
RBD
459–628
XRX03485.1
1 629
Architecture
ATT
ATT
STR
RBD
ATT 8-138 | ATT 146-260 | STR 262-606 | RBD 607-628 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
XRX03485.1
1 629
Domain Start End Length (AA) Confidence
N-terminal 1 253 253 0,9928
Central domain 254 618 366 0,9968
C-terminal 619 629 10 0,0993
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-253
Central
254-618
C-terminal
619-629

Taxonomy

  Name Taxonomy ID Lineage
Phage Burkholderia phage vB_E332
[NCBI]
3417001 Viruses > unclassified bacterial viruses >
Host Burkholderia sp.
[NCBI]
36773 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Betaproteobacteria > Burkholderiales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XRX03485.1 [NCBI]
Genbank nucleotide accession
PQ789818.1 [NCBI]
CDS location
range 19637 -> 21526
strand +
CDS
ATGACCGTTACCACCGACGTGCAGTCGATCGTCTACGATACGGACGGCTCGACGGCGGATTTCCCGATTCCGTTTTACTTCCTGCGTGCCGCCGACATCACGGCCGAGCTCATCGACGCTACTGACAATCTCACGGTGCTCGTGCTCGGAACGGATTTCGCGATCACGGGTGCGGGCAATCCGAGCGGTGGGACGCTGATCGCGAGTCAGGCATTCGCCGCTGGATACAAGCTGCACGTCTACCGTGTCGTGCCCGTTACGCAGGAAAGCCAGTATCAGCAGAACGACCCGTTCCCGGCGAAGACGACCGAGAAGGCGCTCGATAAGCTGACGATGCTTGTGCAGCAGCAGAAGCAGACAACGGATCGCGCGCTCGTCGTGCCGCGATCGGATCTCAACCCGGACACTACGCTGCCGCCTTCGCGGCTGCGTGCGAACAAGGCGCTCGGCTTCGATCAAAACGGCGACGTCATTGCGATTGATCTGAAGATCGGTTACGTGGTTGCGCCTGTCGTCGATAGCATCGCTATGGTGCGCCTGGTGCCCGGTACTGTTACCGCCGTGTTCGCCCTTGGCTACGATGCTGCCGGCGATGGTGGTGGCGGTGACTACTATCCTGACCACAGCGACACGTCTACGCCCGATGACGGTGGCACGTGCCTCATTTCCTCGATTGATGGTACGCGGTTCAAGCTGCGCAGCCACAGCTTCATTTCGTCGAAGCAGATGGGCGTCTTTCCGACGAAGTCGCCGGCATGGAACACGCAGCAGATGCAGAACGGGCTCAACACCGCGTTCGGCAAGTTCCTTTTCGACTGCCGCACGAACAGCGACATCATCAAGATCAACGGCCCGTTGACGGTCCCAATTCAGAAGGAGATCGCGAGCAATACACGATGGGCGGGCACGCTGCAGCAGACCGCGCTTGATCAGCCGATCTTCGTCGTGCCGGCGGGGAGCGCCGACGTCAGCATCAACGACATCCACCTGTCCTACGACGGAACGCCGGTAAGTGGCGCCGACGCGATCCAGCTCAACGGTTGTTTCGCATTCGCCGCGCGGAACATCTGGATCTCGTCGTGCTGGAACGGCATCTTCGCGAACCTCGGCGGAAACCATGAGCTTTTCGGGCTGCGCATCTTCGGCTACGAGAATTGCGCGGCGCTGCTGTCCGCATGCGGCGACGTCAACGTGACGCAGTTCCGCTTTCACGCGAACGACAGCATCAAGGGAAGGCTCGGCGGTATCCGTTTGCAGGGGCCTGTCGAGGGGTGCACGTTCGCGCAGGGCGACGTGACGCTTGGCATATATGGGATCACGACGGCCAATTTCGGATCGAACGCACGGGGCTCCGCGCCGTACTACAACCGGTTCAATGCCGTCTACTTCGACAGTGCGAAGACGAACCCGGCATTTCTCGACAGCCTGTGTCACAGCGCTTTCGACGAATGCTGGTTTGCGAGTGGCGGCCACGACGAAGCAGTCGGATGGTCGACTGCGCTCGGTAACCCGGGGGCCTTCATCAACAACTGCCTTCACCTCCGATTCAACGGCGGCGACTTCGAGAACAACGGCGGCCCCGGCGCTCAGGTGTACGCGAGCTCGAGGTTCGTTTCGTTCCTTGGCGCAACGTGCACGCACAACCAGTTTTCGCGCTCGGCGGACGCGGCCGCAATTCAATTCCTGCCGGACGCGAGCGACTGGCGTGTCGTGTCTTGCAACTTCGAGCGCGATCCCGACACCGTCACGTATCGGCAACGCTACTGGTGCGAGACCGGCGCTGGCGTGTCAACGCGTTTCATCGCGCGCGACAACCTGCTCGGTGGCTGTGAACCGAACATCAACACGTCAGCATCGCCGACGACATACTCGATCGGCGACAACTTCTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
2351dd071cb4c378e7e157cc734731fc561a40d801cc19505c43dde69aec2978
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8879
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50