Genbank accession
ASJ79180.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect
Probability 0,87
Protein sequence
MADHNKPVLTSTYANFVSELDARFDDLSLGLDPAVTSATNLPVNAIRWNSALAKDQKWNGSSWVDKSSFYVLGSVRFNNGTVGAPSITFSDDTTTGIFKPTPTSIALTTSGVEALRATSGNIGIPGTLQLNSAVSIDANSSALTMRYAGGDQQYGISIKADADNTQAIGFFNAASQPVGRISQTATNIQIFGLSNLSVDNAVFSKDGFLTTNYVVNARNPIWRFGDSQLVGISYFQGTSGYQSADSIGMHFGEANAAGSKFSFTSDGRLVTTKNIVSGIAAPHDSGQNITVNGTGTTASTAPYLTVNSRGLVAGNGSQFTSGGLLFASYRDVRTTSYIGGITMRVRNVNDVVTDPVQMEFRIGPSYGDSFANAGDAALPAAPMTLSAGGVLNVSTSITTPYMQGVAAQSNGLKVSDPEETPGLNRELAHITPQSVVRNIRADFAQSTATGTGGRYAGVMTFSPYDGKTASAGGPSYQLAFGSSQNNGGSPQLRIRNGIDTTWNSWVDVMTPAGAIVHFARASAPSGYLKANGAAVSRTAYHALFDIIGTTFGAGDGSTTFNLPDLRAQFIRGWDDGLGVDSFRIFGSFQSGSVESHTHAPPAGLTGPWLSNAFSGDGQIDSSNVTGPGERNGVLGNTQAYGGDETRPRNIALLACIKY
Physico‐chemical
properties
protein length:658 AA
molecular weight: 68691,04460 Da
isoelectric point:5,77901
aromaticity:0,08967
hydropathy:-0,15532

Domains

Domains [InterPro]
DC_1584
STR
108–193
IPR037053
ATT
501–566
SSF88874
STR
505–658
IPR011083
ATT
513–570
ASJ79180.1
1 658
Architecture
STR
RBD
ATT
STR
STR 108-193 | RBD 419-500 | ATT 501-570 | STR 571-658
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
ASJ79180.1
1 658
Domain Start End Length (AA) Confidence
N-terminal 1 193 193 0,2726
Central domain 194 392 200 0,1132
C-terminal 393 658 265 0,9663
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-193
Central
194-392
C-terminal
393-658

Taxonomy

  Name Taxonomy ID Lineage
Phage Curvibacter phage P26059A
[NCBI]
1983783 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Curvibacter sp.
[NCBI]
1888168 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Betaproteobacteria > Burkholderiales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
ASJ79180.1 [NCBI]
Genbank nucleotide accession
KY981271.1 [NCBI]
CDS location
range 27748 -> 29724
strand +
CDS
ATGGCAGATCATAATAAACCAGTGCTAACTAGCACATATGCTAATTTTGTCAGTGAACTTGATGCTAGGTTTGACGATCTATCTCTTGGCCTAGACCCCGCTGTAACGTCAGCTACGAACCTTCCAGTTAACGCAATCCGTTGGAACTCTGCGCTTGCCAAAGATCAGAAATGGAACGGTTCCTCGTGGGTTGATAAAAGTAGCTTCTACGTATTGGGTAGTGTAAGATTCAACAATGGAACAGTTGGTGCTCCCAGTATTACGTTTAGTGATGACACTACTACGGGCATCTTCAAACCTACTCCAACTAGTATTGCGCTTACTACATCAGGCGTGGAAGCACTGCGGGCGACAAGTGGTAACATCGGAATTCCCGGTACATTGCAATTAAATAGTGCAGTCAGTATTGATGCAAATAGTAGTGCGCTGACTATGCGTTATGCAGGTGGGGATCAACAATATGGTATTTCCATTAAAGCCGACGCTGACAACACGCAGGCCATTGGTTTTTTCAATGCCGCCAGTCAACCAGTTGGTCGGATCAGTCAGACTGCTACAAATATTCAAATTTTTGGTTTGAGTAATCTTAGCGTAGACAACGCAGTATTCTCCAAAGACGGTTTCTTGACTACAAATTATGTAGTTAACGCACGAAACCCGATCTGGCGTTTTGGCGATTCGCAGTTGGTTGGTATTAGTTATTTCCAAGGTACTAGCGGTTATCAAAGTGCAGATAGCATTGGCATGCATTTCGGTGAGGCAAATGCAGCAGGTTCTAAGTTTTCGTTCACCAGTGATGGTCGATTAGTGACTACCAAGAATATCGTCAGTGGTATTGCTGCTCCTCATGATTCCGGTCAGAATATTACTGTGAATGGAACGGGGACTACAGCGAGTACCGCACCGTATCTTACTGTAAACAGCAGAGGATTAGTTGCAGGTAATGGTTCGCAATTTACATCCGGTGGTCTATTATTTGCAAGCTATCGTGATGTAAGAACTACATCATACATCGGTGGCATTACAATGCGCGTTAGAAACGTAAATGATGTAGTAACTGACCCTGTTCAGATGGAGTTCCGCATTGGACCTTCTTACGGTGATAGCTTTGCGAATGCCGGTGATGCTGCACTACCTGCTGCACCGATGACGTTGAGTGCCGGCGGTGTTCTGAATGTAAGTACTTCCATTACAACGCCTTACATGCAAGGCGTAGCAGCGCAGAGTAACGGTTTAAAAGTAAGCGATCCTGAAGAAACCCCCGGATTAAATCGAGAATTAGCTCATATTACACCTCAATCAGTTGTTAGGAACATACGTGCTGATTTCGCACAGAGTACTGCAACAGGTACAGGTGGAAGATACGCTGGTGTAATGACTTTCAGTCCATATGACGGTAAAACTGCATCCGCGGGTGGTCCAAGTTACCAACTTGCATTCGGCAGTAGTCAAAACAACGGTGGTTCTCCGCAACTGCGCATTCGCAACGGTATTGACACTACATGGAACTCTTGGGTTGATGTAATGACACCTGCTGGTGCTATTGTTCACTTTGCAAGGGCCAGTGCTCCTTCTGGTTATTTGAAGGCCAATGGTGCAGCTGTGTCAAGAACAGCCTATCATGCGCTATTTGATATTATTGGTACAACATTCGGTGCGGGAGATGGGAGTACCACGTTTAACTTACCTGATTTGAGGGCGCAGTTTATTCGTGGATGGGATGATGGATTGGGAGTAGACAGCTTCCGCATATTCGGTAGTTTCCAATCAGGTTCTGTTGAGAGTCACACTCACGCACCACCTGCAGGTTTGACTGGTCCTTGGCTGAGTAATGCATTCAGTGGTGATGGTCAAATTGATAGCAGTAATGTAACTGGTCCTGGTGAACGAAATGGAGTGTTAGGTAACACTCAGGCTTACGGTGGTGATGAAACTAGACCTCGTAACATCGCATTGCTGGCTTGCATTAAATATTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
9566de0cca28e43681d328696acc0c89639b0b2c39dc4a1e6ce7eed3b0b88d86
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6117
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50