Genbank accession
AFM54803.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,69
Protein sequence
MAWENLITAIEAVITDNDNNEITGTVLRDLLINNLVPQLGASKFMGVANTGTVPAAPQSDVFYIAKTSGTYNNFDGVVLDNEAAFIAYQGGNWVKYNISDSVGSFTKLNPDGNLYEKGNYESGYLITSPGATQGNKVDGTPSWHRTGAIPALPNTEYTAYGYNSNFSAFAYSALPFNNANCLGTIAVTPAVGGGDKFTTPAGTNFLGFNVNGSGSTVTPAAGFDSNFVLIKGDTNVGYVPYGRILSPDADVKFPINVRIQDLIGQVSSIQISQTAKDELKYNPLLEITQRNAFTDTYGNVEVNSAQVTSNKPVSNIVTNTLKRVSGGAIPVPVGFEADLQLSADPGDIYAPVINYKITPAMLQEIGIDVLSPTYDNANPKKVSFRAGWLKDFTGGVTAIQIFTVLLYGNDPLNYSSFELNGSNGVISTTGNFYGNIVNDAGNASKDFNASSVTNEDLSGYRVRSYNEIPVYKEVTLGSNTKTFTGILISILPQSVDVAQLSRKITSFGFAMVNSDTLFGGAADTQFTLATNAINTNENFVPQPFKVSQAQDVDTTALQNGNVLAWDAGAEKFTPRESEGGVSTVTFQNSEKIAFYGCSFTESYYAIKNKSWVNKLAQMTDYIVANFGVSGNRLVDESQRLLDNSNPYHGSIGIKELNATYISFANIGNETLHTGSNNLDLYKAQMIEAIQAVYSVGATPIMGTDHNIQNTAIDALLYDVAKQFDTLYYGIGTLGERIVNNGILAFWGGGHPATRTNAHQFLEWLYFISQLPRPKRAIKVFRVRTEYKAGAPALADLNYDDINQRVKFWQEINSGEKSLKEANGQNGWEYYDRLNEAFAADTITNEYCKLINKENVQFNKFGLFEFILDKVNPTALKIYIKTASNDLDFYIKDNNNPADYKDNLRNQAAFEVTKAIYDGFNEPVDTAFTSDAHGANEMTYKGKEYSEALGGYWLFFKLSSGTATAGGAGNLSKVAGGGNTAYLQSSFALGRHSYDFFSTVGEPQMRFVPVAATYENGHAVISLNPADAKYLEFDKVKLIVADAGTFSVSDAYIEVTGGVDKPVFQKDVQPKLNGTELNADTAFRTDWISANNWVNEGATLEQMPVGLRDYPTVNNELRHVKLDFGVDMFPQKIKKVFNYPFSRGYTKVTIKAVVRLFPKVFNTTVASDDYHTGIRQITADSYDMGTLCVGITTGAGTPAVLRRNVDIGWAEVTFETYLPPFDSSFELSLWRDEKDLVDANYRNHTFPMQLQDVSVQIN
Physico‐chemical
properties
protein length:1257 AA
molecular weight: 137456,67980 Da
isoelectric point:4,91751
aromaticity:0,11535
hydropathy:-0,23787

Domains

Domains [InterPro]
DC_1005
STR
1–831
IPR036514
STR
587–752
SSF52266
STR
589–753
AFM54803.1
1 1257
Architecture
STR
RBD
STR 1-831 | RBD 832-1257
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AFM54803.1
1 1257
Domain Start End Length (AA) Confidence
N-terminal 1 159 159 0,7830
Central domain 160 387 229 0,4609
C-terminal 388 1257 869 0,3310
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-159
Central
160-387
C-terminal
388-1257

Taxonomy

  Name Taxonomy ID Lineage
Phage Croceibacter phage P2559S
[NCBI]
1176422 No lineage information
Host Croceibacter atlanticus HTCC2559
[NCBI]
216432 Bacteria > Bacteroidetes > Flavobacteriia > Flavobacteriales > Flavobacteriaceae > Croceibacter

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AFM54803.1 [NCBI]
Genbank nucleotide accession
JQ867099.1 [NCBI]
CDS location
range 22213 -> 25986
strand +
CDS
ATGGCTTGGGAAAACTTGATTACTGCAATAGAAGCAGTCATAACCGACAACGACAACAACGAAATAACAGGCACGGTCTTGCGTGATTTGTTGATTAATAACTTAGTGCCACAGCTGGGCGCATCTAAATTTATGGGCGTGGCTAATACTGGTACTGTACCAGCTGCACCGCAAAGCGATGTTTTCTACATAGCCAAAACCAGCGGAACGTACAATAACTTTGACGGCGTGGTGTTGGATAATGAAGCTGCTTTTATTGCTTACCAAGGCGGTAACTGGGTTAAGTATAATATTTCTGATAGCGTGGGTAGCTTTACAAAGCTTAACCCCGACGGAAACCTTTACGAAAAAGGTAACTACGAAAGCGGGTACTTAATAACGAGCCCAGGGGCTACGCAAGGTAACAAAGTGGACGGCACACCAAGCTGGCACAGAACGGGAGCGATACCTGCGCTACCGAATACAGAGTACACAGCTTACGGTTATAATAGTAACTTTTCTGCCTTTGCATACTCTGCGCTGCCTTTTAATAATGCTAATTGTTTGGGTACAATAGCAGTAACGCCAGCAGTAGGCGGCGGGGATAAGTTTACTACACCAGCAGGAACAAACTTTTTAGGTTTTAACGTAAACGGTAGCGGCTCGACAGTTACACCAGCGGCGGGATTTGACAGTAATTTTGTACTTATAAAAGGCGATACAAATGTGGGTTATGTGCCTTATGGCAGAATATTAAGCCCCGATGCAGATGTAAAATTCCCAATCAATGTAAGAATACAGGATTTAATCGGGCAGGTTTCATCTATACAAATAAGCCAAACAGCCAAGGACGAACTTAAGTATAATCCGCTTTTAGAAATTACCCAGCGAAATGCTTTTACAGATACTTACGGTAATGTAGAAGTAAACAGCGCACAGGTAACGTCTAATAAGCCCGTTTCTAATATTGTAACCAATACCTTAAAAAGAGTTTCGGGCGGTGCTATTCCTGTGCCTGTCGGTTTTGAAGCGGACTTACAGCTATCCGCAGACCCAGGGGATATATATGCGCCAGTAATTAATTACAAGATAACGCCTGCAATGCTGCAAGAAATTGGCATTGATGTATTAAGCCCTACGTATGATAATGCAAACCCTAAAAAGGTTTCTTTTCGTGCTGGTTGGTTAAAAGACTTTACTGGTGGCGTAACTGCAATACAAATTTTTACGGTGCTGCTTTATGGAAATGATCCTTTAAATTATTCAAGCTTTGAATTAAATGGGAGTAATGGTGTAATATCTACCACAGGGAACTTTTACGGTAATATTGTAAATGATGCGGGTAATGCAAGCAAGGACTTTAACGCATCAAGCGTAACGAATGAAGATTTAAGCGGCTACCGTGTACGCTCGTATAATGAAATACCAGTTTACAAAGAGGTAACCCTTGGGTCTAATACAAAGACTTTCACGGGTATATTAATAAGCATACTACCGCAATCGGTAGACGTAGCGCAGTTAAGTAGAAAAATTACCAGCTTTGGGTTTGCAATGGTTAATTCAGACACTTTATTTGGTGGTGCAGCAGATACGCAGTTTACACTTGCTACAAATGCAATAAATACAAACGAAAATTTTGTGCCGCAGCCTTTTAAGGTAAGCCAAGCGCAAGACGTAGATACTACGGCTTTGCAGAATGGTAATGTACTGGCGTGGGATGCAGGTGCAGAAAAGTTTACGCCACGTGAAAGCGAGGGCGGTGTAAGTACTGTTACTTTTCAAAACTCTGAAAAGATTGCTTTTTACGGGTGTTCTTTTACAGAAAGTTACTACGCTATAAAGAATAAGTCTTGGGTTAATAAACTGGCGCAAATGACTGATTATATAGTTGCAAATTTTGGGGTATCGGGTAACAGGCTGGTGGATGAAAGCCAAAGGCTTTTAGATAATTCAAATCCTTACCACGGCAGTATTGGTATAAAGGAACTTAATGCCACTTATATATCATTTGCTAATATAGGTAACGAAACGCTGCACACAGGTTCTAATAATTTGGATTTGTACAAGGCGCAAATGATTGAAGCTATACAAGCGGTTTACTCGGTAGGTGCTACGCCTATAATGGGAACAGACCATAACATACAAAATACCGCTATTGATGCGCTGCTGTATGATGTGGCAAAGCAATTCGATACACTTTACTACGGTATCGGTACGCTGGGTGAACGTATAGTAAATAACGGCATTTTAGCCTTTTGGGGCGGCGGACACCCAGCTACAAGAACCAATGCACACCAGTTTTTAGAATGGCTATATTTTATAAGCCAGCTACCAAGACCAAAAAGAGCGATAAAGGTTTTTAGGGTAAGAACAGAATACAAAGCAGGTGCGCCAGCTTTGGCAGATTTAAACTATGACGATATTAACCAGCGTGTAAAGTTTTGGCAGGAAATAAACAGCGGCGAAAAGTCCCTTAAGGAAGCAAACGGACAAAACGGCTGGGAGTATTACGATAGGCTTAATGAAGCTTTTGCTGCTGATACTATTACGAACGAGTACTGCAAGCTTATAAATAAGGAAAATGTACAGTTTAATAAATTTGGGCTTTTTGAGTTTATACTTGATAAAGTAAACCCAACGGCATTAAAAATATACATTAAGACCGCCAGCAATGACTTGGATTTTTATATCAAGGATAATAACAACCCTGCGGACTATAAAGACAACTTAAGAAACCAAGCAGCTTTCGAGGTTACAAAAGCAATATACGACGGCTTTAATGAGCCAGTAGATACGGCTTTTACTTCTGATGCGCACGGGGCAAACGAAATGACTTATAAGGGTAAAGAATATTCGGAAGCCTTGGGCGGTTATTGGTTATTTTTTAAGTTATCAAGCGGAACAGCCACGGCTGGCGGTGCGGGTAATTTATCAAAAGTAGCAGGTGGCGGTAATACTGCATACCTACAATCAAGCTTCGCACTTGGGCGACACTCTTACGATTTCTTTTCTACTGTGGGCGAGCCGCAAATGCGTTTCGTACCAGTAGCAGCAACGTATGAAAACGGACACGCTGTAATTAGTTTAAACCCTGCGGATGCTAAGTACTTAGAATTTGATAAGGTTAAGCTTATAGTGGCGGATGCTGGCACGTTTAGCGTATCAGATGCTTATATTGAAGTAACTGGCGGAGTAGATAAACCAGTATTTCAAAAAGACGTACAGCCTAAGCTTAACGGTACAGAGTTAAACGCAGATACAGCTTTCCGTACAGATTGGATAAGCGCAAATAACTGGGTAAATGAGGGGGCTACGCTGGAACAAATGCCAGTAGGTTTAAGAGATTACCCTACTGTAAATAACGAACTAAGGCACGTTAAGCTTGATTTTGGCGTGGATATGTTCCCGCAGAAAATAAAGAAAGTGTTTAATTACCCTTTTAGCCGTGGATATACAAAGGTTACTATTAAAGCCGTGGTAAGGTTATTCCCGAAAGTATTTAATACTACTGTGGCATCAGATGATTACCATACAGGAATAAGACAAATAACGGCAGACAGCTACGATATGGGAACGCTTTGCGTAGGTATTACGACAGGCGCAGGAACGCCTGCTGTATTACGTAGAAACGTAGATATAGGCTGGGCAGAAGTAACGTTTGAAACATACCTGCCGCCTTTTGATAGTTCGTTTGAATTATCTTTGTGGCGTGATGAAAAGGACTTGGTGGATGCTAATTACCGTAACCATACTTTCCCTATGCAGCTGCAAGATGTTTCTGTACAGATTAATTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
32080991bb1bbd87206e4d0d4336ddade00ca4d3a91468055bc1b60cb5efcb0b
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4452
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50