Genbank accession
UGO53778.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,87
Protein sequence
MINMKGVLVDASNKPISGAKIILRSVKNGSVPTGIEAEVVTDENGAYDFSANVGSYLCYIFVENTETALPGYVNIYDFSGAGTLQEYLYAPCEKDARPMFIFMWEIIRQEINSSLRENRDIEERLKQLRDEVEALAEISANGGNVIYKTVQEGMAATQDGGYFRVESSIGGETLFFWYRKNGSIAVKLGGVPSDEAINAVRRLIADVDDSNFVLKIVNGLGRKLFSVSANEEIGTKNVKITRDGITTPGVSINDVAGKGGIYSSDNLGRSIALFDEKGFARANKISGESAELSIDGTQNVLSVIDPLGRGKVIIKDEIKSGGGNSDELAADIARIDSICASYSDNVKAQYNPNISRFIYEICHILWYGQSLSTNQEGFPALTKLVIEHFDNYMIGESTRPNTRGGVDFVPVGEKKLNPLKAVVQSEDGARVLTQQEENALVYGKGNEGEGGVACVNFIKSMLLDSMQMHSNPNRKFVLSNCGVNGRTIEQLSKGASPEIYNRARQAVQIVKDIAASENVSYGIPCVFHSQGEWNYWKMNSGTDDKQQFINKTQKVFDDFVSDFCQGQDKPPAFFTYQTGASYTRDDKDLSIGMAQLEMAKSGNGVYGTYPAYAMPDKGGHLTSNGYRWADMYHAKVAFKVMILGEGWEPLHIVHGEVKGNIGLYGYHVPAPPLRFNEVLVQRALTMYPNKGFRATDGGDANNPLQIKSVQIVSPRVIKVEFARNPVGTVKLWYADKTEHNGNGNLQDSDKFKSMYNYEFIEGSSQTADENIKSLVGKPYPLNNWAFAQVFKVEV
Physico‐chemical
properties
protein length:794 AA
molecular weight: 87398,43960 Da
isoelectric point:5,45344
aromaticity:0,09572
hydropathy:-0,32758

Domains

Domains [InterPro]
IPR013609
ATT
3–112
IPR008969
ATT
5–67
SSF52266
STR
427–637
UGO53778.1
1 794
Architecture
ATT
STR
ATT 3-112 | STR 123-779 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
UGO53778.1
1 794
Domain Start End Length (AA) Confidence
N-terminal 1 547 547 0,7528
Central domain 548 746 200 0,3451
C-terminal 747 794 47 0,7900
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-547
Central
548-746
C-terminal
747-794

Taxonomy

  Name Taxonomy ID Lineage
Phage Serratia phage vB_SmaS_Stoker
[NCBI]
2902692 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UGO53778.1 [NCBI]
Genbank nucleotide accession
OL539464.1 [NCBI]
CDS location
range 18098 -> 20482
strand +
CDS
ATGATTAACATGAAAGGCGTTCTGGTTGACGCTTCAAACAAGCCTATTTCAGGGGCAAAGATTATCCTTCGCTCAGTGAAAAACGGCTCAGTTCCTACCGGAATAGAGGCGGAAGTAGTCACCGACGAAAACGGCGCTTACGACTTTAGCGCAAATGTCGGCAGCTACCTTTGCTATATCTTTGTCGAAAATACAGAAACAGCCCTTCCAGGGTATGTAAATATCTATGATTTCTCCGGTGCTGGTACTCTCCAGGAGTATCTTTACGCGCCGTGCGAAAAGGATGCTCGCCCCATGTTTATCTTCATGTGGGAAATAATTCGCCAGGAGATTAATTCCTCTCTTCGTGAAAACAGGGATATCGAAGAAAGACTAAAGCAACTGCGTGATGAAGTAGAGGCGCTTGCTGAAATCTCTGCAAATGGCGGCAACGTTATTTATAAGACTGTTCAGGAGGGTATGGCCGCAACCCAGGACGGCGGATATTTCCGCGTTGAGTCCTCAATAGGTGGCGAAACTCTGTTTTTCTGGTACAGAAAAAACGGCTCTATCGCTGTCAAGCTCGGCGGCGTTCCCAGCGATGAGGCAATAAACGCTGTAAGGCGATTAATTGCCGATGTTGACGATAGCAACTTTGTTTTAAAAATCGTTAACGGACTTGGGCGAAAGCTTTTCTCGGTTAGCGCCAATGAAGAAATTGGAACCAAGAACGTTAAAATAACCAGGGACGGTATTACCACTCCTGGGGTTTCCATTAACGACGTCGCAGGAAAGGGCGGGATTTATTCATCCGACAACCTCGGCCGCTCAATAGCTCTTTTTGATGAAAAGGGTTTTGCCAGGGCTAACAAAATCTCGGGCGAATCCGCCGAGCTGTCAATCGATGGAACGCAAAACGTATTATCGGTAATAGACCCGCTTGGCCGCGGAAAGGTAATTATCAAGGATGAGATTAAATCCGGAGGCGGAAATTCTGATGAACTTGCGGCGGATATTGCAAGAATTGACAGCATTTGTGCATCTTATTCTGACAACGTAAAGGCTCAATACAATCCTAATATCTCAAGATTTATTTATGAGATTTGCCATATTCTATGGTACGGACAAAGCCTTTCAACTAATCAGGAAGGTTTTCCGGCTTTGACCAAATTGGTTATTGAGCATTTCGATAATTACATGATTGGCGAAAGCACAAGGCCAAACACTCGCGGAGGTGTTGATTTTGTTCCTGTCGGCGAGAAAAAGCTAAACCCGCTAAAGGCTGTCGTTCAAAGTGAAGACGGCGCGCGCGTGCTGACTCAGCAGGAAGAAAACGCATTGGTTTACGGCAAAGGTAACGAAGGCGAAGGCGGTGTCGCTTGTGTTAACTTTATTAAGTCGATGCTGTTGGATTCAATGCAAATGCATTCAAACCCTAATCGAAAATTCGTTCTTTCTAACTGCGGCGTTAACGGGCGCACAATTGAGCAGCTATCAAAAGGCGCAAGCCCTGAAATCTACAATCGAGCAAGGCAGGCTGTTCAGATTGTAAAAGATATCGCAGCTAGCGAAAACGTCTCTTATGGCATTCCTTGTGTTTTCCATTCTCAGGGCGAGTGGAACTACTGGAAGATGAATAGCGGCACTGATGACAAACAGCAGTTCATTAATAAGACCCAAAAGGTATTTGATGACTTTGTTTCAGATTTCTGCCAGGGGCAGGATAAGCCGCCAGCATTCTTTACCTACCAGACCGGTGCTAGCTACACCCGAGACGACAAAGACTTGTCAATCGGCATGGCTCAGCTGGAAATGGCAAAAAGCGGCAATGGCGTTTATGGCACATACCCAGCTTACGCAATGCCTGACAAAGGAGGTCACTTAACATCTAACGGTTATCGCTGGGCTGATATGTATCACGCCAAAGTAGCCTTTAAGGTTATGATTCTCGGCGAAGGGTGGGAGCCGCTGCATATCGTCCACGGAGAAGTTAAAGGCAACATCGGTCTTTATGGTTATCATGTGCCTGCGCCACCTCTGCGATTTAATGAGGTTCTTGTGCAAAGGGCTTTAACCATGTACCCTAATAAAGGATTCAGGGCTACTGACGGCGGCGACGCCAATAACCCGTTGCAAATTAAATCCGTTCAGATTGTATCACCGCGCGTTATTAAGGTTGAGTTTGCGCGCAATCCTGTTGGAACGGTAAAACTGTGGTATGCAGATAAAACCGAACACAACGGAAATGGTAATTTACAGGATAGCGACAAATTTAAATCCATGTATAATTACGAATTCATTGAAGGCTCAAGCCAAACAGCAGACGAAAATATTAAGTCTCTTGTTGGAAAGCCTTACCCATTAAACAATTGGGCTTTTGCTCAAGTATTCAAAGTCGAGGTTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
e4448d251eecb7e48af9a10f77ca3017376eb49a5e5137c40fead6db0899ab07
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8148
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50