Genbank accession
XGU08871.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,69
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MTQFEQAVDQVVEDSERLHKVVNGTASETVVTEDGSTIPTVRKALLDNLFFKTPPMPWIAGTQTTVFNQLYAFNGTNGVQWWYAPTATASAPVVLPQNPANSVNWRLYNDAAAMASIYAPINSPILTGNPQAPTPAANSNSTTIATTAFVTTAIASALSSISGGSVTFANLSVTGATTLNSLVVGGTIDLNGPVNADNSTGRFQNLILTKELSSLTFVFTDADNPTFFKTRLDPYAIQTHSIQTDIIVNGTVAEDDTTMSLTGVGNNVFDYVYIRGNASKDPTAPRLKVSGTTEVENLNITGNVTGITFSVNGLDISPNSVTTADGVTVGGDLQVSGVTNLGNATIGGLDITSDLTVNGNTTLEDFSAGNGNITGPFTVGGLTSLNGGFTTGTADGTIGGKLSVTGTSEFIEDLSVLADVTVQDNLTVNGDVNLNNATGTTTVNNLVIQGTVTGLSVDLTGQNINVGSLSSTGAVTANSLTVQDSAILTKASVEFLTLIAEDIDSSTAAWSPSGDSNIYNVTVDADLTIGAWPEPTDAFSAVIYLTQDGTGGHTVTLDPNYLVLNSETINETAGSVTILQLTYNGVEGGVIDTVIVRRP
Physico‐chemical
properties
protein length:599 AA
molecular weight: 61984,70350 Da
isoelectric point:4,05003
aromaticity:0,06177
hydropathy:0,06945

Domains

Domains [InterPro]
DC_0194
STR
1–596
IPR058969
ATT
2–108
XGU08871.1
1 599
Architecture
ATT
STR
ATT 1-108 | STR 109-596 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage vB_Sen_SG_WM_SEW_6S
[NCBI]
3234148 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Salmonella enteritidis
[NCBI]
149539 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XGU08871.1 [NCBI]
Genbank nucleotide accession
PQ002171.1 [NCBI]
CDS location
range 88597 -> 90396
strand +
CDS
ATGACTCAATTTGAACAGGCTGTCGATCAGGTTGTTGAAGACTCTGAACGCCTCCACAAGGTTGTCAACGGAACGGCATCCGAAACTGTTGTTACTGAAGATGGTAGCACCATTCCAACGGTTCGTAAAGCTCTTCTTGACAACCTGTTCTTTAAAACACCGCCTATGCCGTGGATCGCGGGTACTCAGACCACAGTATTCAACCAGCTTTATGCTTTTAATGGCACAAATGGGGTTCAATGGTGGTATGCACCAACCGCAACAGCAAGCGCCCCTGTCGTTTTACCACAAAACCCAGCTAACAGTGTTAACTGGAGATTGTACAACGACGCAGCGGCGATGGCATCTATCTATGCACCAATCAACAGCCCGATCCTGACAGGAAACCCACAGGCTCCAACCCCTGCGGCTAACAGCAACAGTACAACAATTGCCACAACTGCCTTTGTTACAACCGCTATTGCAAGCGCCTTGTCAAGCATCTCAGGTGGTAGTGTTACCTTTGCAAACCTGTCTGTAACAGGTGCTACAACACTCAATAGTTTGGTGGTTGGTGGGACAATCGACCTTAATGGCCCTGTAAACGCAGATAACTCAACAGGTCGTTTCCAGAACCTGATCCTGACAAAAGAGTTGTCAAGTCTTACCTTCGTATTTACAGACGCAGATAATCCGACATTCTTTAAGACGCGCCTTGACCCATATGCGATCCAAACCCACAGCATCCAGACGGACATTATTGTCAACGGAACAGTGGCTGAAGATGATACAACCATGTCTCTGACAGGTGTGGGTAATAACGTCTTCGATTATGTGTATATCCGTGGTAACGCAAGTAAAGATCCTACAGCACCGAGATTAAAGGTCTCAGGTACAACTGAGGTAGAAAACCTGAATATTACAGGTAACGTAACAGGTATCACCTTCAGTGTCAACGGACTTGATATTTCACCAAACTCTGTTACAACCGCAGACGGTGTAACTGTAGGTGGTGACTTACAGGTCAGTGGTGTTACCAACCTTGGAAACGCAACAATCGGTGGCCTTGATATTACAAGTGATCTGACCGTAAACGGTAATACAACACTCGAAGATTTCTCTGCGGGTAACGGAAACATCACTGGTCCATTCACAGTGGGTGGGTTAACCAGTCTCAATGGTGGATTTACAACCGGAACAGCAGATGGTACAATTGGCGGAAAACTCTCTGTTACAGGAACGTCTGAGTTTATTGAGGATCTTAGCGTACTTGCCGATGTTACAGTCCAGGATAACCTGACCGTAAACGGTGATGTCAACCTTAACAACGCAACAGGAACAACGACAGTTAACAACCTTGTTATTCAGGGTACGGTTACAGGTCTTTCTGTTGACTTGACAGGTCAGAACATCAACGTAGGATCTCTTTCCTCTACTGGTGCAGTAACTGCCAATAGCCTTACGGTACAGGATTCGGCAATCTTAACCAAGGCAAGTGTTGAATTCCTGACACTTATTGCTGAGGATATTGATAGCTCTACAGCGGCATGGTCCCCAAGTGGAGATTCCAACATCTACAACGTAACAGTGGATGCGGATTTAACAATTGGTGCTTGGCCTGAACCGACAGATGCTTTTTCTGCTGTGATTTACCTGACTCAAGATGGTACTGGCGGTCACACTGTGACTTTAGATCCTAACTACTTGGTTTTAAACAGCGAAACAATTAACGAGACGGCTGGTTCGGTGACTATTCTTCAATTAACCTATAATGGTGTTGAAGGCGGTGTTATCGACACTGTAATTGTTCGTCGTCCGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
0275b117dc42359a6f6e3f678eea6e95d7bfbb14b51cd5d837958efddc6c42c8
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6354
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50