Genbank accession
WGG14609.1 [GenBank]
Protein name
tail fiber
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,77
Protein sequence
MTDKLIRELLIDVKQKGATRTAKSIENVSDALENAAAASELTNEQLSKMPKTLYSIERAADRAAKSLTNMQASRGMLSITKSIDSIGAKLDDLAIAMIEVADKLEAGFDGVSRSVKAMGNDVAAATEKVQDRLYDTNRALGGTSRGFNNTAGAAGRASRAIGNTSGSARGATRDFAAMAKIGGSLPIMYAALASNIFVLQSAFEQLKLGDQLNRLEKFGVIVGTQTGTPVQSLARSLQEATGYAISFEEAMRQASTASAYGFDEEQLSKFGLVARRAAAVLGVDMTDALNRVIKGVSKQEIELLDELGITIRLNDAYADYVKQLNAANTGITYNINSLTTFQKQQAYANAIIAESTKQLGYLDEVLRLTPWELFAANADSALRKIQQAAAKYLGPTIDSINTAFYISQASISAEAARAQEKTNKQIDPTNVGAVALSLAASEEGYNKALDMYRESLNKRNKLKSEFDKRMEQADASTAAAIRLVGEGMPVGLAAGGFEVGGVRIGSSEANKQFVAETAAMGLQVARLDKEVEDSTENLNAWKSAFQAAGAAVSKTNPEFQKKINLQKDMNDPGAVYDFNSAALKSLTEQQKAYNQTKKTSGDLANDFQNIASSTDTAAKTSATFEEVIRNVESLSAGTGKSADEYVKSLNLGFNTLSEMKTASQALSEYVKLTGNETKNQLAVQQKIADVYNQTKDKEKAQEAGRHLELQQLEEREAALRRVLQTNQGNKAVEKEIEKVQLEKLKLTNQDMEAKKKVKDYTDKILGVDREIALLNDRTMTTTQYRLAQLRLELQLEQEKEKLYSKQADGQAKVEQSRRVQAQISRELWEAEKQATASHVSALMDALEVSQTQRNVTGQSQILTERLSILQQQLELSKGNTEEEIKYRNEIYKTSAALEQLRKQRDSQMQQQVGSSVGAVYTPTTGLSGEDKDFADMQNRMSSYDQAISKLSELNSEATAVAQSMGNLTNSMIQFSQGSLDTTSMIASGMQTVASMIQYSTSQQVSAIDQAIAAEQKRDGKSEASKAKLKKLEAEKLKIQQDAAKKQIIIQTAVAVMQAATAVPYPFSIPLMVAAGLAGALALAQASSASSMSSIADSGANTTSYLTLGERQKNVDVSMQASSGELSYLRGDKGIGNANSFVPRAEGGMMYPGVSYQMGEHGTEVVTPMVPMKATPNDELKTSSNSTSGRPIILNISAMDAASFREFASSNSGALRDAVELALNENGASLKTLGNS
Physico‐chemical
properties
protein length:1235 AA
molecular weight: 133200,23840 Da
isoelectric point:5,69819
aromaticity:0,05020
hydropathy:-0,39854

Domains

Domains [InterPro]
Coil
Unmapped
524–544
WGG14609.1
1 1235
Architecture
TAS
STR
TAS
TAS 1-81 | STR 82-1197 | TAS 1198-1233 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage phC11
[NCBI]
3038309 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Salmonella enterica subsp. enterica
[NCBI]
59201 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Salmonella

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WGG14609.1 [NCBI]
Genbank nucleotide accession
OQ680480.1 [NCBI]
CDS location
range 96602 -> 100309
strand +
CDS
ATGACTGATAAGCTAATACGAGAATTACTAATAGACGTTAAACAGAAGGGGGCAACCCGTACTGCAAAGTCTATTGAAAACGTATCTGATGCGTTAGAAAACGCTGCTGCTGCTTCTGAACTGACAAATGAACAGCTAAGTAAAATGCCCAAAACTCTATACTCCATTGAGAGGGCAGCAGACAGAGCAGCAAAAAGTCTTACAAATATGCAAGCTAGTAGGGGCATGCTTAGTATCACTAAATCTATTGATAGTATAGGTGCTAAGCTGGATGATCTAGCTATTGCAATGATTGAAGTAGCAGACAAACTAGAGGCTGGATTTGATGGAGTATCTAGGTCTGTTAAAGCAATGGGTAATGATGTTGCAGCTGCAACAGAGAAAGTTCAAGATAGGTTATACGATACTAATAGAGCTTTAGGCGGCACATCTAGAGGTTTTAATAACACTGCTGGTGCTGCTGGTAGGGCTTCTAGAGCTATTGGTAATACTTCTGGTTCAGCACGTGGTGCTACTCGTGATTTTGCAGCAATGGCTAAGATCGGTGGTAGTCTACCTATTATGTACGCAGCTCTTGCTTCCAACATCTTCGTTTTGCAATCTGCATTCGAACAACTTAAACTAGGTGATCAGTTAAATCGTCTAGAAAAATTTGGTGTTATAGTAGGTACTCAGACAGGTACTCCTGTTCAGTCTCTCGCTAGATCATTACAAGAAGCTACTGGATATGCTATTTCTTTTGAAGAAGCTATGCGTCAGGCATCCACTGCTTCAGCCTACGGATTTGATGAGGAACAACTTAGTAAATTTGGTTTAGTAGCTCGTCGTGCTGCGGCTGTTCTTGGTGTTGATATGACTGACGCACTTAACCGTGTAATTAAGGGTGTATCAAAACAGGAGATCGAACTTCTAGATGAGCTTGGTATCACCATTCGTCTTAATGACGCATATGCTGACTATGTTAAACAGTTAAATGCTGCTAACACAGGCATAACTTATAACATTAATAGTCTAACCACTTTCCAGAAACAACAAGCATACGCTAACGCTATAATTGCTGAATCTACTAAGCAGCTTGGCTACTTAGATGAGGTTCTTAGATTAACTCCTTGGGAGCTATTTGCTGCTAACGCTGACTCTGCCCTAAGAAAAATACAACAAGCTGCTGCTAAGTACTTAGGACCAACGATTGATTCTATTAATACTGCATTCTATATCTCTCAGGCTTCTATATCTGCTGAAGCAGCTAGAGCTCAAGAAAAAACTAATAAACAGATAGATCCTACCAACGTTGGTGCTGTTGCTTTAAGTTTGGCTGCTTCTGAAGAGGGCTATAATAAAGCTCTAGATATGTATAGGGAATCCCTTAATAAGCGTAATAAGCTAAAATCTGAGTTCGATAAACGAATGGAACAAGCAGATGCTAGTACTGCCGCCGCTATTAGGTTGGTGGGTGAGGGAATGCCTGTTGGGTTAGCTGCTGGGGGATTTGAAGTAGGAGGAGTGCGCATAGGTTCTTCCGAAGCTAATAAGCAATTTGTAGCAGAAACTGCAGCTATGGGTTTACAAGTAGCACGCTTAGATAAAGAAGTTGAAGATTCTACTGAAAACCTTAATGCTTGGAAATCAGCCTTCCAAGCTGCAGGTGCTGCGGTTTCCAAGACTAACCCAGAATTCCAGAAGAAGATTAATCTGCAGAAGGATATGAATGACCCTGGTGCGGTTTATGACTTTAACTCTGCTGCTCTAAAGAGTCTGACGGAGCAACAAAAAGCGTACAACCAAACTAAGAAAACGTCTGGTGATTTAGCTAATGACTTTCAAAATATAGCTAGTAGCACAGATACTGCTGCTAAAACTAGTGCAACTTTTGAAGAGGTAATTAGAAATGTAGAATCTCTCTCCGCAGGAACTGGTAAGAGTGCTGATGAGTACGTTAAAAGTCTTAACTTAGGGTTTAATACCCTATCTGAAATGAAAACCGCATCCCAGGCTCTATCTGAGTACGTTAAACTAACTGGTAATGAAACTAAGAATCAGTTAGCAGTTCAACAGAAGATAGCTGACGTATACAACCAAACTAAAGATAAAGAAAAGGCACAGGAAGCCGGTAGGCATTTAGAACTCCAACAGTTAGAAGAGCGAGAAGCTGCTTTACGCCGTGTTCTTCAAACAAACCAGGGGAATAAAGCTGTTGAGAAAGAAATTGAAAAAGTTCAGCTGGAGAAACTTAAACTTACTAACCAGGATATGGAAGCTAAGAAGAAAGTTAAGGATTATACGGATAAAATTCTGGGTGTAGATCGTGAGATAGCTCTTCTGAACGACCGTACTATGACTACTACTCAGTATCGTTTGGCGCAGTTAAGATTAGAGCTGCAGTTAGAGCAGGAAAAAGAGAAGTTATACTCTAAACAAGCAGATGGTCAAGCTAAAGTAGAACAGTCAAGGCGTGTTCAAGCGCAAATAAGTAGAGAACTATGGGAAGCGGAGAAACAAGCTACTGCCTCGCATGTGTCAGCTCTTATGGATGCATTAGAGGTTAGCCAAACACAAAGAAATGTTACTGGCCAATCTCAAATTCTTACGGAAAGATTATCCATTCTGCAGCAACAGCTGGAACTATCTAAGGGTAATACTGAGGAAGAAATCAAATATCGTAATGAGATTTATAAAACTTCGGCGGCCTTAGAGCAGCTTAGAAAGCAGAGAGACAGCCAGATGCAGCAACAGGTAGGATCTTCTGTAGGTGCTGTGTACACTCCTACAACTGGACTATCTGGGGAGGATAAAGATTTTGCTGACATGCAGAATAGGATGTCTTCGTATGACCAAGCAATTTCTAAACTATCTGAATTAAACTCTGAAGCAACTGCTGTAGCCCAAAGCATGGGTAATTTAACTAATTCTATGATTCAATTCTCACAGGGATCACTGGATACTACATCTATGATTGCTTCTGGTATGCAGACTGTAGCCTCTATGATTCAATATAGTACTAGCCAACAAGTTAGTGCGATTGATCAGGCTATTGCAGCAGAACAGAAACGAGATGGTAAATCTGAAGCATCTAAAGCTAAACTGAAAAAGTTAGAAGCTGAAAAGTTAAAAATCCAGCAAGACGCAGCTAAGAAACAAATTATTATCCAGACAGCAGTAGCAGTAATGCAGGCGGCAACAGCTGTTCCATACCCGTTCTCTATTCCTCTGATGGTAGCGGCAGGTTTAGCAGGTGCTCTGGCCCTCGCCCAAGCATCCTCTGCATCGAGTATGTCGAGTATTGCTGATTCGGGAGCAAATACAACTAGTTACTTAACCTTAGGTGAGCGACAGAAGAACGTTGATGTATCTATGCAAGCTAGTTCAGGAGAACTATCCTACTTACGTGGTGATAAGGGTATTGGTAATGCCAATTCATTTGTTCCGCGTGCTGAGGGTGGTATGATGTACCCTGGAGTAAGCTATCAAATGGGTGAGCACGGTACCGAAGTAGTAACTCCTATGGTTCCTATGAAAGCTACACCTAATGATGAGCTAAAAACCTCATCTAACTCAACTTCAGGAAGACCTATCATCCTGAATATTAGTGCTATGGATGCTGCAAGTTTTAGAGAGTTTGCTTCTAGTAATAGTGGTGCTCTAAGAGACGCAGTAGAATTAGCTCTGAATGAGAACGGTGCTAGTCTGAAAACATTAGGAAATTCTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
6f483967867e411aa5deac454c10ada962d1289bb719dc57535d05ca74ae2ac4
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6337
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Comparative analysis of effectiveness for phage cocktail development against multiple Salmonella serovars and its biofilm control activity Ribeiro,J.M., Pereira,G.N., Durli,I., Teixeira,G.M., Bertozzi,M.M., Verri,W.A., Kobayashi,R.K.T. and Nakazato,G. — — GenBank