Genbank accession
WGH50156.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MSDDHEIINYETDDIIEFTGVLHFNESQAQLVKVKEMAQLGNYLIYRRHNGDSACLTIMDFTHNPLAGTREISCEDGALDLLNNVVPAIKTTSPQSFQYYWNIVMRDTGFTLGANYLSNQTRTLNYDNETTAVERLRSIISDFGGAKFTIDFDFENMQLKTKTMNIIEDMGDEKDITLRVGRDVDSIVTTGNIYELTTAIRALGGTPEGSDNPITLSGFSWIDPDGRFKLENGVMIDTQEAPKWSRLLSTTGGLFTRAVTYDTLDKGKMASLAVSDLKKKSQPAFNYEVNVVNVPSDLNVGDRIDIVDEKDELYLSGKVLTVDRCTADSTVVITLGEFRIKYSGLDPQLLQIASDFSKQFDNSVPSQVILTPSKQFFVNGEGNITITAKVMKGKDDITNNFTSFVWRRYDASNTLDTTWTGTGKTITVTAGQSTVYTYYCSVDY
Physico‐chemical
properties
protein length:444 AA
molecular weight: 49536,93240 Da
isoelectric point:4,65167
aromaticity:0,09459
hydropathy:-0,30428

Domains

Domains [InterPro]
IPR010572
ENZ
90–339
WGH50156.1
1 444
Architecture
ENZ
ENZ 90-339 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Enterococcus phage Phi_Eg_SY1
[NCBI]
3022905 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Enterococcus gallinarum
[NCBI]
1353 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WGH50156.1 [NCBI]
Genbank nucleotide accession
OQ623132.1 [NCBI]
CDS location
range 20411 -> 21745
strand -
CDS
ATGTCAGATGACCATGAAATAATCAACTATGAAACGGATGACATTATTGAGTTCACTGGTGTATTACACTTTAATGAATCACAAGCACAACTTGTAAAAGTAAAGGAGATGGCGCAGTTAGGTAATTATCTAATTTATAGACGACATAACGGAGATAGCGCCTGTCTTACTATCATGGACTTCACACACAATCCATTGGCTGGAACACGTGAGATAAGTTGTGAAGATGGTGCGCTTGACTTACTTAATAATGTGGTACCTGCTATTAAAACCACGTCACCTCAATCGTTTCAATACTACTGGAACATTGTCATGAGAGACACAGGTTTTACATTAGGTGCAAACTACCTTAGTAATCAGACACGCACTTTAAACTATGATAATGAGACAACGGCAGTAGAGCGTTTACGCAGTATCATATCAGACTTTGGCGGTGCTAAGTTCACCATTGACTTTGATTTTGAGAACATGCAGTTAAAAACGAAAACAATGAACATTATAGAGGATATGGGTGATGAAAAGGATATCACGCTGCGTGTAGGACGTGACGTTGATTCAATTGTAACTACAGGTAACATCTATGAGTTAACAACAGCAATACGTGCGTTAGGTGGGACACCAGAGGGGTCAGATAACCCAATTACCTTGAGTGGGTTTTCATGGATTGACCCTGACGGACGTTTCAAACTAGAAAATGGTGTCATGATTGACACACAGGAAGCGCCTAAGTGGTCTAGACTATTATCAACAACAGGCGGATTGTTTACACGTGCTGTGACATATGATACATTAGATAAAGGTAAAATGGCTTCACTGGCAGTGAGTGACTTGAAAAAGAAAAGTCAACCTGCTTTTAATTATGAAGTAAACGTAGTCAATGTACCTTCTGATTTAAATGTAGGCGATAGGATTGATATTGTTGATGAGAAAGACGAGTTGTATCTATCTGGTAAGGTTTTAACAGTAGACAGATGTACAGCAGATTCAACTGTAGTGATTACATTAGGTGAGTTCAGAATAAAATACTCTGGACTAGATCCCCAATTACTACAAATTGCCTCAGACTTCTCAAAGCAGTTTGACAACAGTGTTCCTTCTCAAGTTATACTCACACCATCCAAGCAGTTCTTTGTTAATGGAGAAGGTAATATAACCATTACTGCTAAGGTAATGAAGGGTAAGGATGATATAACAAATAATTTTACATCGTTTGTATGGCGTAGATATGACGCTTCAAATACATTAGACACAACATGGACAGGGACAGGAAAAACGATTACAGTGACAGCAGGTCAATCAACTGTGTATACGTATTACTGCTCTGTAGACTACTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
65b918b57d77f5987a1aae86b0c7da157deb6b5849a8f5d4259187c15f465338
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,9035
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50