Genbank accession
YP_010647189.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MQIWIHDKSMRKVCALNNNIPGMLPYSNSQWHTYLEYSTSTFDFTIPKIVNGKLHEDIKYINDKMYVSFYYDNSYHVFYVSQLVENDFSFQVTCNNTNLELAAETSRPLASVDGAKTLEWYLQNLDLLGFAGLEIGINEVSDRTRTITFESQSGTKLEQLHSLMNQFDAEFVFRTELNRDGTLKRFVIDIYQRPDGNHHGIGKVRGDVILYYQNGLKGVQVSSDKTQLFNAGLFLGKDGLNLGSVVFEEKNELGQVEFYSFKDSPMVYAPLSADKYPSALGGANEIDRWTRRDFQTEYSDVDSLKAYALRTIKQYAYPLMTYTVSVQSSFIENYKDINLGDTVKIIDNNFMDGLALEARVSEMIISFDMPLNNSVVFTNFRKLENKTSDALQQRIDEIVSKSLPYHVEIRTTNGTVFKNRVGRSTVKPILKQGDKIVNATYRFMIDGTIKYSGMTYDMVASDITEPTALTVSAWVDNKEVASEEVTFVNVSDGNDGRTPYVHFAYADSADGQKGFSLTQTGSKRYLGVLTNFIKEDSTNPADYTWNDTAGSISIGGRNLLNGSKGPFKPDSKPTDFDNYVRYENETSVYLEQGKQYIISAKTDGNFTNLHNPGSESDNITLWLFYLWYVVDIVSDSNTGTTGTQFTWNHPTGTYHLRVNTYHKTAIKSVWEVKIEEGTVKTDWTPSVDDVQNEIDSKADDAMTIEQINALNERAGIIKAEMEAKASAEILNNWIKNYQDFVKANETERAAAEKALISSSQRVSIIAKELGELSDRWNFIDSYMTASKDGLVVGKTDNSSSMLFSPSGRISMFSAGHEVMYISQGVIHIENGIFSKTIQVGRYREEQYHLNPDMNVIRYVGGF
Physico‐chemical
properties
protein length:862 AA
molecular weight: 97410,76450 Da
isoelectric point:5,14486
aromaticity:0,11253
hydropathy:-0,41949

Domains

Domains [InterPro]
DC_0002
STR
1–862
IPR010572
ENZ
139–382
YP_010647189.1
1 862
Architecture
STR
STR 1-862
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage P7574
[NCBI]
1971430 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus thermophilus
[NCBI]
1308 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_010647189.1 [NCBI]
Genbank nucleotide accession
NC_070702.1 [NCBI]
CDS location
range 15271 -> 17859
strand +
CDS
ATGCAAATTTGGATTCATGACAAAAGTATGCGAAAAGTGTGTGCGTTAAATAACAACATTCCCGGAATGTTACCTTATTCAAACAGTCAATGGCACACTTATCTTGAATATTCAACAAGCACTTTTGATTTTACGATTCCTAAAATTGTGAATGGGAAACTTCACGAGGATATCAAATATATCAATGACAAAATGTACGTTTCGTTTTACTACGATAATTCATACCACGTTTTCTATGTCTCTCAACTCGTTGAAAATGATTTTAGTTTTCAAGTGACTTGTAATAATACCAACTTGGAACTTGCAGCAGAAACATCACGTCCGTTAGCTAGTGTTGACGGTGCTAAAACTCTGGAGTGGTATCTTCAAAACCTTGACTTATTGGGATTTGCAGGACTAGAAATTGGTATTAATGAAGTTTCTGATAGAACAAGAACTATCACGTTTGAATCTCAAAGTGGCACAAAATTAGAACAGCTTCATAGCTTGATGAATCAATTCGATGCTGAGTTTGTTTTCCGTACCGAATTAAACCGAGATGGCACTTTGAAACGCTTCGTCATTGATATTTACCAACGTCCAGATGGAAATCATCATGGAATTGGTAAGGTCCGAGGTGACGTCATTCTCTATTATCAAAATGGATTGAAAGGTGTCCAAGTATCTAGCGATAAGACTCAACTCTTTAACGCTGGTCTTTTCCTAGGAAAAGACGGACTAAACCTAGGAAGCGTTGTATTTGAGGAAAAGAACGAGTTAGGACAAGTAGAGTTTTATTCTTTTAAAGACAGTCCAATGGTTTACGCACCATTGTCAGCAGATAAATATCCATCTGCATTGGGTGGTGCTAATGAAATAGATAGATGGACACGTAGGGACTTTCAGACAGAATACAGTGATGTTGATTCCCTCAAAGCTTATGCCTTGCGTACTATTAAGCAATACGCTTATCCTCTAATGACCTATACCGTTAGTGTTCAATCTAGTTTCATTGAAAACTACAAGGATATTAATCTAGGTGACACTGTTAAAATCATCGATAACAATTTTATGGATGGTCTTGCCCTTGAAGCTCGAGTTTCTGAAATGATAATAAGTTTCGATATGCCTTTGAATAATTCAGTGGTGTTTACCAATTTTAGAAAACTCGAAAACAAAACCTCAGATGCCTTACAACAACGTATCGATGAGATTGTTTCTAAATCGTTGCCATATCATGTTGAGATAAGGACAACGAATGGTACAGTATTTAAGAACCGTGTTGGTCGTTCTACTGTTAAACCGATTTTGAAACAAGGCGATAAAATCGTTAATGCAACTTATCGATTTATGATTGACGGCACTATTAAATATTCAGGTATGACCTATGACATGGTAGCGTCTGATATTACCGAACCGACAGCCTTGACGGTTTCAGCGTGGGTAGATAACAAAGAAGTAGCTTCAGAAGAAGTTACTTTTGTAAATGTATCAGATGGTAATGACGGACGTACGCCTTATGTACATTTTGCCTATGCCGATAGTGCCGATGGTCAAAAGGGTTTCAGTTTGACACAGACTGGAAGTAAACGCTATTTAGGTGTGCTAACCAACTTCATAAAAGAAGATAGTACTAATCCAGCAGATTACACATGGAATGATACTGCTGGTAGTATTTCCATTGGTGGTCGAAATCTATTAAATGGTTCGAAAGGACCTTTTAAACCTGACAGTAAACCTACAGATTTTGATAATTACGTTCGTTATGAAAATGAAACTTCTGTATATTTAGAACAAGGAAAACAGTATATCATCAGTGCAAAAACAGATGGTAATTTTACTAATTTGCACAACCCAGGAAGCGAAAGTGACAATATCACACTCTGGTTATTTTATTTATGGTATGTGGTTGACATTGTTTCTGATTCAAATACAGGTACTACAGGAACGCAGTTTACTTGGAATCATCCGACAGGTACATATCATCTACGTGTAAATACATATCATAAAACAGCAATCAAATCTGTTTGGGAAGTGAAGATTGAAGAAGGGACAGTCAAAACAGATTGGACACCTTCAGTAGATGACGTACAAAATGAGATTGATTCCAAAGCCGATGATGCTATGACGATTGAACAGATTAATGCGCTTAATGAAAGGGCTGGAATCATTAAAGCAGAGATGGAAGCCAAAGCAAGCGCTGAAATTTTGAATAACTGGATTAAAAATTACCAAGATTTCGTTAAGGCAAACGAGACCGAGAGAGCTGCAGCCGAGAAAGCTTTGATTAGTTCAAGTCAGCGGGTATCAATCATTGCTAAGGAATTAGGTGAACTGTCTGATCGTTGGAATTTCATCGATAGCTACATGACTGCATCAAAAGATGGGCTTGTTGTGGGTAAAACGGATAATTCTAGTTCTATGTTGTTTAGTCCTAGCGGTCGTATCTCAATGTTCTCAGCTGGGCACGAGGTCATGTATATTTCGCAAGGTGTAATACACATCGAGAACGGGATCTTCTCAAAAACTATCCAAGTTGGTCGATATCGTGAGGAACAGTACCATCTTAACCCAGACATGAATGTCATTCGTTATGTAGGAGGTTTTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
9f51fba916d24ec72ddf9cc81615b22a5a902357d6bd9f174b487e135f4e5bf7
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7468
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50