Genbank accession
YP_010647891.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,91
Protein sequence
MQIWIHDKSMRKVCALNNNVPGMLPYSNSQWHTYLEYSTSTLDFVIPKIVNGKLHDDIKYINDQMYVSFYYDNSYHVFYVAKIVENDFSFQVTCNNTNLELAMEVARPLADSGGPKTIEWCLQNLELLGFAGLEIGVNEISDRTRTLTFESQSGTKLEQLHSLMNQFDAEFIFRTELNRDGTLKKFVIDIYHRPDKNHHGIGKARGDVVLYYQSGLKGVQVTSDKTQLFNAGVFTGADGVNLDSVEFEEKNGLGQVEFYSRKGTSFVFAPISRERYPSTMNPDSADNWTRKDFQTEYKDVESLKAYALRTIKQYAYPLLTYTVDVQSSFLDNYKDINLGDTIKIVDNNFRGGLALEARVSEMIISFDNPANNSVVFTNFKKLDNKPSDALQQRIDEIVSKSLPYHVEIRTTNGTVFKNGVGHSTVKPILKQGDKIVNATYRFVIDGTIKYSGMTYDMVASEINQPTTLTISAWVDNKEVASEEVTFVNVSDGKQGPKGDRGNDGLPGKDGIGLKTTTITYGLSDSDSTQPTDWTSQPPALVKGKYLWTKTVWTYTDSSSETGYQKTYIAKDGNDGTDGLPGKDGVGIKTTTITYAQGISGTVPPTNGWNSQVPNVPAGQYLWTKTIWDYTDNTSETGYSVAKMGEKGPKGDRGERGLQGPKGDQGIPGPKGADGRTQYTHIAYANSPDGNKDFSTSDSNREYIGIYVDFNIDDSNNPSDYSWTLVKGADGAQGVPGKPGADGKTPYFHTAWSYSADGTDGFTTVYPNLNLLEGTKYFSGDWWGRYGSQTDGTYKGLTVMKRTAQWVGISKTFTAPKDGTYTFSAYVKSSGNNVDIIRWININGVQDVEKAPMKSLGNNFDWFRDYFTLNLKAKETASVSYNISGSGSGTLWTAGHKWEEGPKATPWMPSASEVTTADYPSFIGQYTNYTQVDSPNPRDYTWSLIRGNDGKQGPQGIPGPKGADGRTQYTHIAYADTISGSGFSQTDVNKAYIGMYQDFNAEDSKNPQDYRWSKWKGSDGKDGIPGPKGADGRTPYVHFAYADSADGQKGFSLTQTGRKRYLGVLTNFFKEDSTNPSDYTWNDTAGSISVGGRNLLVKTNQGITNWNWQLSDGDKSVEEVKVDGIRAVKLIKGSTAANTGWNFIEYNGLLRELIQPKSKYVLSFDVKPSVDVTFYATLARGDFNEPLTDTVAMPKALANQWNKVSCVLTSKETLPNIAGQVVYLAGMPTTNGNWVIIKNIKLEEGDIPTQWTPAIEDIQDEIDSKADAAMTIEQINALNEMAGIIKAEMEAKASAEVLNNWIKNYQDFVKANETERAAAEKALVSSSQRVSTIAKELGELSDRWNFIDTYMSSSNDGLVIGKNDGSSSIMFNPNGRISMYSAGEEVMYISQGVIHIENGIFSKTIQVGRYREEQYHLNPDMNVIRYVGGF
Physico‐chemical
properties
protein length:1429 AA
molecular weight: 158296,07640 Da
isoelectric point:5,32055
aromaticity:0,10987
hydropathy:-0,55360

Domains

Domains [InterPro]
IPR010572
ENZ
142–381
DC_1151
STR
576–881
YP_010647891.1
1 1429
Architecture
STR
STR 1-1429
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage SW2
[NCBI]
2419640 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus thermophilus
[NCBI]
1308 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_010647891.1 [NCBI]
Genbank nucleotide accession
NC_070717.1 [NCBI]
CDS location
range 16821 -> 21110
strand +
CDS
ATGCAAATTTGGATTCATGATAAAAGCATGCGCAAGGTGTGTGCTTTAAATAACAACGTTCCCGGAATGTTGCCATATTCAAATAGTCAATGGCATACCTACCTTGAATACTCAACCAGCACACTCGATTTTGTGATTCCTAAAATCGTAAACGGGAAACTGCACGATGATATCAAATACATCAATGACCAGATGTATGTGTCGTTTTACTACGATAATTCTTACCACGTTTTCTATGTGGCTAAGATTGTTGAGAATGATTTTAGTTTTCAAGTGACTTGTAATAATACCAACCTTGAATTGGCAATGGAAGTTGCACGACCACTTGCAGACAGTGGCGGTCCCAAAACTATTGAATGGTGTCTTCAAAATCTTGAGTTGCTTGGTTTTGCAGGTCTGGAAATAGGTGTCAATGAAATTTCTGATAGAACAAGAACACTTACTTTTGAATCTCAAAGTGGAACTAAACTAGAGCAACTTCATAGCTTGATGAATCAATTTGATGCAGAATTTATTTTCCGTACCGAATTAAACCGAGATGGTACTTTGAAAAAGTTTGTCATCGACATCTACCATCGTCCTGACAAAAACCATCACGGTATAGGTAAGGCTAGAGGAGACGTCGTTCTCTATTATCAAAGCGGCCTGAAAGGTGTTCAAGTTACAAGCGATAAAACACAACTGTTTAATGCTGGTGTTTTCACTGGTGCAGACGGTGTTAATCTTGATAGCGTTGAGTTTGAAGAAAAAAATGGGTTAGGACAAGTAGAGTTCTATTCTCGAAAGGGCACTAGCTTCGTTTTCGCCCCAATATCAAGAGAACGCTACCCATCTACCATGAATCCAGACAGCGCCGATAACTGGACACGTAAGGATTTTCAAACAGAATACAAGGACGTTGAATCCTTAAAAGCTTACGCCTTGCGTACTATCAAGCAGTATGCTTATCCACTATTGACTTACACAGTAGATGTTCAGTCTAGTTTTCTGGATAACTATAAAGACATCAATCTAGGTGATACCATCAAGATTGTGGATAACAATTTTAGAGGTGGTCTAGCCCTAGAAGCTCGTGTATCTGAAATGATAATCAGCTTTGACAATCCTGCGAATAATTCAGTAGTTTTCACCAACTTTAAAAAGTTGGATAATAAACCATCGGATGCCTTACAACAACGCATCGATGAGATAGTTTCTAAGTCATTGCCATATCATGTTGAGATAAGGACCACAAACGGTACAGTATTTAAAAACGGAGTTGGCCATTCTACTGTTAAACCCATCTTGAAACAAGGCGATAAAATCGTTAATGCAACTTATCGATTTGTAATTGACGGTACTATTAAATACTCAGGTATGACCTATGATATGGTAGCATCAGAGATTAACCAACCAACCACGCTTACTATCTCAGCGTGGGTAGATAACAAAGAAGTAGCTTCAGAAGAAGTTACTTTTGTAAATGTATCAGATGGTAAACAAGGACCTAAGGGCGATAGAGGTAACGACGGACTACCAGGTAAGGACGGTATAGGATTAAAAACCACTACTATTACTTACGGTCTGAGTGATTCTGATTCTACTCAACCTACTGACTGGACTTCTCAACCACCAGCTTTGGTAAAAGGAAAATACCTTTGGACTAAGACGGTCTGGACATATACTGATTCATCTAGTGAGACTGGCTACCAAAAGACTTATATTGCTAAAGATGGAAACGACGGTACAGACGGGCTTCCTGGTAAAGATGGTGTTGGTATCAAAACCACAACCATAACTTACGCACAAGGTATATCTGGGACAGTTCCACCAACAAACGGTTGGAATAGTCAAGTGCCGAATGTGCCAGCAGGTCAGTACTTATGGACTAAAACAATCTGGGATTATACTGATAACACTAGTGAAACTGGATATTCAGTAGCTAAAATGGGTGAGAAAGGACCTAAAGGTGATAGAGGTGAGCGTGGATTACAAGGACCAAAGGGAGACCAAGGAATCCCGGGACCAAAGGGAGCTGACGGAAGAACACAGTACACCCACATAGCTTATGCTAATAGCCCAGATGGTAATAAAGACTTTTCAACGTCTGACTCTAACCGTGAATACATTGGTATATACGTTGATTTCAATATCGATGATTCAAACAATCCGAGCGATTACTCATGGACACTCGTTAAAGGTGCTGACGGTGCTCAAGGGGTACCAGGAAAACCGGGAGCTGACGGGAAGACTCCTTATTTTCACACGGCATGGTCTTACAGCGCAGACGGTACCGATGGTTTCACGACTGTTTACCCTAATTTGAATTTGCTTGAAGGGACTAAATATTTTAGTGGAGATTGGTGGGGTAGATATGGTTCGCAAACTGACGGAACATATAAAGGTCTAACTGTTATGAAAAGAACCGCTCAATGGGTCGGTATATCCAAAACATTTACTGCACCAAAAGACGGAACTTATACTTTCTCAGCTTATGTCAAAAGTTCAGGAAATAATGTAGATATAATTAGATGGATTAATATAAATGGTGTACAAGACGTTGAAAAAGCTCCTATGAAATCGCTAGGAAATAATTTTGATTGGTTTAGAGACTACTTTACGTTAAACTTGAAAGCAAAGGAGACTGCCTCTGTTTCCTATAACATAAGTGGTTCAGGTTCAGGTACTTTATGGACGGCTGGGCATAAATGGGAAGAGGGACCTAAAGCCACTCCTTGGATGCCCTCGGCTAGCGAAGTCACAACTGCTGATTATCCAAGTTTCATCGGACAATATACAAACTATACACAAGTAGATAGTCCTAATCCTCGAGATTACACTTGGAGCCTCATTAGAGGTAACGATGGTAAACAAGGACCGCAAGGAATACCTGGACCAAAGGGTGCTGACGGAAGAACGCAATATACACATATCGCTTACGCTGACACAATTTCAGGTAGTGGCTTTAGTCAAACAGATGTCAATAAAGCCTATATTGGTATGTATCAAGACTTCAATGCCGAAGATAGCAAAAATCCACAAGATTATCGTTGGTCTAAGTGGAAAGGTAGCGATGGTAAAGATGGTATTCCTGGTCCTAAAGGTGCGGACGGACGTACGCCTTACGTCCATTTTGCTTATGCCGATAGTGCCGATGGTCAAAAGGGTTTCAGTTTGACACAAACTGGACGCAAGCGCTATTTAGGTGTGCTTACCAACTTCTTCAAGGAAGACAGTACTAATCCTTCTGATTACACGTGGAACGATACTGCGGGTAGCATCTCTGTAGGTGGTCGAAACTTGCTTGTAAAAACCAATCAAGGTATTACTAATTGGAATTGGCAGCTTTCCGATGGCGACAAGAGCGTTGAAGAAGTGAAAGTTGATGGCATTCGTGCTGTAAAACTAATCAAAGGTTCAACAGCAGCAAACACTGGGTGGAATTTCATTGAATATAATGGCTTGCTGCGTGAACTCATACAGCCGAAGTCGAAGTATGTTCTTTCGTTCGATGTTAAACCTAGCGTTGACGTAACTTTCTATGCAACGCTAGCACGAGGTGACTTTAACGAACCATTGACTGATACTGTCGCTATGCCTAAAGCATTAGCGAATCAGTGGAATAAGGTATCGTGCGTTTTGACAAGCAAAGAAACTTTGCCAAATATTGCAGGGCAAGTTGTATACTTAGCAGGTATGCCAACAACAAACGGTAATTGGGTAATAATTAAAAATATCAAACTTGAAGAAGGTGACATACCTACTCAGTGGACACCTGCGATTGAGGACATACAAGATGAAATTGATTCCAAGGCCGATGCTGCTATGACGATTGAACAGATTAATGCACTTAATGAAATGGCTGGAATCATTAAAGCAGAGATGGAAGCCAAAGCAAGCGCTGAAGTTTTGAATAACTGGATTAAAAATTACCAAGATTTCGTTAAGGCAAACGAGACCGAGAGAGCTGCAGCCGAGAAAGCTTTGGTTAGCTCAAGTCAGCGGGTGTCAACCATCGCTAAAGAGTTGGGTGAACTGTCTGATCGTTGGAATTTCATTGATACCTACATGAGCTCATCAAATGATGGGCTTGTGATTGGAAAGAATGACGGTAGCTCTAGCATTATGTTTAACCCTAACGGTCGCATTTCAATGTACTCGGCAGGGGAGGAGGTCATGTATATTTCGCAAGGTGTAATACACATCGAGAACGGGATCTTCTCGAAAACTATTCAAGTTGGTCGATATCGTGAGGAACAGTACCATCTTAACCCAGACATGAATGTCATTCGTTACGTAGGAGGTTTTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
0532050db1a6e4d95135da2b223fbc1c22a84083283996832b2443888b218ad9
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6949
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Biodiversity of Streptococcus thermophilus Phages in Global Dairy Fermentations Lavelle,K., Martinez,I., Neve,H., Lugli,G., Franz,C., Ventura,M., Bello,F., Sinderen,D. and Mahony,J. 2018 GenBank