Genbank accession
AAC39297.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,91
Protein sequence
MQIWIHDRSMRRVCALNNEIPGMLPYSNSQWHPYLEYSTSTFDFTIPKIVNGKLHDDIKYINDQMYVSFYYDNSYHVFYVSQLVENDFSFQATCNNTNLELAAEISRPLASVDGPKTIEWYLQNLDLLGFAGLEIGFNEIPDRTRTITFESQNGTKLEQLHSLMNQFDAEFVFRTDLNRDGTLKKFVIDIYQRPDENHHGIGKVRGDVTLYYQTGLKGVQISSDKTQLFNAGYFVGKDGLTLGSVVFEEKNELGQVEFYSFKDSPMVYAPLSADKYPSAMGGANEIDRWTRKDFQTEYADINSLKAYALRTIKQYAYPLMTYTVSVQSSFLENYNDINLGDTVKIINNNFIDGLALEARVSEMVISFDMPQNNSVVFTNFRKLDNKPSSELQQRIDEIVSKSLPYHVEIRTTNGTAFKNGVGRSTVKPVLKQGDKIVDATYRFVIDGTIKYSGMTYDMVASDITEPTTLTVAAWVDDKEVASEEVTFFNVSDGKHGEKGDIGPKGADGRTQYTHIAYANSADGKKDFSTSDSNREYIGIYVDFEESDSVDPSKYNWTLVKGADGTQGVPGPKGADGQTPYFHTAWSYSADGKDRFTTIYPNLNLLDGTRDFSGNWVGALEGGSDGTYKGLIVQKRIYQWWSLYKEFTIPKDGIYTFSAYVKSSGDNANVCSYLAINGRDASYLMPRWVLGNNFDWFRESFSVPLKKGDIVYANYYMGGNAKDSALWTAGHKWEEGSVATPWMPSTNEVKTSDYPSYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGERGLTGPQGPKGDRGERGLQGPRGDQGIPGPKGEDGKTHYTHIAYADTVSGSGFSQTDVNKPYIGMYQDFNEVDSNNPQDYRWTKWKGSDGRDGIPGKAGADGRTPYVHFAYADSADGRDGFSLTQTGSKRYIGVLTNFFKEDSTNPADYTWNDTAGSISVGGRNLLVKTNQGITNWDWTMSNGDKSVEEVNIDGIRAVKLTKGTKTANTGGNYIQYQGLLRKLIRPNTQYTLSFDVKPSVDVSFSATLIRGNYQAELTDTVLMNKALANQWTKVSCVLTSKETLSGDLNQVVYLAGMPTTNGNWLIIKNIKLEEGNIPTPWTPAIEDIQEEIDSKADDVLTQAQLNKLNEINSIVKAELAAKASLDTLDQWKQAYQDFVNANNANRAQAEKDLADASARVTKLENDLNDMSERWNFIDSYMTASNEGLVVGKTDNSSSMLFSPNGRISMFSAGHEVMYISQGVIHIENGIFSKTIQIGRYREEQDIINPDRNVIRYVGGS
Physico‐chemical
properties
protein length:1291 AA
molecular weight: 144337,58010 Da
isoelectric point:5,05130
aromaticity:0,11309
hydropathy:-0,55352

Domains

Domains [InterPro]
IPR008983
RBD
644–718
AAC39297.1
1 1291
Architecture
STR
STR 1-1291
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage Sfi19
[NCBI]
2905685 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus thermophilus
[NCBI]
1308 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AAC39297.1 [NCBI]
Genbank nucleotide accession
AF115102.1 [NCBI]
CDS location
range 16396 -> 20271
strand +
CDS
ATGCAGATTTGGATTCATGACAGAAGCATGCGCAGAGTGTGTGCATTGAATAATGAAATCCCCGGAATGTTACCTTATTCGAATAGTCAATGGCACCCTTACCTTGAATACTCAACAAGTACATTTGATTTCACAATTCCTAAAATCGTAAATGGTAAGTTACACGATGATATCAAATATATCAATGACCAGATGTACGTGTCGTTTTACTACGACAATTCCTACCACGTTTTTTATGTTTCTCAACTCGTTGAAAATGATTTTAGTTTTCAAGCGACTTGTAATAATACTAACTTGGAACTAGCAGCAGAAATCTCTCGTCCGTTAGCCAGTGTTGATGGCCCTAAAACCATTGAGTGGTATCTTCAAAACCTTGATTTACTTGGTTTTGCTGGTCTTGAAATTGGTTTCAATGAGATTCCTGATAGAACAAGAACTATCACGTTTGAATCACAAAATGGCACTAAACTAGAACAGCTTCATAGCTTGATGAACCAGTTTGATGCTGAGTTTGTTTTTCGTACCGATTTAAACCGAGATGGCACTTTGAAAAAGTTTGTCATTGACATCTACCAACGTCCTGACGAAAACCATCACGGTATTGGAAAGGTTCGAGGAGATGTAACTCTTTACTATCAAACTGGATTGAAAGGTGTTCAAATATCTAGTGATAAGACTCAACTATTTAACGCTGGGTATTTCGTTGGAAAAGACGGACTAACACTAGGAAGCGTTGTGTTTGAGGAAAAGAATGAGTTAGGACAAGTAGAGTTCTACTCATTTAAAGACAGTCCAATGGTTTACGCACCTTTATCAGCAGATAAATATCCATCTGCAATGGGTGGTGCTAATGAAATAGATAGATGGACACGCAAGGACTTTCAAACAGAGTATGCAGACATCAATTCCCTCAAGGCTTATGCCTTGCGTACTATTAAGCAATATGCTTATCCTCTAATGACATATACCGTAAGTGTTCAATCTAGTTTCTTGGAAAACTACAATGACATCAATCTAGGTGATACGGTTAAGATTATTAATAATAATTTTATAGATGGTCTAGCACTTGAAGCTCGAGTTTCTGAAATGGTTATCAGCTTCGATATGCCACAAAATAATTCGGTCGTTTTTACTAATTTCAGAAAGTTGGATAATAAACCGTCTAGCGAATTACAACAACGTATCGATGAGATTGTTTCTAAGTCACTGCCATATCATGTTGAGATAAGGACAACGAACGGTACAGCGTTTAAAAATGGTGTTGGTCGTTCTACTGTTAAGCCAGTTTTGAAACAAGGCGATAAAATTGTTGATGCAACCTATCGATTTGTGATCGACGGTACTATTAAATATTCTGGTATGACTTACGATATGGTAGCGTCGGATATTACAGAACCAACAACATTGACGGTTGCTGCTTGGGTTGATGATAAAGAAGTAGCTTCAGAAGAAGTTACTTTTTTTAATGTATCAGACGGGAAACATGGCGAAAAAGGAGACATCGGTCCTAAGGGAGCTGACGGAAGAACACAGTACACCCACATAGCTTATGCAAATAGTGCTGACGGTAAGAAAGATTTTTCAACATCTGACTCAAATCGTGAATACATCGGTATATACGTTGATTTTGAAGAATCTGACAGCGTAGACCCATCAAAATATAACTGGACGCTCGTAAAGGGTGCTGACGGTACTCAAGGCGTACCTGGTCCTAAAGGTGCTGACGGACAAACGCCATATTTCCATACAGCATGGTCTTACAGTGCAGATGGTAAGGATAGATTCACTACAATTTATCCTAATTTGAATTTGCTGGATGGTACAAGAGATTTTAGTGGTAATTGGGTTGGAGCATTAGAAGGTGGATCTGACGGAACTTATAAAGGTCTAATTGTTCAAAAACGAATATATCAATGGTGGAGTTTATATAAAGAATTTACTATCCCTAAAGATGGAATATATACTTTCTCAGCATACGTTAAAAGTTCAGGAGACAATGCGAATGTATGTTCATATTTAGCTATAAATGGTAGAGACGCTAGTTACCTCATGCCTAGATGGGTCTTAGGAAATAATTTCGACTGGTTTAGAGAAAGTTTCTCTGTACCTTTGAAAAAAGGAGACATTGTATATGCTAATTATTATATGGGAGGTAATGCCAAGGATTCAGCTTTATGGACTGCCGGTCATAAATGGGAAGAAGGTTCAGTAGCCACCCCTTGGATGCCTTCAACAAATGAAGTCAAAACTTCTGATTATCCAAGCTATATCGGTCAATACACAAACTATATGGAAGTAGATAGTCCTAATCCTCAAGACTACACATGGAGTTTGATTAGAGGAAACGATGGCAAGCAAGGTCCACAAGGTGAACGAGGTTTAACCGGTCCTCAAGGTCCCAAAGGTGATAGAGGCGAGCGTGGGTTACAAGGTCCAAGAGGTGACCAAGGAATACCGGGACCAAAGGGTGAAGACGGTAAAACACATTACACCCATATTGCTTATGCCGACACTGTTTCTGGTAGTGGTTTTAGTCAAACAGATGTCAATAAACCATACATTGGAATGTACCAAGATTTCAATGAAGTTGATAGTAATAACCCTCAAGACTATCGTTGGACGAAGTGGAAAGGTAGTGATGGTCGTGATGGCATTCCTGGAAAAGCTGGAGCAGACGGACGGACTCCTTACGTACACTTTGCTTATGCAGACAGTGCTGATGGACGAGATGGTTTTAGTCTTACTCAGACTGGAAGTAAACGATATATAGGTGTACTTACCAACTTCTTCAAAGAAGACAGCACAAATCCAGCAGATTATACATGGAATGATACTGCTGGAAGTATTTCGGTTGGCGGTCGGAACTTACTTGTAAAAACCAATCAAGGTATTACTAATTGGGATTGGACGATGTCGAATGGTGACAAGAGCGTTGAAGAAGTCAATATCGATGGTATTCGTGCTGTTAAATTAACCAAAGGTACAAAAACAGCAAATACTGGTGGGAACTACATTCAATATCAAGGTTTGTTGCGTAAACTCATACGACCAAACACACAGTACACTCTTTCGTTTGATGTAAAACCAAGTGTTGATGTAAGTTTTTCAGCAACGCTAATAAGAGGCAACTACCAAGCTGAATTGACTGATACTGTCCTTATGAATAAAGCTTTGGCAAATCAATGGACTAAAGTATCATGTGTTCTGACAAGTAAAGAAACGTTATCAGGTGATTTAAATCAAGTTGTCTACTTGGCAGGTATGCCAACAACAAACGGTAATTGGTTAATAATCAAGAATATCAAGCTAGAAGAAGGTAATATACCTACTCCATGGACACCAGCCATCGAGGACATACAAGAAGAGATTGATTCCAAAGCCGATGATGTCCTTACGCAAGCACAACTCAACAAGCTGAATGAAATAAATTCTATTGTTAAAGCTGAACTTGCTGCTAAAGCCTCACTTGATACACTTGACCAATGGAAGCAAGCCTATCAAGATTTCGTTAACGCAAACAATGCCAATCGTGCACAAGCTGAAAAAGATTTAGCTGATGCAAGTGCTCGTGTAACCAAACTAGAAAACGACTTAAATGATATGTCAGAACGTTGGAATTTCATCGATAGCTACATGACTGCATCAAACGAGGGTCTTGTTGTTGGTAAAACTGATAATTCTAGCTCTATGCTGTTTAGTCCAAACGGTCGTATCTCAATGTTCTCAGCTGGACATGAGGTAATGTATATCTCACAAGGTGTCATTCACATCGAGAATGGTATTTTCTCGAAAACTATTCAAATTGGACGTTATCGTGAAGAACAAGATATTATTAACCCTGACAGAAATGTCATTCGTTATGTAGGAGGTAGTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
f2be88f3e9eac4d5867de17bd0a0dd62ab0959b54193ee9f7f6b1ca73ccb60c6
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7231
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50