Genbank accession
QBX19964.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,88
TF
Evidence RBPdetect2
Probability 0,82
Protein sequence
MSFVDYCNLFGILKNGAITIGTNETTDQKRTIEWTGQDTNLKRLLSIANNFDAEIEFVTHLKNDSSLKSFVMNVYKKNDATNQGVGRRRDDIILQYGKNIESVRRKIDKTGIYNAIRPSGKITTTTTTTTAKQGSVQTGSVLWSGGNLTYAGHVMQSSVVNTILSLCSKYKLLPSGVFSQLYLESFWGDTPVGRADNNWGGITWTGATTRPSGINVSQGQPRAEGGHYNHYASVDDYLKDYTYLLAEQGIYAVKGKLTIDEYTRGLFRVGGATYDYAAAGYDHYAPLMRDIRAGINRNNNGAMDNVDNQFKNGGSTSQNTTQIAAKTKAVLAEATGLKGQRVGSGQCYALAAWYAMKLDGPGLNGGVTSFRGLIGAGAAAAQIGTDYNWGQFGWKVVQPNKVADLITGSIVNIRANAGSPVFTGAWGHTVVVKSLSGDTLTVLEQNYNNVQTVQEHTYSASAYLSVVQTVCYPPEIVKGRRVEGTAQAEQPQPETTTTSEEKEVLINPSLYREWKNESGQVEFYVKNSMLYAPLSKSLYPSAFTGIETDDNWIRKDLDVDTESEEKLISVALADLRKHCYPAVTYEVSGFIGDLDIGDTIKINDPEYTPSLILEARVSEQHISFTEPNQNKTVFDNYRALESKVSQGLIDRMNELAEAAKPYDLRLMTDNGNVFLNGEGRTILTAELWKGNKKFDASYQFKRDGQLVGAGLQLAVDAKDVPADKPLIITVEAYLNNELIASKQITFTNSLGEQGPAGRGIVSTEDYYLASPNRTGVTSATSGWTKTPQEITETNKYHWYYHVDVYSDGTRKETTPAIIGVYGDKGSDGKQGEKGNDGPMGPQGPAGALDEKQLQDINNKIDGKADQNLTIEQINKLAELQSIANAELQAKASIDALASLQKQVQSAIAAMNASQKLSEQDLITASQRAIKATNDILDLKEQWNFIDNYMSASEEGLIIGSKDGTSSVRVAKDRIAFYSAGAEVASITGGMLKIDNGMFVATLQVGHFREEMYKVDGVDKHINVTRYYETIVG
Physico‐chemical
properties
protein length:1032 AA
molecular weight: 112815,73860 Da
isoelectric point:5,47475
aromaticity:0,08527
hydropathy:-0,41492

Domains

Domains [InterPro]
DC_0558
ATT
1–282
IPR002901
ENZ
147–282
IPR002901
ENZ
164–275
G3DSA:1.10.530.10
RBD
166–270
G3DSA:2.10.70.40
Unmapped
189–232
QBX19964.1
1 1032
Architecture
ATT
STR
ATT 1-282 | STR 283-1032
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage Javan503
[NCBI]
2548217 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus pyogenes MGAS10750
[NCBI]
370554 Bacillota > Bacilli > Lactobacillales > Streptococcaceae > Streptococcus > Streptococcus pyogenes

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QBX19964.1 [NCBI]
Genbank nucleotide accession
MK448783.1 [NCBI]
CDS location
range 26423 -> 29521
strand +
CDS
ATGTCTTTTGTCGATTATTGTAATTTGTTTGGCATCCTTAAAAACGGTGCTATTACCATTGGCACTAATGAGACAACCGACCAAAAACGCACAATCGAATGGACTGGTCAAGATACCAATCTTAAACGCTTGTTATCTATCGCCAATAATTTTGATGCGGAAATAGAATTTGTAACGCATCTTAAAAACGATTCTAGTCTTAAATCGTTTGTCATGAATGTCTACAAGAAGAACGACGCTACTAATCAAGGTGTTGGTCGTAGACGAGATGATATTATTTTGCAATATGGCAAAAATATCGAAAGTGTCAGACGTAAGATTGATAAAACAGGCATTTACAATGCTATAAGACCAAGCGGTAAAATAACAACGACTACAACCACAACGACTGCTAAACAAGGCTCTGTGCAAACAGGGTCTGTTTTGTGGTCTGGCGGTAACTTGACTTATGCAGGCCATGTGATGCAATCATCTGTTGTTAACACTATTTTAAGCCTATGTAGCAAATACAAGCTGTTACCGTCCGGTGTTTTTAGCCAGCTGTACCTTGAATCATTTTGGGGAGATACCCCAGTCGGAAGAGCCGATAATAACTGGGGTGGCATCACTTGGACTGGCGCAACAACTAGACCAAGCGGTATCAATGTCTCACAAGGGCAACCTCGAGCCGAGGGTGGTCATTATAACCATTACGCAAGCGTTGATGACTACTTAAAAGACTATACTTACCTCTTGGCAGAGCAAGGTATTTATGCCGTAAAAGGTAAGCTAACCATTGATGAGTACACAAGAGGTCTGTTTAGGGTCGGTGGCGCAACATATGATTATGCTGCAGCTGGATATGATCATTATGCACCTTTGATGCGAGACATCAGAGCAGGTATTAACCGTAATAATAACGGCGCTATGGATAACGTCGATAACCAATTTAAAAATGGCGGCTCGACTAGTCAAAATACTACTCAGATAGCTGCTAAAACAAAAGCGGTACTTGCGGAAGCAACCGGACTGAAAGGTCAACGAGTAGGCTCTGGTCAGTGCTATGCGTTAGCAGCTTGGTACGCAATGAAATTAGATGGGCCAGGTCTAAATGGTGGTGTAACTAGTTTTAGAGGACTTATTGGTGCTGGTGCAGCAGCTGCTCAGATTGGTACGGACTACAACTGGGGTCAGTTTGGCTGGAAAGTTGTACAACCGAATAAAGTCGCAGACTTAATCACAGGCTCGATTGTTAACATCAGAGCAAACGCTGGCAGTCCTGTTTTTACAGGCGCTTGGGGGCATACTGTTGTTGTTAAATCTCTATCTGGAGATACGCTCACAGTCTTAGAGCAAAACTATAACAACGTGCAAACAGTCCAAGAGCATACATATAGCGCTAGCGCTTATTTATCAGTTGTACAGACAGTCTGTTACCCGCCAGAAATCGTTAAAGGGAGACGTGTCGAAGGCACTGCACAAGCAGAACAGCCACAACCAGAAACAACCACGACATCTGAAGAAAAAGAGGTTTTAATTAACCCATCGCTTTACCGTGAGTGGAAAAACGAATCAGGACAAGTCGAATTTTACGTTAAAAACAGCATGCTCTATGCACCTTTGTCTAAATCGCTTTATCCATCAGCGTTTACAGGAATTGAAACTGACGATAATTGGATACGAAAAGACTTAGATGTTGATACAGAAAGTGAAGAAAAGCTTATCTCTGTTGCTCTCGCAGATCTGAGAAAACATTGTTATCCAGCGGTGACCTATGAAGTATCTGGTTTTATTGGTGATTTAGATATTGGTGACACTATCAAAATCAATGATCCAGAATACACGCCAAGCCTAATTTTAGAAGCAAGGGTTAGCGAGCAACACATCTCGTTTACAGAGCCTAATCAAAATAAGACCGTCTTTGATAATTACAGAGCTTTAGAGAGCAAAGTCTCACAAGGTTTAATTGACCGCATGAACGAACTAGCAGAAGCTGCTAAACCTTACGACTTGCGGTTAATGACAGATAACGGAAATGTGTTTTTAAACGGCGAAGGTCGTACGATTTTAACCGCTGAACTTTGGAAAGGTAACAAAAAGTTTGATGCAAGCTATCAATTTAAACGTGATGGTCAATTAGTCGGCGCTGGATTGCAGTTGGCAGTTGACGCTAAGGATGTACCAGCTGATAAACCTCTAATCATTACTGTTGAGGCTTATTTAAATAATGAGCTGATTGCAAGTAAACAGATTACGTTTACTAACTCGCTTGGAGAACAAGGACCAGCTGGACGTGGGATTGTCTCTACAGAGGACTATTACTTAGCGTCACCAAATCGTACAGGTGTCACATCTGCAACATCTGGTTGGACTAAGACGCCTCAGGAAATTACTGAGACTAATAAATATCATTGGTATTATCACGTTGATGTTTATTCAGATGGCACTCGAAAAGAGACTACACCGGCTATTATTGGTGTTTACGGCGATAAAGGTTCAGATGGCAAGCAAGGAGAAAAAGGGAACGATGGTCCAATGGGTCCGCAAGGTCCTGCCGGAGCGCTAGATGAAAAGCAACTACAAGACATCAATAATAAAATTGATGGCAAAGCAGACCAGAATTTGACCATCGAGCAAATCAATAAATTAGCCGAGTTACAATCTATTGCCAACGCTGAGTTACAAGCAAAGGCTAGCATCGACGCTTTAGCTAGCTTACAAAAGCAAGTACAGTCTGCAATAGCGGCAATGAATGCTAGCCAAAAGTTATCAGAGCAAGACCTTATTACAGCTAGTCAACGTGCTATCAAAGCAACCAACGACATCTTAGACTTAAAAGAGCAATGGAATTTTATTGACAATTATATGTCAGCGTCTGAAGAGGGACTTATTATCGGCTCTAAAGACGGTACAAGTTCCGTGCGTGTTGCCAAAGACCGTATTGCCTTTTACTCAGCTGGCGCAGAAGTCGCTTCGATTACTGGTGGTATGCTCAAAATTGATAATGGTATGTTTGTGGCTACTTTGCAAGTTGGACATTTTCGCGAGGAGATGTACAAAGTTGATGGGGTAGATAAACACATAAATGTTACAAGATATTACGAAACGATTGTGGGGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
35018fae16d950f0f5fcd1305bbe7bde17819c4330216bb8ad4497bfcf6f9122
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7774
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50