Genbank accession
AIU44396.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,57
TF
Evidence RBPdetect2
Probability 0,86
Protein sequence
MLITIHNANLEKVAYIDNDKQDTLNYYDDKFSQYLNTANSTFEFTVYKRGIKSDTVKEKAYLTLTERSFVSFKYNGKSYLFNVMTTDETDIEIRCYCENLNLELLNEYAGPYKAATQMSFVDYCNLFGILKNGAITIGTNETTDQKRTIEWTGQDTNLKRLLSIANNFDAEIEFVTHLKNDSSLKSFVMNVYKKNDATNQGVGRRRDDIILQYGKNIESVRRKINKTGIYNAIRPSGKITTTTTTTTAKQGSVQTGSVLWSGGNLTYAGHVMQSSVVNTILSLCSKYKLLPSGVFSQLYLESFWGDTPVGRADNNWGGITWTGATTRPSGINVSQGQSRAEGGYYNHYASVDDYLKDYAYLLAEQGIYAVKGKLTIDEYTRGLFRVGGATYDYAAAGYDHYAPLMRDIRAGINRNNNGAMDNVDNQFKNGGSTSQNTTQIAAKTKAVLAEANGLKGQRVGSGQCYALAAWYAMKLDGPGLNGGVTSFRGLIGAGAAAAQIGTDYNWGQFGWKVVQPNKVADLITGSIVNIRANAGSPVFTGAWGHTVVVKSLSGDTLTVLEQNYNNVQTVQEHTYSASAYLSVVQTVCYPPEIVKGRRVEGTAQAEQPQPETTTTSEEKEVLINPSLYREWKNESGQVEFYVKNSMLYAPLSKSLYPSAFTGIETDDNWIRKDLDVDTESEEKLISVALADLRKHCYPAVTYEVSGFIGDLDIGDTIKINDPEYTPSLILEARVSEQHISFTEPNQNKTVFDNYRALESKVSQGLIDRMNELAEAAKPYDLRLMTDNGNVFLNGEGRTILTAELWKGNKKFDASYQFKRDGQLVGAGLQLAVDAKDVPADKPLIITVEAYLNNELIASKQITFTNSLGEQGPAGRGIVSTEDYYLASPNRTGVTSATSGWTKTPQEITETNKYHWHYHVDVYSDGTRKETTPAIIGVYGDKGSDGKQGKRGEIGPSGPPGALDEKQLQDINNKIDGKADQNLTIEQINKLAELQSIANAELQAKASIDALASLQKQVQSAIAAMNASQKLSEQDLITASQRAIKATNDILDLKEQWNFIDNYMSASEEGLIIGSKDGTSSVRVAKDRIAFYSAGAEVASITGGMLKIDNGMFVATLQVGHFREEMYKVDGVDKHINVTRYYETIVG
Physico‐chemical
properties
protein length:1146 AA
molecular weight: 126204,61060 Da
isoelectric point:5,50778
aromaticity:0,09162
hydropathy:-0,42565

Domains

Domains [InterPro]
DC_0558
ATT
1–399
IPR002901
ENZ
264–399
IPR002901
ENZ
281–392
G3DSA:1.10.530.10
RBD
283–387
G3DSA:2.10.70.40
Unmapped
306–349
AIU44396.1
1 1146
Architecture
ATT
STR
ATT 1-399 | STR 400-1146
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage T12
[NCBI]
35344 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus pyogenes
[NCBI]
1314 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AIU44396.1 [NCBI]
Genbank nucleotide accession
KM289195.1 [NCBI]
CDS location
range 27019 -> 30459
strand +
CDS
TTGCTTATAACAATCCACAACGCAAATTTAGAAAAAGTTGCTTATATTGATAACGATAAGCAAGACACCTTGAATTATTATGACGACAAATTTTCACAGTATTTAAATACGGCCAATTCGACATTTGAGTTTACGGTTTATAAGCGAGGAATTAAGTCCGACACAGTCAAAGAGAAAGCCTATCTGACACTTACAGAAAGGTCTTTTGTGTCGTTTAAATATAATGGCAAGTCTTATCTGTTTAACGTAATGACAACAGACGAGACAGACATCGAGATACGTTGTTACTGCGAGAACCTCAATCTCGAGTTGCTCAATGAGTATGCAGGACCTTATAAAGCGGCAACTCAGATGTCTTTTGTCGATTATTGTAATTTGTTTGGCATCCTTAAAAACGGTGCTATTACCATTGGCACTAATGAGACAACCGACCAAAAACGCACAATCGAATGGACTGGTCAAGATACCAATCTTAAACGCTTGTTATCTATCGCCAATAATTTTGATGCGGAAATAGAATTTGTAACGCATCTTAAAAACGATTCTAGTCTTAAATCGTTTGTCATGAATGTCTACAAGAAGAACGACGCTACTAATCAGGGCGTTGGTCGTAGACGAGATGATATTATTTTGCAATATGGCAAAAATATCGAGAGTGTCAGACGTAAGATTAATAAAACAGGCATTTACAATGCTATAAGACCAAGCGGTAAAATAACAACGACTACAACCACAACGACTGCTAAACAAGGCTCTGTGCAAACAGGGTCTGTTTTGTGGTCTGGCGGTAACTTGACTTATGCAGGTCATGTAATGCAATCATCTGTTGTTAACACTATTTTAAGCCTATGTAGCAAATACAAACTTTTACCATCTGGTGTTTTTAGCCAGCTATACCTTGAATCGTTTTGGGGAGATACCCCAGTCGGAAGAGCCGATAATAACTGGGGTGGTATCACTTGGACTGGCGCAACAACTAGGCCAAGCGGAATAAATGTCTCCCAAGGGCAGTCTCGTGCTGAAGGTGGTTATTATAACCATTACGCCAGTGTTGATGACTACTTGAAAGATTACGCTTACCTCTTGGCCGAGCAAGGCATTTATGCCGTAAAAGGTAAGCTAACCATTGATGAGTACACAAGAGGTCTGTTTAGGGTCGGTGGCGCAACATATGATTATGCTGCAGCTGGATATGATCATTATGCACCTTTGATGCGAGACATCAGAGCAGGTATTAACCGTAATAATAACGGCGCTATGGATAACGTCGATAACCAATTTAAAAATGGTGGCTCGACTAGTCAAAACACTACTCAGATAGCTGCTAAAACAAAAGCGGTACTTGCGGAAGCAAATGGACTGAAAGGTCAACGAGTAGGCTCTGGTCAGTGCTATGCGTTAGCTGCTTGGTACGCCATGAAATTAGATGGTCCAGGTCTGAACGGTGGTGTAACTAGTTTTAGAGGGCTTATTGGTGCTGGTGCTGCCGCTGCTCAGATTGGTACGGATTACAACTGGGGTCAGTTTGGCTGGAAAGTTGTACAACCGAATAAAGTCGCAGACTTAATCACAGGCTCGATTGTTAACATCAGAGCAAACGCTGGCAGTCCTGTTTTTACAGGCGCTTGGGGGCATACTGTTGTTGTTAAATCTTTATCTGGAGATACACTCACAGTATTAGAGCAAAATTATAACAACGTGCAAACAGTCCAAGAGCATACATATAGCGCTAGCGCTTATTTATCAGTTGTACAGACAGTCTGTTACCCGCCAGAAATCGTTAAAGGGAGACGTGTCGAAGGCACTGCACAAGCAGAACAGCCACAACCAGAAACAACCACGACATCTGAAGAAAAAGAGGTTTTAATTAACCCATCGCTTTACCGTGAGTGGAAAAACGAATCAGGACAAGTCGAATTTTACGTTAAAAACAGCATGCTCTATGCACCTTTGTCTAAATCGCTTTATCCATCAGCGTTTACAGGAATTGAAACTGACGATAATTGGATACGAAAAGACTTAGATGTTGATACAGAAAGTGAAGAAAAGCTTATCTCTGTTGCTCTCGCAGATCTGAGAAAACATTGTTATCCAGCGGTGACCTATGAAGTATCTGGTTTTATTGGTGATTTAGATATTGGTGACACTATCAAAATCAATGATCCAGAATACACGCCAAGCCTAATTTTAGAAGCAAGGGTTAGCGAGCAACACATCTCGTTTACAGAGCCTAATCAAAATAAGACCGTCTTTGATAATTACAGAGCTTTAGAGAGCAAAGTCTCACAAGGTTTAATTGACCGCATGAACGAACTAGCAGAAGCTGCTAAACCTTACGACTTGCGGTTAATGACAGATAACGGAAATGTGTTTTTAAACGGCGAAGGTCGTACGATTTTAACCGCTGAACTTTGGAAAGGTAACAAAAAGTTTGATGCAAGCTATCAATTTAAACGTGATGGTCAATTAGTCGGCGCTGGATTGCAGTTGGCAGTTGACGCTAAGGATGTACCAGCTGATAAACCTCTAATCATTACTGTTGAGGCTTATTTAAATAATGAGCTGATTGCAAGTAAACAGATTACGTTTACTAACTCGCTTGGAGAACAAGGACCAGCTGGACGTGGGATTGTCTCTACAGAGGACTATTACTTAGCGTCACCAAATCGTACAGGTGTCACATCTGCAACATCTGGTTGGACTAAGACGCCTCAGGAAATTACTGAGACTAATAAATATCATTGGCATTATCACGTTGATGTTTATTCAGATGGCACTCGAAAAGAGACTACACCGGCTATTATTGGTGTTTACGGCGATAAAGGTTCAGATGGCAAGCAAGGGAAACGTGGGGAGATAGGACCATCAGGACCTCCTGGCGCTTTAGATGAAAAGCAACTACAAGACATCAATAATAAAATTGATGGCAAAGCAGACCAGAATTTGACCATCGAGCAAATCAATAAATTAGCCGAGTTACAATCTATTGCCAATGCTGAGTTACAAGCAAAGGCTAGCATCGACGCTTTAGCTAGCTTACAAAAGCAAGTACAGTCTGCAATAGCGGCAATGAATGCTAGCCAAAAGTTATCAGAGCAAGACCTTATTACAGCTAGTCAACGGGCTATCAAAGCAACCAACGACATCTTAGACTTAAAAGAGCAATGGAATTTTATTGACAATTATATGTCAGCGTCTGAAGAGGGACTTATTATCGGCTCTAAAGACGGTACAAGTTCCGTGCGTGTTGCCAAAGACCGTATTGCCTTTTACTCAGCTGGCGCAGAAGTCGCTTCGATTACTGGTGGTATGCTCAAAATTGATAATGGTATGTTTGTGGCTACTTTGCAAGTTGGACATTTTCGCGAGGAGATGTACAAAGTTGATGGGGTAGATAAACACATAAATGTTACAAGATATTACGAAACGATTGTGGGGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
fc8356430053b31356b3c4c37722caff38bd61228d63648f8a8e775a216c486b
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7775
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50