Genbank accession
AAK83241.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MQIWIHDKSMRKVCALNNEIPGMLPYTNSQWHSYLEYSTSTFDFTIPKFVNGKLHDDLKYINDQMYVSFYYDNSYHVFYTAKIVENDMSFQVTCNNTNLELAMEIARPLADIGGAKSVEWYLQNLDLLGFAGLEVGFNEVSDKTRTITFESQSGTKLEQLHSLMNQFDAEFVFRTDLNRDGTLKKFVIDIYNRPDENHHGIGKVRGDVTLYYQTGLKGVQVTSDKTQLFNAGVFTGANGVNLDSVEFEEKNELGQVEFYSRKGTSFVFAPLSRERYPSTMNPDSADNWTRKDFQTEYKDVESLKAYALRTIKQYAYPLLTYTVDVQSSFLDNYKDINLGDTIKIVDNNFRGGLALEARVSEMIISFDNPTNNSVVFTNFRKLANKPTDALQQRIDEIVSKSLPYHVEIRTTNGTVFKNGIGRSTVKPVLKQGDKIVNATYRFVIDGTIKYSGMTYDMVASEINQPTTLTISAWVDNKEVASEEVTFVNVSDGKQGPKGADGKTPYVHFAYADSADGQKGFSLTQTGSKRYLGVYTDFNQAGSTNPADYTWSDTAGSVSVGGDNLITNSSFPKNLDGWGYYEEGEPNSNLHISTHEFYYNGARKLFRLNNNGKEEVPAASRRFKVKRNTDYSFNILIFATWNIHSVDIYFLGRKANETKTFTKVVNLKTHTGSPSVTQAVKWHLTFNSGECDEGFIRIDNNGTTDGKTSMLFFAELDCYEGTTDRSWQASPEDLKDEIDTKADNALTQAQLNKLSEINSVMKAELEAKASLATVNQWIKAYQDFVNANSADRAQAQKALADASARVVKLENNLNDMSERWNFIDNYMAASNDGLVIGKKDNSSSIMFNPNGRISMFSAGNEVMYISQGVIHIENGIFSKTIQIGRFREEQDFINPDRNVIRYAGGI
Physico‐chemical
properties
protein length:905 AA
molecular weight: 101946,47060 Da
isoelectric point:5,42746
aromaticity:0,11381
hydropathy:-0,48983

Domains

Domains [InterPro]
DC_0002
STR
1–905
IPR010572
ENZ
142–381
AAK83241.1
1 905
Architecture
STR
STR 1-905
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage MD4
[NCBI]
152565 No lineage information
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AAK83241.1 [NCBI]
Genbank nucleotide accession
AF348735.1 [NCBI]
CDS location
range 164 -> 2881
strand +
CDS
ATGCAAATATGGATTCATGATAAAAGTATGCGTAAGGTGTGTGCTTTGAATAATGAAATTCCAGGAATGTTGCCATATACGAACAGTCAATGGCATTCATATCTTGAATACTCAACAAGTACGTTTGACTTCACAATTCCTAAGTTTGTAAATGGAAAACTTCACGATGATTTAAAATATATCAATGATCAGATGTATGTGTCGTTTTACTATGATAATTCTTACCACGTTTTCTATACGGCTAAGATTGTTGAGAATGATATGAGCTTCCAAGTGACTTGTAACAATACCAATCTTGAATTAGCAATGGAAATTGCACGACCACTTGCAGATATTGGCGGTGCCAAAAGTGTTGAGTGGTATCTTCAAAATCTTGATTTACTTGGTTTTGCTGGTCTTGAAGTTGGCTTCAATGAGGTTTCTGATAAAACAAGAACTATCACGTTCGAGTCTCAAAGTGGTACAAAACTAGAACAGCTTCACAGCTTGATGAATCAATTCGATGCAGAGTTTGTTTTTCGTACAGATTTAAACCGAGATGGTACTTTGAAAAAATTTGTCATTGACATTTACAACCGTCCTGACGAAAACCATCACGGTATTGGTAAGGTTCGAGGAGATGTAACCCTTTACTATCAAACAGGTTTGAAAGGCGTTCAAGTTACTAGTGATAAAACGCAACTGTTTAATGCTGGTGTTTTCACTGGTGCAAACGGGGTTAATCTTGATAGCGTTGAGTTTGAAGAAAAAAATGAGTTAGGACAAGTAGAGTTCTATTCTCGAAAGGGCACTAGCTTCGTTTTCGCCCCACTATCAAGGGAACGCTACCCATCTACCATGAATCCAGACAGCGCTGATAACTGGACACGTAAGGATTTTCAAACAGAATACAAGGACGTTGAATCCTTAAAAGCTTACGCCTTGCGTACTATCAAGCAGTATGCTTATCCACTATTGACTTACACAGTAGATGTTCAGTCTAGCTTTCTGGATAACTATAAAGACATCAATCTAGGTGATACCATCAAGATTGTGGATAACAATTTTAGAGGTGGTTTAGCCCTCGAAGCTCGTGTATCTGAAATGATTATCAGCTTTGACAATCCTACAAACAATTCGGTTGTTTTTACTAATTTTAGAAAACTCGCAAACAAGCCAACAGACGCCTTACAACAACGTATCGACGAGATTGTTTCTAAGTCATTGCCATATCATGTAGAGATAAGGACCACAAACGGTACAGTATTTAAAAACGGTATTGGTCGTTCTACTGTTAAACCAGTCTTAAAGCAAGGCGATAAAATTGTTAATGCAACTTATCGATTTGTGATTGATGGCACTATTAAATATTCGGGTATGACTTATGATATGGTAGCGTCAGAGATTAACCAACCAACCACGCTTACTATCTCAGCTTGGGTAGATAATAAAGAAGTAGCTTCAGAAGAAGTTACTTTTGTAAATGTATCAGATGGTAAACAAGGACCTAAAGGTGCTGACGGGAAAACACCTTATGTTCACTTTGCTTATGCCGATAGTGCCGATGGTCAAAAGGGTTTCAGTTTGACACAGACTGGAAGTAAACGCTATTTAGGTGTGTACACCGATTTCAATCAGGCGGGCAGCACTAACCCAGCTGATTATACTTGGAGTGACACGGCTGGCAGTGTTTCGGTTGGTGGTGATAATTTAATCACTAACTCATCTTTCCCAAAAAATCTTGACGGATGGGGTTATTATGAAGAAGGAGAGCCTAATAGCAATCTTCATATAAGTACACATGAATTTTATTACAACGGTGCAAGAAAACTATTTAGACTAAATAATAACGGCAAGGAGGAAGTTCCTGCTGCATCAAGACGTTTTAAAGTTAAACGCAATACAGATTATTCGTTTAATATTCTGATATTTGCAACCTGGAACATCCATAGTGTTGATATCTATTTTTTGGGTCGGAAGGCGAATGAAACTAAGACATTTACTAAAGTGGTCAACTTAAAGACACATACAGGTTCACCATCGGTTACACAAGCTGTTAAATGGCATCTAACATTTAACTCTGGAGAGTGTGATGAAGGGTTCATTCGTATTGATAACAATGGCACTACTGACGGTAAAACTTCTATGCTATTTTTCGCAGAACTAGACTGCTATGAGGGTACTACTGATAGATCGTGGCAAGCGTCACCGGAAGACTTAAAGGACGAGATAGACACTAAAGCTGACAATGCATTAACGCAGGCTCAGCTTAATAAATTAAGTGAAATTAATTCGGTGATGAAAGCAGAGCTCGAAGCAAAAGCATCCCTTGCCACTGTTAATCAATGGATTAAGGCTTATCAAGATTTTGTTAATGCAAACAGCGCAGATCGTGCGCAGGCTCAAAAGGCTTTGGCAGATGCCAGTGCACGAGTAGTGAAACTAGAAAATAACTTAAACGATATGTCAGAGCGTTGGAATTTTATCGATAACTACATGGCAGCATCAAATGATGGTTTGGTTATCGGGAAGAAAGATAACTCCAGCTCTATTATGTTCAATCCAAATGGGCGTATATCAATGTTTTCAGCTGGTAATGAGGTAATGTATATCTCTCAGGGTGTGATTCACATTGAGAACGGTATTTTTTCTAAGACTATTCAAATTGGACGATTCCGAGAAGAACAAGATTTTATTAATCCGGATCGCAACGTCATCCGCTATGCAGGAGGTATTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
a31ff16a81359391d8e95f09e732477a14712976fe862d654895c402bfcc8484
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7663
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50