Genbank accession
APD23838.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,54
TF
Evidence RBPdetect2
Probability 0,92
Protein sequence
MLLTIHDANLQKVAFVDNDKQGTLNYYDDTWTRSLLTGSSTFEFTVFKKSIKSDNALQKAYSYLNERAWVSFKYHGKSFLFNVMQVEEDEQTIKCYCENLNLELINEIANPYKANKAMSFAEYCEVMDLLNHTRLSIGINEISDYKRTLEWEGQETKLARLLSLANKFNAEIEFDTQLEADSTIKKFSVNIYHENDEKHQGVGRIRSDIQLKYGKNVKSIRRKVDKTGIFNTIRPTGKRRVKNGKGEEVEEIVTLKGLDAWSVKNDRGIVEFYQRNESLYAPISMQLYPSTFSHGTADDQWTRKDFSYDTDDPKELHRLGYNELKKHCYPAITYEVDGFVDADIGDTVKAYDDDFSPFLIVKARVTDQKISFSNPTNNKTIFSNFKALENQLSDGIQEAFERLFEAAKPYTIKLSTDNGVIFKNQIGQSLVTPTLYKGGKPVVVGVTWRWALDGEVTTGMTYLVRGSNVTDTVTLTVAAYIGNKEVAVDEISLVNVADGKLGTPGTPGRDGRTPYVHTAWANNATGTDGFSLDSSINKLYIGIYTDFEPNDSTDPKKYKWAKVKGDKGEKGDKGEPGQRGLDGLQGARGEQGLPGRNGADGRTQYTHIAYSNSADGTKDFSVSASDRAYIGMYVDFNSADSNTPSDYNWTLVKGADGANGVAGKAGTDGRTPYLHIAYATSNNGSQGFSTTDSTNKTYIGTYTDYTQSDSTDYRVYKWTLIKGADGTGISNVTNYYLATTVSTGITRTSAGWTTTPQPITSDKRYLWNYRVELYTNGTSKTTEPTVIGVHGDKGERGLQGLQGLQGARGEQGIPGPRGADGRTQYTHMAYADNATGGGFSQTNTDKAFVGVYIDFNPTDSRNPADYRWTRWKGRDGANGVAGKAGADGRTPYVHFAYSENADGSGLTMTDNGQRYFGHYSDYEKPDSSDKTKYKWADRWAKVDGGYVNIYALSKNRSIGKSYHVSEFNMDVLSGNITLKAIGSDPYIGAVSSHPGIFIKQQGMKIPVIQGRSICITITNPLFRKNYISFFNSLGKTVKTYKHYNTNKFLISSADLVGVEFIALRYGAGSSNIQIGTVLETKVKVEYGTVHSDWSPAPEDIESNINSKADQGLTQEQLNALNEKSQILEAEMKAKASMEAFSELEKAYNAFVKLNADSQKNLSLI
Physico‐chemical
properties
protein length:1164 AA
molecular weight: 129114,93750 Da
isoelectric point:6,39970
aromaticity:0,10739
hydropathy:-0,59785

Domains

Domains [InterPro]
DC_0120
STR
1–591
IPR010572
ENZ
145–386
DC_1151
STR
580–736
APD23838.1
1 1164
Architecture
STR
STR 1-1162 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
APD23838.1
1 1164
Domain Start End Length (AA) Confidence
N-terminal 1 956 956 0,9561
Central domain 957 1153 198 0,5375
C-terminal 1154 1164 10 0,0287
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-956
Central
957-1153
C-terminal
1154-1164

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage IPP53
[NCBI]
1916191 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus pneumoniae GA41538
[NCBI]
760813 Bacillota > Bacilli > Lactobacillales > Streptococcaceae > Streptococcus > Streptococcus pneumoniae

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
APD23838.1 [NCBI]
Genbank nucleotide accession
KY065491.1 [NCBI]
CDS location
range 29291 -> 32785
strand +
CDS
ATGCTTTTAACAATTCATGATGCAAACTTACAAAAGGTGGCATTTGTTGACAATGATAAACAAGGCACATTGAATTATTATGACGACACATGGACTAGAAGTCTGCTTACAGGTTCATCAACATTTGAGTTTACTGTATTTAAAAAATCTATTAAGTCAGACAATGCATTACAAAAAGCCTATTCGTACCTTAATGAACGAGCCTGGGTATCTTTCAAATATCATGGTAAGAGTTTTCTTTTTAACGTTATGCAAGTTGAGGAGGATGAACAGACTATCAAATGCTATTGCGAGAACCTCAATCTTGAGTTGATAAACGAGATAGCAAATCCTTATAAAGCTAATAAGGCAATGAGCTTTGCGGAATACTGCGAGGTTATGGATTTATTAAACCATACTCGTCTTTCCATCGGCATTAATGAAATTTCAGATTACAAACGTACTCTTGAATGGGAGGGGCAAGAAACAAAACTTGCCCGCTTGTTGAGCCTTGCTAACAAGTTCAATGCTGAGATTGAGTTTGATACACAATTAGAAGCTGATAGCACTATCAAAAAGTTTAGTGTTAATATCTATCATGAAAACGACGAAAAACATCAAGGTGTAGGTCGGATAAGAAGTGATATACAACTAAAATATGGCAAGAATGTCAAATCAATCCGTCGCAAGGTTGATAAAACAGGTATTTTTAATACGATTAGACCAACTGGTAAAAGACGAGTTAAGAATGGAAAAGGCGAAGAAGTCGAGGAAATTGTAACATTAAAAGGCTTAGATGCTTGGTCTGTTAAGAATGATAGAGGTATTGTTGAATTTTATCAACGAAACGAGTCACTGTATGCGCCTATCTCAATGCAACTATATCCATCAACATTCTCACATGGCACAGCTGATGATCAATGGACAAGAAAAGATTTTAGCTACGACACTGACGATCCAAAAGAACTACATCGTCTGGGTTATAACGAGCTTAAAAAACATTGTTATCCAGCAATTACTTATGAAGTTGATGGTTTTGTCGATGCTGACATTGGTGATACAGTCAAGGCTTATGATGATGACTTTAGTCCTTTCTTGATTGTCAAGGCACGAGTTACTGACCAGAAAATCAGTTTTTCCAATCCAACAAACAACAAAACAATATTTTCAAACTTTAAAGCCCTTGAAAATCAATTATCAGACGGCATACAAGAGGCTTTTGAGAGATTATTTGAGGCTGCTAAGCCATATACTATTAAATTATCAACGGACAATGGTGTTATCTTTAAAAATCAGATCGGCCAGAGTCTAGTAACCCCAACCTTATACAAGGGAGGAAAACCAGTCGTTGTTGGTGTTACTTGGCGATGGGCACTTGATGGAGAAGTAACAACAGGGATGACTTACTTAGTTAGAGGCTCAAATGTAACTGATACAGTTACTCTGACAGTTGCAGCTTACATTGGAAATAAAGAGGTTGCTGTTGATGAGATATCGCTTGTTAATGTTGCTGATGGAAAACTTGGTACACCTGGAACTCCAGGGCGAGATGGCCGTACTCCTTATGTCCATACAGCATGGGCTAATAATGCAACAGGAACAGATGGATTTAGTCTTGATAGCTCAATCAATAAACTCTATATTGGTATTTATACAGACTTTGAACCAAACGATAGCACAGACCCTAAAAAATACAAGTGGGCTAAAGTAAAAGGAGACAAGGGAGAAAAAGGCGATAAAGGAGAACCGGGACAACGTGGTTTAGATGGCTTGCAAGGTGCACGAGGTGAACAAGGATTACCTGGTCGCAATGGTGCAGATGGCCGTACTCAATACACTCACATAGCTTACAGCAATAGCGCTGATGGAACTAAGGATTTTTCTGTAAGCGCCTCTGATAGAGCTTATATCGGTATGTATGTTGATTTTAATAGTGCTGATAGTAATACTCCATCTGATTACAATTGGACACTTGTAAAAGGAGCTGATGGCGCAAACGGCGTGGCAGGTAAGGCTGGTACAGATGGTAGGACACCATACTTACACATAGCTTACGCCACATCAAATAACGGCTCACAAGGCTTCTCAACTACTGACAGTACAAATAAAACGTATATCGGAACATACACAGATTACACTCAGTCAGATAGTACAGATTACAGAGTGTATAAGTGGACGTTGATAAAAGGGGCAGATGGTACTGGTATTTCTAATGTAACTAATTATTATTTAGCTACTACAGTCTCAACAGGTATCACAAGAACAAGCGCAGGGTGGACAACTACGCCACAGCCTATCACATCAGACAAGCGTTATTTATGGAATTATCGAGTTGAGCTATACACAAACGGTACAAGTAAGACAACAGAGCCTACTGTTATTGGTGTGCACGGGGATAAAGGAGAACGTGGATTACAAGGTTTACAAGGCTTGCAAGGCGCACGAGGTGAACAAGGTATTCCTGGACCTAGAGGGGCAGATGGCCGTACACAATATACTCACATGGCCTATGCCGATAACGCAACAGGTGGTGGATTCAGTCAAACAAACACTGACAAAGCCTTTGTTGGAGTGTACATTGATTTTAATCCAACAGACAGCAGAAATCCTGCTGATTATCGCTGGACAAGATGGAAAGGTCGTGATGGCGCAAACGGCGTGGCAGGTAAGGCTGGTGCAGATGGTAGGACACCTTATGTTCACTTTGCGTATTCTGAAAATGCAGATGGATCAGGTTTGACAATGACAGATAACGGACAGCGTTATTTTGGTCATTATTCAGATTATGAGAAACCTGATAGTTCGGATAAAACTAAGTACAAATGGGCTGATCGTTGGGCTAAAGTTGATGGAGGTTATGTAAATATCTATGCATTGTCTAAGAATAGAAGTATTGGGAAATCTTATCATGTTTCTGAATTTAATATGGATGTACTTTCAGGGAATATCACTCTAAAAGCAATTGGGTCAGATCCATACATTGGCGCCGTTTCTTCTCATCCAGGTATTTTTATAAAGCAACAGGGAATGAAAATCCCAGTTATACAAGGGAGATCTATTTGTATAACAATAACAAATCCTTTATTTAGAAAAAATTACATCTCGTTTTTTAATTCATTAGGTAAAACTGTTAAAACATATAAGCATTACAACACAAATAAATTTTTAATATCTTCAGCTGATTTGGTAGGTGTTGAATTTATCGCTTTACGATATGGTGCAGGAAGCTCGAATATACAAATTGGAACCGTACTAGAGACAAAAGTAAAGGTAGAATATGGAACCGTGCATAGCGACTGGTCGCCCGCTCCAGAAGATATTGAAAGTAATATTAACTCTAAAGCTGATCAGGGGCTGACTCAAGAGCAGTTAAATGCCCTCAATGAGAAGTCACAGATTTTAGAGGCTGAAATGAAAGCGAAAGCATCGATGGAGGCCTTTAGTGAATTAGAAAAAGCATATAATGCCTTTGTGAAATTAAATGCAGATAGTCAAAAAAATCTGAGTCTGATTTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
b7953ac5ab28e02ae9fc49f91a790a1e425cb43dcf7b6751d8684737d3078e09
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7252
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50