Genbank accession
YP_009003391.1 [GenBank]
Protein name
tail fiber protein and host specificity
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,53
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MLLTIHDANLQKIGFIDNEKQETLNFYDDTWTRNLETASSTFEFTVSKKQLLSDTGNKHLYNQLNERSFVSFKYKGKTYLFNIMKTEENERWVRCYCENLNLELINEYTNAYKAEKAMSFAEYLNAFDIPQFAMVTLGVNEVSDQKKTLEWEGQDTKLARLLSLANKFNAEVEFVTRLNDDSSIKQLVLNVYHQADDSHTGVGRIRSDIRLTFEKNIKSMTRKVDKTEIYTMIVPYGKAKEQPENGPEVRVYIGGLPAWEEKNDRGIVIFKQEGNCLYAPHAANLYPSTFGASTQDNKWIRKDLEVDSDDPNVIRAAGIANLRKHAYPAITYEVDGFIDVEIGDTITIHDKGFTPALDVRARAVEQKISFSNPTNNKTTFGNFKELENRTSGDLRSVFEQMVENSRPYNILVSTDNGVLFKNNTGQSTLRPTLKRGNQVINATYRFVIDGSIVNSGLTYTVKASDISKPTVITISAWVDNKEVASEEVTFLNVSDGLKGDKGDPGRDGIAGKDGVGLRSTNITYASSTSGTSAPSNGWTSSVPTVPAGQYLWTKTVWNYTDSTSETGYSVARIGKDGNTGRDGVPGKDGVGINSTTVVYAGSTSGTVPPSSGWSDQIPSVSPGQYLWTKTTWSYTDNTSETGFSVAKMGEVGPKGDRGEQGLQGPRGEQGIPGPKGADGRSQYTHIAYADTISGSGFSQTDTNKAFIGMYQDFNTTDSQNPQDYRWSKWKGSDGRDGVPGKPGADGRTPYVHFAYADSPDGRTGFSVTQNGKKRYLGVYTDFNQADSTNPSDYTWNDTAGSISVGGRNLLVKTNQGITNWDWGLSDGDKSFEEVKVDGIRAVKLIKGSTTANTGWNYISYNGLLRELIQPNTKYVLSFDVKPSVDVTFYATLTQGDFKETFTDTGTMTKALANQWNKVSCVLTSKETLPNITWQLVHLSGMPTTNGSWLIVKNIKLEEGNIPTQWTPAIEDIQDEIDTKADSVLTQSQLNQLNEINSVMKAELEAKASLDTLNQWVKAYQDFVNANSADRAQAQKALADASARVVKLENNLNDMSERWNFIDNYMAASNDGLVIGKKDNSSSIMFNPNGRISMFSAGNEVMYISQGVIHIENGIFSKTVQIGRFLEEQDSINPDRNVIRYVGGI
Physico‐chemical
properties
protein length:1144 AA
molecular weight: 126615,13300 Da
isoelectric point:5,32652
aromaticity:0,09528
hydropathy:-0,55184

Domains

Domains [InterPro]
DC_0255
STR
1–1144
IPR010572
ENZ
144–385
IPR001763
RBD
247–268
YP_009003391.1
1 1144
Architecture
STR
STR 1-1144
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_009003391.1
1 1144
Domain Start End Length (AA) Confidence
N-terminal 1 812 812 0,9527
Central domain 813 1105 294 0,4090
C-terminal 1106 1144 38 0,9379
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-812
Central
813-1105
C-terminal
1106-1144

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage 20617
[NCBI]
1392231 Uroviricota > Caudoviricetes > Aliceevansviridae > Brussowvirus 20617 >
Host Streptococcus thermophilus DSM 20617
[NCBI]
1091038 Bacteria > Firmicutes > Bacilli > Lactobacillales > Streptococcaceae > Streptococcus

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_009003391.1 [NCBI]
Genbank nucleotide accession
NC_023503.1 [NCBI]
CDS location
range 33771 -> 37205
strand +
CDS
ATGCTATTAACAATTCACGATGCCAACTTACAAAAGATTGGTTTTATCGATAACGAAAAGCAAGAAACATTAAACTTCTACGATGACACTTGGACCCGTAACCTTGAGACAGCATCGAGCACGTTCGAGTTTACCGTTTCTAAGAAACAGTTACTTAGCGATACAGGAAATAAACACCTTTATAACCAACTAAACGAGCGCTCTTTTGTTTCCTTCAAATATAAAGGCAAGACATATCTTTTTAACATCATGAAGACGGAAGAAAATGAGCGATGGGTGCGATGTTACTGTGAAAACCTGAATCTTGAATTGATAAACGAGTACACGAATGCTTACAAGGCTGAAAAAGCTATGTCATTTGCAGAATACCTCAATGCGTTTGATATTCCTCAATTTGCAATGGTAACGCTCGGTGTCAATGAAGTCTCTGACCAGAAAAAAACACTTGAATGGGAGGGACAAGACACGAAGTTAGCAAGGTTGTTGAGCTTAGCTAATAAATTTAATGCTGAAGTTGAATTCGTGACTAGACTTAATGACGATAGCTCTATTAAGCAACTCGTCCTGAACGTTTACCATCAAGCGGACGATTCACACACTGGCGTAGGTCGAATTCGTAGCGATATTCGTTTGACGTTTGAAAAAAATATCAAATCGATGACGAGAAAGGTTGATAAAACCGAGATCTATACAATGATTGTCCCTTACGGGAAAGCAAAAGAGCAACCCGAAAACGGTCCTGAAGTGAGAGTTTATATTGGTGGTCTTCCAGCTTGGGAAGAGAAGAACGATAGAGGGATTGTTATCTTCAAACAAGAGGGCAATTGTCTCTATGCACCTCATGCAGCCAACTTGTATCCTTCAACTTTTGGGGCTTCGACTCAAGATAATAAGTGGATTCGAAAAGACTTAGAGGTTGATAGCGATGATCCAAATGTCATCCGTGCTGCAGGTATTGCAAACTTACGCAAACACGCATATCCAGCTATCACTTACGAGGTTGACGGTTTTATTGATGTCGAAATTGGGGATACGATAACAATCCACGACAAAGGATTCACACCAGCGCTTGACGTGAGAGCGCGTGCCGTTGAGCAAAAAATTAGCTTCAGCAATCCAACCAACAATAAGACCACTTTCGGAAACTTCAAAGAGCTTGAAAATAGGACATCTGGAGACCTTAGGAGCGTTTTCGAGCAAATGGTTGAGAACAGTCGACCATACAATATCCTAGTCTCAACTGATAACGGTGTTTTGTTTAAAAACAATACAGGGCAGTCAACACTACGCCCAACATTAAAACGAGGGAATCAGGTTATTAATGCAACATATAGATTTGTAATTGATGGTTCTATTGTTAACTCTGGTCTGACCTATACCGTCAAAGCAAGCGATATCTCAAAACCAACTGTGATCACGATTTCAGCGTGGGTTGATAACAAAGAAGTAGCTTCAGAAGAAGTTACTTTTTTAAATGTTTCAGACGGTCTTAAAGGCGATAAAGGAGACCCAGGGCGTGATGGTATCGCTGGTAAGGATGGTGTAGGTCTTCGTTCTACAAATATCACTTACGCCTCGTCAACATCAGGAACAAGCGCCCCTAGCAATGGCTGGACTAGCTCAGTACCAACGGTACCAGCTGGACAGTATCTGTGGACTAAGACTGTCTGGAATTACACAGACAGTACCTCAGAGACTGGTTATTCAGTAGCTAGGATTGGTAAAGACGGCAACACTGGTAGAGATGGCGTACCTGGTAAAGACGGTGTAGGGATAAACTCTACTACGGTAGTTTACGCTGGTTCTACATCAGGAACTGTCCCACCGTCTAGCGGTTGGTCTGATCAAATCCCTAGCGTATCTCCTGGTCAATATCTCTGGACTAAAACCACATGGAGCTATACAGATAATACTAGCGAGACTGGTTTTTCAGTCGCTAAAATGGGAGAGGTAGGACCTAAAGGTGACCGTGGTGAACAAGGTTTGCAAGGACCACGGGGAGAGCAAGGGATTCCTGGACCTAAAGGAGCAGACGGAAGAAGCCAATATACACATATTGCTTACGCTGATACAATTTCAGGTAGTGGCTTTAGTCAAACAGATACTAACAAGGCTTTCATCGGCATGTATCAAGATTTCAACACCACGGATAGTCAAAACCCTCAAGACTACCGTTGGTCTAAGTGGAAAGGTAGCGATGGACGGGATGGTGTTCCTGGTAAGCCAGGAGCTGATGGACGCACGCCTTATGTCCACTTCGCTTACGCAGATAGTCCAGATGGACGTACAGGTTTCAGTGTTACACAGAACGGTAAAAAACGCTATTTAGGTGTGTACACCGATTTCAATCAAGCGGACAGCACTAATCCTTCTGATTACACATGGAATGACACTGCGGGTAGTATATCAGTTGGTGGTCGGAACTTGCTTGTAAAAACCAATCAAGGTATTACTAATTGGGATTGGGGGCTTTCCGACGGCGACAAGAGCTTTGAAGAGGTCAAAGTTGATGGCATTCGTGCTGTAAAACTAATCAAAGGTTCAACAACAGCAAACACTGGTTGGAATTACATTTCATATAACGGTTTACTGCGTGAACTCATACAGCCGAACACTAAGTATGTTCTTTCGTTCGATGTTAAACCAAGCGTTGATGTAACTTTCTATGCAACGCTAACGCAAGGAGACTTTAAAGAGACGTTTACTGATACTGGGACTATGACTAAAGCATTAGCAAATCAGTGGAATAAGGTATCGTGCGTTTTGACAAGTAAAGAAACTTTGCCAAATATTACATGGCAGCTTGTACACTTATCAGGTATGCCGACAACAAATGGTAGTTGGCTAATCGTCAAGAATATCAAACTTGAAGAAGGCAACATACCTACTCAGTGGACTCCCGCAATTGAAGACATACAAGATGAAATTGACACTAAGGCTGACAGTGTATTGACGCAAAGTCAGTTAAACCAATTGAATGAGATTAATTCGGTGATGAAAGCAGAGCTCGAAGCCAAAGCGTCTCTTGATACGCTCAATCAATGGGTCAAGGCTTATCAAGATTTTGTTAATGCAAATAGCGCAGATCGCGCACAAGCTCAAAAGGCTTTGGCAGATGCTAGTGCACGAGTAGTTAAACTAGAAAATAACTTAAACGATATGTCAGAGCGTTGGAATTTTATCGACAACTACATGGCAGCATCAAATGATGGTCTTGTCATTGGAAAAAAAGATAACTCCAGCTCTATCATGTTCAATCCAAACGGGCGTATATCAATGTTCTCAGCCGGTAATGAGGTAATGTATATCTCTCAGGGTGTGATTCACATTGAAAACGGTATTTTTTCTAAAACTGTTCAAATTGGACGATTCCTAGAAGAACAAGATTCCATAAATCCGGATCGTAACGTCATTCGCTATGTGGGAGGTATTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
d5fb3372be869f17c545cf7f033c6ac00320cf67401eaf42163a0372edc1d479
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7442
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Streptococcus thermophilus prophage 20617 Mora,D. and Arioli,S. 2005-11 — GenBank