UniProt accession
L0P3P8 [UniProt]
Protein name
Putative host specificity protein
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,93
Protein sequence
MKIITRNDITLTNVYDGSDGKTPYFHTAWSYSADGTDRFTTVYPNLNLLDGTKDFSGNWVGALEGGSDGTYKGLIVQKRIYQWWSLYKEFTIPKDGIYTFSAYVKSSGDNANVCSYLAINGRDASYLMPRWVLGNNFDWFRDSFSVSLKKGDIVYASYYMGGNAKDSALWTAGHKWEEGSVATPWMPSTNEVKTSDYPSYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGERGLTGPQGPKGDRGERGLQGPRGDQGIPGPKGEDGKTQYTHIAYADTESGEGFSQTDVNKPYIGMYQNFNPIDSPNPQDYRWTKWKGSDGKDGIPGKAGADGQTPYFHTAWAYSSDGTDRFTTVYPNLNLFDGTSDKPSTVTGSAWNIKHIGAYKAPKVGQEYTFSVEVPESDHDVLVEVFRCNDDKWGRIDSLFSNRGVKSGEKIHATFTWPEPGNSGATQIVANLAWTNDRDSGTYSYRNAKLEIGNTLTPWMPSASEVTTADYPQYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGERGLTGPQGPKGDRGERGLQGPRGDQGIPGPKGEDGKTQYTHIAYADTESGEGFSQTDVNKPYIGMYQNFNPIDSPNPQDYRWTKWKGSDGKDGIPGKAGADGQTPYFHTAWAYSSDGTDRFTTVYPNLNLFDGTSDKPSTVTGSAWNIKHIGAYKAPKVGQEYTFSVEVPESDHDVLVEVFRCNDDKWGRIDSLFSNRGVKSGEKIHATFTWPEPGNSGATQIVANLAWTNDRDSGTYSYRNAKLEIGNTLTPWMPSASEVTTADYPQYIGTYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGERGLTGPQGPKGDRGERGLQGPRGDQGIPGPKGEDGKTQYTHIAYADTESGEGFSQTDVNKPYIGMYQNFNPIDSPNPQDYRWTKWKGSDGKDGIPGKAGADGQTPYFHTAWAYSSDGTDRFTTVYPNLNLFDGTSDKPSTVTGSAWNIKHIGAYKAPKVGQEYTFSVEVPESDHDVLVEVFRCNDDKWGRIDSLFSNRGVKSGEKIHATFTWPEPGNSGATQIVANLAWTNDRDSGTYSYRNAKLEIGNTLTPWMPSASEVTTADYPQYIGQYTNYMEVDSPNPQDYTWSLIRGNDGKQGPQGERGLTGPQGPKGDRGERGLQGPRGDQGIPGPKGEDGKTQYTHIAYADTESGEGFSQTDVNKPYIGMYQNFNPIDSPNPQDYRWSKWKGSDGRDGIPGKPGADGRTPYVHFAYADSADGRDGFSLTQTGSKRYIGVLTNYYKEDSTNPEDYTWNDTAGSISVGGRNLLVKTNQGVTNWDWEMSNGDKSVEEVNIDDIRAVKLTKGTKTANTGWNFIQYQGLLRKLIRPNTQYTLSFDVKPSVDVSFSATLMRGDYQAELTDTVLMNKALANQWTKVSCVLQSKPIFPDDLSQVVYLSGMPTTNGNWLIIKNIKLEEGNIPTEWTPAIEDIQEEIDSKADAVLTTEQINKLNEEANIIKAEVEAKAKADIVNNWIKDYNDFRKVSERLRVKAEQDLKNAQQRLISLSKNLGELSERWEFVDTYMSASNEGFVIGKQDGSKSIMINPDGGVTMFSAGSKTMTISDGKAEADNGVFKKNLKVGRYIEQPYHLDPDINVIRYVGED
Physico‐chemical
properties
protein length:1647 AA
molecular weight: 182370,86750 Da
isoelectric point:5,03766
aromaticity:0,11293
hydropathy:-0,82726

Domains

Domains [InterPro]
L0P3P8
1 1647
Architecture
STR
STR
STR
STR
STR
STR
STR 7-193 | STR 210-305 | STR 319-608 | STR 628-782 | STR 787-1086 | STR 1091-1647
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage TP-J34
[NCBI]
73422 Uroviricota > Caudoviricetes > Aliceevansviridae > Brussowvirus TPJ34 >
Host Streptococcus thermophilus
[NCBI]
1308 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CCI71981.1 [NCBI]
Genbank nucleotide accession
HE861935 [NCBI]
CDS location
range 33773 -> 38716
strand +
CDS
ATGAAGATAATAACACGAAATGATATAACCCTAACTAACGTTTATGATGGTAGCGATGGTAAAACACCTTATTTCCACACAGCCTGGTCTTACAGTGCAGATGGTACAGATAGATTTACTACTGTTTATCCGAATTTGAATTTGCTTGACGGGACTAAAGACTTTAGTGGTAATTGGGTTGGAGCATTAGAAGGTGGATCTGACGGAACTTATAAAGGTCTAATTGTTCAAAAACGAATATATCAATGGTGGAGTTTATATAAAGAATTTACTATCCCTAAAGATGGAATATATACTTTCTCAGCATACGTTAAAAGTTCAGGAGACAATGCGAATGTATGTTCATATTTAGCTATAAATGGTAGAGACGCTAGTTACCTCATGCCTAGATGGGTCTTAGGAAATAATTTCGACTGGTTTAGAGATAGTTTCTCTGTATCTTTGAAAAAAGGAGACATTGTATATGCTAGTTATTATATGGGAGGTAATGCTAAGGATTCAGCTTTATGGACTGCCGGTCATAAATGGGAAGAAGGTTCAGTAGCCACTCCTTGGATGCCTTCAACAAATGAAGTCAAAACTTCTGATTATCCAAGCTATATCGGTCAATACACAAACTATATGGAAGTAGATAGTCCTAATCCTCAAGACTACACATGGAGTTTGATTAGAGGAAACGATGGCAAGCAAGGTCCACAAGGTGAACGAGGTTTAACCGGTCCTCAAGGTCCCAAAGGTGATAGAGGCGAGCGTGGGTTACAAGGTCCAAGAGGTGACCAAGGAATACCGGGACCAAAGGGTGAAGACGGTAAAACACAATATACCCATATAGCCTATGCTGATACTGAATCTGGTGAAGGTTTTAGTCAAACAGATGTTAATAAACCATACATCGGAATGTATCAAAACTTCAATCCTATTGATAGTCCTAACCCACAAGACTACCGCTGGACTAAGTGGAAAGGTAGCGATGGTAAAGATGGTATTCCTGGTAAAGCTGGTGCTGACGGACAAACGCCATATTTCCACACGGCATGGGCATATAGTTCTGATGGTACAGATAGATTCACCACAGTTTATCCGAATTTGAATTTGTTTGATGGTACTTCTGACAAGCCTTCTACAGTAACAGGTAGTGCTTGGAATATTAAACATATTGGTGCATACAAGGCACCTAAAGTTGGTCAAGAATACACTTTTTCTGTTGAAGTTCCGGAATCCGACCACGATGTTTTAGTTGAAGTGTTTCGTTGTAATGATGACAAGTGGGGGAGAATAGATTCCCTTTTCTCAAATCGGGGAGTAAAGTCTGGAGAAAAGATTCATGCGACATTCACTTGGCCAGAACCTGGAAATAGTGGTGCAACACAAATTGTAGCAAACTTAGCATGGACTAACGACAGAGATTCAGGGACATATTCATACCGTAACGCTAAGCTAGAGATTGGCAACACTCTTACACCGTGGATGCCTTCAGCAAGCGAAGTAACAACTGCTGACTATCCACAATACATTGGTCAATATACGAACTATATGGAAGTAGATAGTCCTAATCCTCAAGACTACACATGGAGTTTGATTAGAGGAAACGATGGCAAGCAAGGTCCACAAGGTGAACGAGGTTTAACCGGTCCTCAAGGTCCCAAAGGTGATAGAGGCGAGCGTGGGTTACAAGGTCCAAGAGGTGACCAAGGAATACCGGGACCAAAGGGTGAAGACGGTAAAACACAATATACCCATATAGCCTATGCTGATACTGAATCTGGTGAAGGTTTTAGTCAAACAGATGTTAATAAACCATACATCGGAATGTATCAAAACTTCAATCCTATTGATAGTCCTAACCCACAAGACTACCGCTGGACTAAGTGGAAAGGTAGCGATGGTAAAGATGGTATTCCTGGTAAAGCTGGTGCTGACGGACAAACGCCATATTTCCACACGGCATGGGCATATAGTTCTGATGGTACAGATAGATTCACCACAGTTTATCCGAATTTGAATTTGTTTGATGGTACTTCTGACAAGCCTTCTACAGTAACAGGTAGTGCTTGGAATATTAAACATATTGGTGCATACAAGGCACCTAAAGTTGGTCAAGAATACACTTTTTCTGTTGAAGTTCCGGAATCCGACCACGATGTTTTAGTTGAAGTGTTTCGTTGTAATGATGACAAGTGGGGGAGAATAGATTCCCTTTTCTCAAATCGGGGAGTAAAGTCTGGAGAAAAGATTCATGCGACATTCACTTGGCCAGAACCTGGAAATAGTGGTGCAACACAAATTGTAGCAAACTTAGCATGGACTAACGACAGAGATTCAGGGACATATTCATACCGTAACGCTAAGCTAGAGATTGGCAACACTCTTACACCGTGGATGCCTTCAGCAAGCGAAGTAACAACTGCTGACTATCCACAATACATTGGTACATATACGAACTATATGGAAGTAGATAGTCCTAATCCTCAAGACTACACATGGAGTTTGATTAGAGGAAACGATGGCAAGCAAGGTCCACAAGGTGAACGAGGTTTAACCGGTCCTCAAGGTCCCAAAGGTGATAGAGGCGAGCGTGGGTTACAAGGTCCAAGAGGTGACCAAGGAATACCGGGACCAAAGGGTGAAGACGGTAAAACACAATATACCCATATAGCCTATGCTGATACTGAATCTGGTGAAGGTTTTAGTCAAACAGATGTTAATAAACCATACATCGGAATGTATCAAAACTTCAATCCTATTGATAGTCCTAACCCACAAGACTACCGCTGGACTAAGTGGAAAGGTAGCGATGGTAAAGATGGTATTCCTGGTAAAGCTGGTGCTGACGGACAAACGCCATATTTCCACACGGCATGGGCATATAGTTCTGATGGTACAGATAGATTCACCACAGTTTATCCGAATTTGAATTTGTTTGATGGTACTTCTGACAAGCCTTCTACAGTAACAGGTAGTGCTTGGAATATTAAACATATTGGTGCATACAAGGCACCTAAAGTTGGTCAAGAATACACTTTTTCTGTTGAAGTTCCGGAATCCGACCACGATGTTTTAGTTGAAGTGTTTCGTTGTAATGATGACAAGTGGGGGAGAATAGATTCCCTTTTCTCAAATCGGGGAGTAAAGTCTGGAGAAAAGATTCATGCGACATTCACTTGGCCAGAACCTGGAAATAGTGGTGCAACACAAATTGTAGCAAACTTAGCATGGACTAACGACAGAGATTCAGGGACATATTCATACCGTAACGCTAAGCTAGAGATTGGCAACACTCTTACACCGTGGATGCCTTCAGCAAGCGAAGTAACAACTGCTGACTATCCACAATACATTGGTCAATATACGAACTATATGGAAGTAGATAGTCCTAATCCTCAAGACTACACATGGAGTTTGATTAGAGGAAACGATGGCAAGCAAGGTCCACAAGGTGAACGAGGTTTAACCGGTCCTCAAGGTCCCAAAGGTGATAGAGGCGAGCGTGGGTTACAAGGTCCAAGAGGTGACCAAGGAATACCGGGACCAAAGGGTGAAGACGGTAAAACACAATATACCCATATAGCCTATGCTGATACTGAATCTGGTGAAGGTTTTAGTCAAACAGATGTCAATAAACCATACATCGGAATGTATCAAAACTTCAATCCTATTGATAGTCCTAACCCACAAGACTATCGTTGGAGCAAGTGGAAGGGAAGCGATGGACGAGATGGTATTCCTGGTAAACCTGGAGCAGACGGACGAACACCTTACGTACACTTTGCTTATGCAGACAGTGCTGATGGACGAGATGGTTTTAGTCTTACTCAGACTGGAAGTAAACGATATATAGGTGTACTTACCAACTACTACAAAGAAGACAGCACTAATCCAGAAGATTATACATGGAATGATACTGCTGGTAGCATTTCAGTTGGTGGTAGGAACTTACTTGTAAAAACCAATCAAGGTGTTACTAATTGGGATTGGGAGATGTCGAATGGTGACAAGAGCGTTGAAGAAGTCAATATCGATGATATTCGTGCTGTTAAATTAACCAAAGGTACAAAAACAGCAAATACTGGTTGGAACTTCATTCAATATCAAGGTTTGTTGCGTAAACTCATACGACCAAACACACAGTACACTCTTTCGTTTGATGTAAAACCAAGTGTTGATGTAAGTTTTTCAGCAACGCTAATGAGAGGCGACTACCAAGCTGAATTGACTGATACTGTCCTTATGAATAAAGCTTTGGCAAATCAATGGACTAAAGTATCATGTGTTCTGCAAAGTAAACCAATTTTTCCAGATGATTTGTCTCAAGTGGTCTACTTGTCAGGTATGCCAACTACTAATGGTAATTGGCTAATAATCAAGAATATCAAGCTAGAAGAAGGCAACATACCTACTGAGTGGACACCCGCCATCGAGGATATACAAGAAGAGATTGATTCCAAAGCGGATGCTGTTTTGACAACTGAACAGATTAATAAACTAAACGAAGAAGCCAATATTATTAAAGCCGAGGTAGAAGCCAAAGCTAAAGCTGACATCGTGAATAACTGGATTAAAGATTACAACGATTTTCGTAAAGTAAGCGAAAGACTTCGTGTTAAAGCAGAGCAAGATTTGAAAAATGCTCAACAGCGTTTGATATCACTAAGTAAAAACTTAGGTGAGCTATCAGAACGTTGGGAATTTGTTGACACATACATGAGTGCATCGAACGAAGGATTTGTGATTGGTAAACAAGATGGAAGCAAGAGCATCATGATTAATCCGGACGGTGGCGTAACGATGTTTAGTGCAGGTAGTAAGACAATGACTATTTCTGATGGTAAAGCTGAGGCAGACAATGGTGTTTTCAAGAAAAATCTTAAAGTTGGGCGATATATTGAACAACCATATCACCTTGACCCAGATATTAATGTAATACGATACGTAGGAGAAGATTAA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0031012 extracellular matrix Cellular Component IEA:TreeGrafter (UniProt)
GO:0005615 extracellular space Cellular Component IEA:TreeGrafter (UniProt)

Tertiary structure

PDB ID
073217a69c4cc1c4d5259f5b67d6be52de70e213cc931ee5c38a4b740652ac87
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,7569
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50