Genbank accession
QBX31199.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,67
TF
Evidence RBPdetect2
Probability 0,91
Protein sequence
MRIAIRDTTDSHTVGFFDNKAGIKFNSAEMTQFLKGACSFVTIKYRSKDAEKVRAGCKLAFRHKGKDYWLTINEFNKQGTEVEITAYSLSLEANKEKRGAYKASSAMPIVDYFSVFDPEKSFEIGINEVSDKKLTLEWTGTDTVLARLYSIANSFDAELEFVTELNPNYSLKRHVVNIYRSGNLGGDSTGRPVRVGTELKVLGFNSNINDLYTAIDVTGKDGLKLPDKTIKDSKGEVQFFSKNGRLYAPQARDKFPSNKANVNDGYILAEAKTTDYTNQEALFGYALSEMKKHCDVQVEYSTEGAVKGSVGDTKTLIDSINFEPALYVQARITEQTEDLETGKSLKTTFSNFKRTSSQLSSDLTKKIEELAKSAVPYRIVMVTSNGTSFKNGAGQSIVSPKLFKGDAEITDATYRFNFNNNTVAGLNYTVNASAVNGTSVLKIDAYVGNDAVASDELTFINVNDGSKGADGNGIASSVIAYQAGTSATVAPTGTWSSSPVSVPAGQFLWTRTIFTYTDTTTKTIYNVSRQGADGISGKDGNGIASTTVSYGTSTSSTTQPSTWTSTIPTVPAGQYLWTRTITDYTDASVPDTISYTYAKQGVDGAKGDQGVAGTSVKVSKIEYQAGTSATTAPTGTWSTTIVSAPAGQYLWSKTTMSDNSIIYGIARQGADGANGKDGQIPHIAYADKSTDVLVDAMQTLGNPWFYSGATGTVSPISGGYKYTTAGGTHQMKQVITFNGTTGKNVYTYVVIKNTHPTNDLVINFNGLGAVLNGGFANVTVKPGQTYVDYRPAVCRDTYDFVQINILATVIANDLSYEIYDYAIYNTNPFINFSFASNGLNSHIGMYQDTNTVGSTDPSKYAWTLIKGQKGDQGLPGAPGADGKTPYWHVAYANNATGTLDFSLSDSSGRKFRGEYVDYVLADSTDPTKYKWLDMTANVKAGNNNLLVNTKTLANNYFVANNTSETYLGGTVATGIAPSGSYRDTYRQAMKIAPEGNEFIVSFYAKSSIDNVTINNHFYSPNRTIKGISSTGALFNSVSGGDGLIAIKLTTQWKRYWIKWTIRGASSEAENVPMTVILGRNFDSVNSVSIALPAMYAGNLNTEHSDAPEDVQAVIDANQALTQAQMLALEERSALARDNAIAEAMKNTISEVEAKWQTWYNLNTADEKQKVANDIASLFERVAKFEQNLGEASARFEFINNETLIGEEGVAIGDKEGKAKLFLSNDSISFVTNGVAQMTLTGDTLTIKNGLFTERIQIGNYVEEVYDRNPLYNVIRPIKYS
Physico‐chemical
properties
protein length:1280 AA
molecular weight: 138979,05550 Da
isoelectric point:5,68688
aromaticity:0,10156
hydropathy:-0,34070

Domains

Domains [InterPro]
DC_0690
STR
3–618
IPR010572
ENZ
120–359
QBX31199.1
1 1280
Architecture
STR
STR 3-1280
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QBX31199.1
1 1280
Domain Start End Length (AA) Confidence
N-terminal 1 677 677 0,9902
Central domain 678 964 288 0,5243
C-terminal 965 1280 315 0,1737
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-677
Central
678-964
C-terminal
965-1280

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage Javan626
[NCBI]
2548286 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Streptococcus uberis C5072
[NCBI]
1450182 Bacillota > Bacilli > Lactobacillales > Streptococcaceae > Streptococcus > Streptococcus uberis

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QBX31199.1 [NCBI]
Genbank nucleotide accession
MK448995.1 [NCBI]
CDS location
range 32551 -> 36393
strand +
CDS
GTGAGAATTGCAATCAGAGACACAACCGATAGTCACACTGTCGGTTTTTTTGATAATAAAGCAGGCATCAAATTCAACTCAGCAGAGATGACTCAGTTTTTAAAAGGTGCTTGTAGCTTTGTCACAATTAAGTACCGGTCAAAAGATGCTGAAAAAGTGAGAGCTGGATGCAAGCTAGCCTTTAGACATAAAGGTAAAGACTACTGGTTAACAATCAATGAGTTTAACAAACAGGGTACTGAGGTTGAAATCACTGCGTACTCATTGAGTCTTGAGGCTAACAAGGAAAAGCGTGGTGCTTACAAGGCGTCTAGTGCCATGCCAATTGTTGATTACTTCTCAGTTTTTGACCCTGAAAAATCCTTTGAAATTGGGATTAATGAGGTCTCAGATAAGAAGTTAACTCTGGAGTGGACTGGAACCGATACGGTCCTTGCAAGGCTCTACTCAATAGCTAACTCATTTGACGCAGAGCTTGAGTTCGTCACAGAGCTAAATCCAAACTACTCTCTTAAGCGTCATGTTGTTAACATCTACCGCAGTGGGAACTTGGGCGGAGACTCGACAGGTAGGCCAGTTAGAGTTGGAACAGAGCTTAAGGTTTTAGGATTTAACTCAAACATTAATGATCTCTACACTGCGATTGATGTTACTGGTAAAGATGGGCTCAAGCTGCCTGACAAGACAATCAAGGACTCTAAGGGAGAAGTTCAGTTTTTTAGTAAAAACGGCCGTCTCTATGCACCTCAAGCAAGAGATAAGTTCCCTTCTAACAAGGCTAACGTGAACGATGGTTACATCTTAGCAGAGGCTAAGACAACAGATTACACGAACCAGGAAGCACTTTTTGGCTACGCACTGTCAGAAATGAAAAAGCACTGCGATGTTCAAGTTGAGTATTCGACGGAAGGAGCGGTCAAGGGTTCTGTTGGCGATACAAAAACACTGATTGACTCTATCAACTTTGAGCCGGCTCTTTACGTACAAGCTCGCATCACAGAACAGACTGAGGACCTTGAGACGGGAAAAAGTCTCAAGACAACCTTCTCAAACTTCAAGAGAACATCAAGTCAGTTGTCAAGCGATCTGACAAAAAAGATCGAAGAACTTGCTAAGAGTGCAGTACCATACCGAATTGTGATGGTTACTTCCAACGGCACGTCGTTTAAAAATGGCGCTGGCCAATCAATTGTTAGCCCTAAATTATTTAAAGGTGATGCTGAAATCACAGATGCAACCTACCGTTTTAACTTTAACAACAACACAGTTGCTGGTCTCAACTATACAGTTAATGCGTCAGCGGTAAATGGCACATCTGTACTCAAGATAGACGCTTACGTTGGCAACGATGCCGTAGCAAGTGATGAGTTAACATTTATCAACGTTAACGATGGTTCAAAAGGCGCTGACGGCAACGGCATTGCATCATCTGTAATTGCTTATCAGGCTGGCACTAGTGCGACAGTTGCACCAACAGGCACTTGGTCATCAAGTCCCGTCTCAGTACCAGCGGGTCAATTTTTGTGGACACGAACCATTTTTACTTATACTGACACGACGACCAAGACGATCTATAACGTGTCAAGACAGGGTGCAGACGGTATCTCAGGTAAGGATGGAAATGGCATCGCTAGCACAACAGTGTCTTACGGAACATCAACATCATCAACAACTCAGCCGAGCACTTGGACAAGTACAATTCCGACAGTACCAGCTGGACAGTATTTATGGACTCGGACAATAACCGATTACACTGATGCAAGTGTACCTGACACGATTTCCTACACTTATGCAAAACAGGGTGTTGATGGAGCTAAGGGTGATCAGGGAGTTGCTGGAACCTCGGTTAAAGTATCGAAAATTGAGTATCAGGCAGGCACATCAGCAACCACAGCGCCAACTGGCACTTGGTCAACGACAATAGTCTCAGCGCCTGCTGGTCAATATCTATGGTCGAAAACAACCATGAGTGATAACAGCATCATCTATGGTATAGCTAGGCAGGGAGCGGACGGTGCAAATGGTAAAGATGGCCAAATACCTCATATCGCTTACGCTGATAAGTCAACAGATGTTTTAGTTGATGCAATGCAGACGCTTGGAAATCCTTGGTTTTACAGTGGAGCAACTGGTACGGTTAGTCCGATTTCAGGCGGGTATAAATACACGACGGCTGGCGGAACGCATCAAATGAAACAAGTAATAACATTTAACGGTACAACAGGAAAAAACGTGTACACGTATGTTGTTATAAAAAACACTCATCCAACCAATGATTTAGTTATTAATTTTAATGGGTTAGGTGCGGTGCTCAACGGTGGTTTTGCAAATGTTACGGTAAAGCCAGGCCAAACATATGTTGATTACAGACCTGCGGTTTGTCGTGATACTTATGATTTTGTACAAATTAACATTTTAGCTACTGTAATCGCCAACGACTTATCATATGAGATTTATGATTATGCGATATACAACACAAATCCATTTATCAATTTCTCATTTGCTAGTAATGGTCTAAATTCCCACATTGGAATGTATCAAGATACAAACACAGTCGGAAGTACAGACCCATCAAAATATGCATGGACATTGATTAAAGGACAAAAGGGTGACCAAGGATTGCCTGGCGCCCCTGGTGCTGATGGTAAAACACCTTATTGGCATGTTGCGTATGCAAATAATGCAACTGGTACATTGGATTTTAGTCTATCGGACTCATCAGGTAGAAAATTTAGAGGTGAGTATGTTGACTATGTACTAGCGGACTCAACTGATCCAACTAAATATAAGTGGTTAGATATGACTGCGAATGTTAAGGCTGGAAACAACAATTTGTTGGTTAACACAAAAACGTTGGCCAACAACTATTTTGTAGCTAACAACACATCAGAAACCTACTTAGGTGGTACGGTTGCGACAGGAATTGCACCGAGTGGATCATATAGAGACACTTATAGGCAAGCTATGAAAATAGCACCAGAAGGCAACGAATTCATTGTTTCATTCTATGCTAAGAGTTCTATTGATAATGTCACAATCAACAATCATTTTTATAGTCCGAACCGAACAATAAAAGGAATTTCTAGTACAGGTGCATTATTCAATAGTGTCAGTGGTGGAGATGGGCTGATTGCCATCAAACTAACCACTCAATGGAAACGATACTGGATAAAATGGACAATTCGCGGCGCAAGTTCAGAGGCCGAAAATGTGCCAATGACTGTAATTTTAGGCCGTAATTTTGACTCAGTTAACAGCGTGTCTATCGCATTACCGGCAATGTACGCTGGCAATCTTAACACAGAGCACTCAGATGCACCTGAAGATGTCCAAGCGGTTATTGATGCTAACCAAGCATTAACCCAAGCGCAGATGCTGGCGCTTGAGGAACGCTCAGCACTTGCAAGAGACAACGCAATTGCCGAGGCAATGAAGAACACAATCAGCGAAGTTGAGGCCAAATGGCAAACTTGGTACAACCTCAATACCGCAGACGAAAAACAAAAAGTTGCTAATGACATAGCATCCCTTTTTGAACGAGTGGCCAAATTTGAACAAAATTTGGGTGAGGCAAGTGCTAGGTTTGAATTTATCAACAATGAAACCTTGATTGGTGAAGAGGGTGTTGCAATTGGTGACAAAGAGGGCAAAGCTAAGCTTTTCTTGTCAAACGATAGCATTTCATTTGTAACAAACGGCGTCGCTCAAATGACATTGACAGGTGACACGTTAACAATCAAAAATGGTTTGTTCACGGAACGCATTCAAATTGGGAATTACGTTGAGGAAGTCTATGACAGAAATCCACTATACAACGTGATTAGACCAATTAAATATAGCTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
d060cec5544200569042f959a0941a0be3540e0fb8aba5107a5d459c9862b74f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7007
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Prophages and satellite prophages are widespread among Streptococcus species and may play a role in pneumococcal pathogenesis Rezaei Javan,R., Ramos-Sevillano,E., Akter,A., Brown,J. and Brueggemann,A.B. 2018-12-20 GenBank