UniProt accession
A0A0A0YV37 [UniProt]
Protein name
Tail fiber PblB-like protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MLYLLESDTRNVKWNGIPLHEATTAIIKEQMNGDFILTVRYPITDSDIYQLFREDMLIKAPAPVIGPQLFRIKKPVENDDHLEITAYHITDDVMQRSINPLSVNKQSCWQALSQLVQVAKSPINDFSFTSDITDRRTINTKEVETLYSVLMDGAHSIVGTWEGEMVRDNFAISIKRNRGEDRGVIISTHKNLKSYQRTKNSQNVVTRIHAKSTFKAEGAKEDTTIAITIDSPLIGAYPYINERSYTNNNIQTVDELTKWASAKFTNEHIDKATDAIKIEAYELDGQTVHMGDIVNLKSYKHNVDVYKKAIAYEYDCLANNGQGAYLTITFDDKVKSGGNGGGLSAVANAILDKQETQFDIMLERAIANADRAFDAEFKKRKKEIDDGIELAKAKAEEVKQELSDTINQRFNSFDNGPLQEVKRKAEEALKNAGASSLLAQEAKQIGLDSVARLEAFKSQTTSAQTALSGDLDALKRTIANDIRPKQAQAEAEIAKQVEALVQTKKELAGVKSAQATYEETTTRRLAELTNLANGKASKSELTQTAEELSSKIASVQAGSSRNYFRNSRSRIFTTGDQAVYDYRTFIVPDFWKNSDRLKRNYVRISFDVAFPIALARDTQANVHFSASPWYGYKLTFKGGTTERQHFEFTIDLSSSSENYQTNNVFIRFGTNYGFPADLQVVIENAMLSVGNYFPTYQSAYEDQEDRVSTVESSFKQRADALDAGVSRLTEGLRTKADISSLNVTAENIRQSVKSLETNTQNKLDQKLSMAEFEVQAGSIRQEILNATKDKADKTLVVAEAGKLREELASQVGSGRNLWINSKILGNPVIEPLPDGHITGQKQCYKLTNNQEITFNIEPDFSSRLFRKVTFSAWVKYENVVKGANDWNRFNCFKHYMFFRNSQTGNISGANRPTLAILEGSSDWKRIVFTYDYSMNKGYDQLKTTLRFNLESVKSGVAWIAGIQVEFGSVATDWSPAPEDVDGLITEAKATFERTAQGLRTDLSAIQEYVNKDGQRQEALQRYTREESARQATAVRELVTSNYVGKATYQEDVKGINQKIEAVKTSANKEIASQIASYRQSVDGKFTDISSQITTYKQDVGGQISGLSNRLTSSEQGTTTQISNLSNRINSNKQGTDNQISNLTTQVATNKDNAERQMGRISDQVSANKANADSQFANVSNQLARKVETTDFQRVKETSQLYERIIGTTEDSIADKVARMALTNQLFQVEVSKNEGLKTVQRQLADSWSVQHINSAGDIISGINLGADGRNRFIGKTFHITGETLIDNAVIKSAMVDKLKTANFEAGSVTTTILDAEAVTADKLKVDFALVRKLTANDAFIEQLTSKRIFSAKVESVVSSSTFLEAYQGRIGGFTLGQFDYGGGRWISGVNQFSVGMGNGAGYGVKTAFWANWGNSWDYAGPKAWYVNTDGKMYCRNEAGFYDQVDFSNSSSANFYGNTTFSRSPVFSNGIELGSKDVFGDGWNPKGGRNAVVWWNQVGSGSVKYWMDQESDRRLKENITDTAVKALNKINRLRMVAFDFIESKKHEEIGLIAQEVETIVPRIVSRDPENPDGYLHIDYTALVPYLIKAIQELNQKIEKWRKQ
Physico‐chemical
properties
protein length:1602 AA
molecular weight: 178820,71290 Da
isoelectric point:6,40015
aromaticity:0,08801
hydropathy:-0,51454

Domains

Domains [InterPro]
DC_1274
ATT
3–619
IPR010572
ENZ
100–333
DC_0976
RBD
1560–1602
A0A0A0YV37
1 1602
Architecture
ATT
STR
STR
RBD
ATT 3-619 | STR 722-1048 | STR 1082-1571 | RBD 1572-1602
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage SpSL1
[NCBI]
1566990 Uroviricota > Caudoviricetes > Mcshanvirinae > Adrianbuildvirus SpSL1 >
Host Streptococcus pneumoniae
[NCBI]
1313 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AIX12926.1 [NCBI]
Genbank nucleotide accession
KM882824 [NCBI]
CDS location
range 11408 -> 16216
strand +
CDS
TTGCTTTATTTACTTGAAAGTGATACTCGTAACGTTAAATGGAACGGTATTCCACTGCATGAAGCGACTACAGCAATCATAAAAGAGCAAATGAACGGGGATTTTATCCTTACTGTTCGCTACCCTATCACGGACTCTGATATTTATCAGCTTTTCCGTGAAGATATGTTGATAAAGGCACCAGCTCCTGTGATTGGGCCTCAGTTGTTCCGCATCAAGAAGCCAGTAGAGAATGATGATCATTTAGAAATCACTGCTTATCATATCACTGATGATGTCATGCAGCGGTCTATCAATCCTCTGTCTGTCAACAAGCAGAGTTGCTGGCAGGCTCTTTCTCAATTGGTACAAGTTGCTAAGTCTCCTATCAATGATTTTTCATTTACCAGTGATATCACAGACAGGAGAACCATCAACACAAAAGAAGTAGAAACACTCTACAGCGTGTTAATGGATGGCGCTCACTCAATTGTGGGAACATGGGAAGGAGAGATGGTTCGGGATAATTTTGCTATCTCAATTAAGCGAAATCGAGGAGAGGACAGAGGTGTTATCATCTCTACCCACAAAAACCTTAAATCCTATCAACGAACCAAAAACTCACAAAATGTTGTTACTCGGATCCATGCTAAGTCTACATTTAAGGCAGAGGGGGCCAAGGAAGATACAACGATTGCCATAACGATTGATAGTCCCTTAATTGGTGCCTACCCTTACATCAACGAAAGAAGTTATACAAATAACAACATTCAGACCGTTGATGAGTTGACAAAGTGGGCTAGCGCTAAATTTACTAACGAACACATAGATAAGGCTACAGATGCCATCAAGATTGAAGCCTATGAACTTGATGGGCAAACTGTTCACATGGGCGATATAGTCAACCTGAAAAGTTATAAGCACAATGTGGACGTTTATAAGAAAGCAATTGCCTATGAATATGACTGCTTAGCAAACAATGGACAGGGAGCTTATCTGACCATTACCTTTGATGATAAAGTGAAATCAGGGGGGAATGGTGGCGGATTGTCAGCAGTAGCAAACGCAATCTTGGACAAGCAAGAAACACAATTTGACATTATGCTGGAACGTGCAATCGCAAACGCTGACCGTGCGTTTGATGCTGAGTTCAAAAAGCGTAAAAAAGAGATAGATGATGGTATCGAACTTGCCAAGGCCAAGGCAGAAGAAGTTAAGCAAGAACTATCTGACACTATCAATCAGCGTTTCAACAGCTTTGACAACGGCCCATTACAAGAAGTCAAGCGTAAGGCTGAGGAAGCCTTGAAAAACGCTGGCGCAAGTAGTTTGCTAGCCCAGGAAGCCAAGCAGATTGGTCTGGACTCTGTTGCTAGACTTGAAGCGTTTAAGTCACAGACTACGAGCGCTCAGACGGCTCTGTCAGGTGACTTGGACGCTCTGAAACGGACTATCGCGAATGATATTCGACCGAAGCAGGCGCAGGCTGAAGCTGAGATTGCCAAGCAAGTTGAAGCACTTGTTCAGACAAAAAAAGAACTGGCTGGTGTGAAGTCAGCGCAAGCGACGTACGAAGAGACAACGACTCGTAGGTTGGCAGAGTTGACCAACTTGGCCAATGGTAAAGCCAGTAAGTCAGAACTCACGCAGACAGCCGAAGAGCTGTCTAGTAAAATAGCGAGTGTGCAGGCAGGTAGTTCACGGAATTACTTCAGGAATTCGCGTTCAAGAATATTTACGACAGGAGATCAAGCGGTATACGACTATCGAACATTCATAGTTCCAGATTTCTGGAAGAACAGTGACAGGCTCAAGCGTAATTATGTCCGCATATCTTTTGATGTGGCTTTCCCTATCGCACTAGCCAGAGATACACAAGCTAACGTGCATTTTAGCGCTAGTCCATGGTATGGCTACAAACTCACATTTAAAGGTGGAACTACTGAACGCCAACATTTTGAGTTTACGATTGATCTGTCTAGCTCTTCAGAGAACTATCAGACTAACAATGTCTTTATTCGTTTTGGGACGAATTACGGCTTTCCAGCTGATTTGCAGGTCGTCATCGAGAACGCTATGTTATCGGTTGGCAATTATTTCCCAACCTATCAATCAGCGTATGAAGACCAAGAAGACCGTGTCTCAACCGTTGAATCTAGCTTCAAGCAAAGAGCTGATGCGCTTGACGCTGGGGTGAGCCGTCTTACTGAAGGGTTAAGAACCAAAGCGGATATCAGCTCACTCAACGTGACTGCTGAGAATATCAGGCAGTCCGTGAAGAGTCTTGAGACAAATACGCAGAACAAGCTGGATCAGAAATTGAGCATGGCTGAATTTGAAGTGCAGGCTGGCTCAATTCGTCAGGAAATCCTGAACGCAACCAAGGACAAGGCAGATAAGACCCTAGTTGTGGCTGAAGCTGGGAAATTGCGAGAGGAGTTGGCAAGTCAAGTTGGCAGTGGTCGGAATCTTTGGATCAATTCAAAGATTTTGGGCAATCCAGTGATTGAACCTCTACCTGACGGACACATAACAGGGCAGAAACAATGCTACAAGCTAACCAATAATCAAGAAATAACCTTTAACATCGAGCCAGACTTCAGCTCTAGGTTATTCCGAAAAGTAACATTCAGCGCATGGGTCAAGTATGAGAATGTTGTCAAAGGCGCTAATGATTGGAATCGTTTTAACTGCTTCAAGCATTATATGTTCTTTAGGAATAGTCAGACAGGAAACATAAGTGGTGCTAATCGCCCCACACTAGCTATTTTAGAAGGTTCGTCTGATTGGAAACGCATCGTATTTACTTATGATTACAGTATGAACAAGGGCTACGACCAACTAAAAACCACTCTTAGATTCAATCTTGAGAGTGTTAAAAGTGGTGTGGCTTGGATTGCTGGTATTCAAGTTGAATTCGGTAGTGTAGCAACTGACTGGTCTCCTGCTCCTGAGGATGTTGATGGCCTCATCACTGAAGCCAAGGCTACCTTTGAGAGGACAGCTCAGGGATTGCGAACTGATTTATCAGCTATTCAGGAATATGTCAATAAAGACGGTCAGCGACAGGAAGCCTTGCAGCGTTACACTCGAGAAGAGAGTGCGAGACAAGCGACGGCTGTACGGGAGTTGGTAACGAGTAATTATGTCGGCAAAGCGACTTACCAAGAAGATGTGAAGGGTATCAATCAGAAGATTGAAGCTGTTAAAACTAGTGCGAATAAAGAAATCGCTAGTCAAATCGCAAGCTATCGTCAATCTGTAGATGGTAAGTTCACGGATATTTCAAGTCAGATAACTACTTATAAGCAAGATGTGGGCGGTCAAATCAGTGGTCTATCAAATAGACTTACAAGCAGTGAGCAAGGAACTACTACTCAGATTTCGAATCTTTCAAATCGGATAAACAGTAACAAACAAGGCACAGATAATCAGATTTCAAATTTAACTACTCAGGTCGCTACAAACAAGGATAATGCTGAACGACAAATGGGTAGAATATCTGATCAGGTTTCTGCAAACAAAGCAAATGCTGATAGTCAATTTGCGAATGTGAGCAATCAACTAGCACGAAAAGTAGAGACTACTGACTTCCAGCGTGTCAAAGAAACCAGCCAACTCTATGAGCGGATTATTGGTACAACTGAAGATAGTATTGCAGATAAGGTCGCTCGCATGGCTCTGACCAATCAACTGTTCCAGGTTGAGGTATCTAAGAATGAAGGTCTGAAAACCGTTCAAAGGCAGCTTGCTGATTCATGGTCTGTTCAACATATCAACTCAGCTGGAGATATCATCTCAGGAATCAATCTGGGTGCTGACGGTCGAAATCGATTTATAGGAAAAACGTTTCATATAACTGGTGAAACCTTGATTGATAATGCAGTCATCAAGTCAGCCATGGTTGATAAGCTGAAAACGGCCAATTTTGAAGCGGGTTCCGTCACGACTACGATTTTAGACGCTGAAGCGGTTACGGCTGATAAGTTGAAAGTTGATTTCGCACTCGTTAGAAAACTCACTGCGAATGATGCATTCATTGAGCAACTGACTTCTAAACGTATCTTTTCTGCTAAGGTTGAATCTGTCGTATCTAGCTCAACATTCCTAGAAGCTTACCAAGGTCGAATCGGTGGATTTACACTTGGTCAATTTGACTATGGGGGTGGTCGCTGGATTTCTGGTGTCAATCAGTTCTCTGTTGGTATGGGGAATGGCGCTGGTTATGGAGTCAAGACAGCCTTCTGGGCTAATTGGGGCAATAGTTGGGACTATGCAGGACCTAAAGCATGGTACGTAAATACCGATGGAAAAATGTACTGTAGAAATGAAGCCGGTTTTTATGATCAAGTAGACTTTTCGAATTCATCGAGTGCAAACTTTTATGGGAATACTACTTTTTCTCGTTCTCCTGTATTTTCAAATGGTATCGAACTTGGAAGTAAAGACGTCTTTGGTGATGGTTGGAATCCTAAAGGTGGAAGGAATGCGGTTGTTTGGTGGAATCAGGTCGGTAGTGGTAGCGTGAAGTATTGGATGGACCAAGAATCAGACAGACGCTTAAAAGAGAACATCACAGATACAGCTGTGAAAGCCTTGAACAAAATCAACAGATTAAGAATGGTTGCATTTGATTTCATCGAAAGTAAGAAACATGAGGAAATCGGTCTAATAGCTCAAGAGGTTGAAACCATTGTTCCAAGAATTGTCTCACGAGATCCTGAGAATCCAGATGGCTATCTGCATATAGACTATACCGCTTTAGTGCCTTACTTAATCAAGGCCATTCAAGAGTTAAATCAAAAAATAGAAAAATGGAGAAAACAATAG

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0098015 virus tail Cellular Component IEA:UniProtKB-KW (UniProt)

Tertiary structure

PDB ID
c8479b08ae55a488409a8b313b4709c1d061c1ab97d625e95f0c605ea382f76b
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,6633
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50