Genbank accession
UYL94074.1 [GenBank]
Protein name
putative tail fiber protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MLVVTNLQGQTEALTDYKDLTRKWRVNGERSLSFLLFKTERNAHAFDLVQEESVVEYDGHEYRIKQLEERAIGNTPVKQVRADHIFFDIIDVYQYNTISGTKTISEALSFALNGTGWTFVVVGSFSTVQFENFGDDNAAALFQKILESYGAEFDITGNEVRIYNQIGANTDFQFRYRHNIKTLEKIVKTDNLSTYIKGYGKRNDDGTYVATAEYTSPMAAIFGIRHAKPVYDERFTNNESLLEYIKSKLQDTPEISITIDFVDLAKAGYPLPRPRLGDTVYLIYEPLNIDITTRILEITDYPESNRSPEVTLANFKESFADVSIRYTKSQIEKIYNEQTGRIRYTALDEAVKQATEALQSAQTELKFENGIIAIDKNDPNNIVLFNSAGIGISDDGGQTFKTAMTGSGIVADVITSGALNTNNIVVGNNKIRVDNNGLYVYKNNIMGASLVEGNLTFFDQTNAKKIGMFAATVWSDGVTKGISMNMEHDRYISFGHYLNPTVGYTPMLVLNPGTAMDGVPQGIVSNLPFRANADMWLGANALRFGLTNTHNHSALWHDANNNLAIASYTGIRLAYLTSGGVANDRLTVDENSVDVWQDLDLHGWRLLRVDEADFMSTARIAHDNDAIYIQHNGEVRATQYKSATYVPVRASSFPTGSLAEYKQDIHVWEESALEKIRNATIYEYRLKSEVEEGKGRWRQGLVIGEGYNTPEGVIDGDGVEQYLMNTWSWKAIQELADEIDRLKQEIENLKGGEAKQLQEAE
Physico‐chemical
properties
protein length:761 AA
molecular weight: 85383,38580 Da
isoelectric point:4,99537
aromaticity:0,10118
hydropathy:-0,38200

Domains

Domains [InterPro]
DC_0904
STR
5–758
IPR007119
Unmapped
26–308
UYL94074.1
1 761
Architecture
ATT
STR
ATT 1-82 | STR 83-758 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
UYL94074.1
1 761
Domain Start End Length (AA) Confidence
N-terminal 1 434 434 0,9613
Central domain 435 633 200 0,7927
C-terminal 634 761 127 0,9803
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-434
Central
435-633
C-terminal
634-761

Taxonomy

  Name Taxonomy ID Lineage
Phage Geobacillus phage vB_GthS_PK5.1
[NCBI]
2985566 No lineage information
Host Geobacillus thermodenitrificans
[NCBI]
33940 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UYL94074.1 [NCBI]
Genbank nucleotide accession
OP341628 [NCBI]
CDS location
range 13220 -> 15505
strand +
CDS
ATGCTCGTTGTTACGAATTTGCAAGGGCAAACAGAAGCATTGACGGATTATAAAGACTTAACCCGGAAATGGAGAGTGAACGGAGAGCGTTCTCTCTCTTTTCTTTTGTTCAAAACCGAACGGAACGCCCATGCATTTGACCTCGTGCAAGAGGAATCCGTTGTTGAATATGACGGGCATGAATACCGTATCAAACAGTTAGAAGAACGGGCAATCGGAAATACACCTGTTAAACAAGTGCGAGCCGATCATATTTTCTTTGACATTATTGACGTGTATCAATACAACACAATCAGCGGCACAAAAACCATTAGTGAAGCCTTGTCGTTTGCGCTGAACGGAACAGGATGGACGTTCGTTGTCGTCGGGTCATTCAGCACGGTACAATTTGAAAATTTTGGTGACGACAATGCCGCCGCTTTGTTTCAAAAAATCTTGGAATCGTATGGAGCCGAATTTGATATAACCGGAAACGAAGTCCGTATTTACAATCAGATCGGCGCCAACACTGACTTCCAATTCCGTTATCGCCACAACATCAAAACGCTTGAAAAGATCGTAAAAACAGACAACCTGTCCACATACATCAAGGGATACGGCAAACGAAACGACGACGGAACCTATGTAGCTACAGCCGAATACACAAGCCCGATGGCTGCCATTTTCGGGATTCGGCACGCGAAACCGGTATATGATGAACGTTTCACGAATAACGAATCTTTGCTCGAATACATCAAATCCAAGCTACAAGACACGCCGGAAATCTCAATCACGATTGACTTTGTAGACTTGGCAAAAGCAGGATATCCTTTGCCACGTCCACGACTTGGCGATACCGTATATCTCATTTACGAACCGTTAAACATCGACATTACAACACGGATATTAGAAATTACCGATTACCCGGAATCGAATAGATCACCGGAAGTGACGCTTGCGAATTTCAAAGAGAGTTTTGCTGATGTATCCATAAGATACACAAAGTCGCAAATCGAAAAAATTTACAACGAGCAAACCGGAAGGATTCGCTACACCGCGCTAGACGAAGCGGTCAAACAAGCGACAGAAGCATTACAAAGCGCCCAAACAGAATTAAAATTCGAAAACGGAATCATCGCGATAGATAAAAACGACCCAAACAACATTGTATTGTTCAATTCTGCCGGAATCGGTATATCAGACGACGGCGGGCAGACATTTAAAACAGCGATGACCGGAAGCGGAATTGTGGCGGACGTCATTACAAGTGGCGCGCTCAATACAAACAACATCGTGGTCGGAAACAACAAAATCCGCGTGGATAACAACGGCTTATATGTTTATAAAAACAACATCATGGGCGCGTCCCTTGTCGAAGGAAACTTGACATTTTTTGATCAAACAAACGCCAAAAAAATCGGGATGTTCGCCGCCACCGTTTGGTCAGACGGCGTGACGAAAGGCATCTCAATGAACATGGAGCACGACCGGTATATCTCGTTTGGTCACTACCTCAACCCCACGGTGGGTTACACACCTATGCTTGTTCTTAATCCGGGCACGGCGATGGATGGAGTGCCGCAAGGAATCGTTTCAAACCTTCCTTTCCGCGCTAATGCTGATATGTGGCTAGGGGCGAACGCTCTGCGCTTTGGTTTAACCAACACACATAACCATAGCGCATTGTGGCACGACGCGAACAACAACCTAGCGATCGCAAGCTATACCGGCATTCGTCTTGCTTATTTGACGTCAGGTGGCGTAGCGAACGACCGGTTGACGGTGGACGAGAACAGTGTGGACGTATGGCAAGACTTAGACCTGCATGGTTGGAGATTGTTGCGCGTTGACGAAGCCGACTTCATGAGCACAGCGCGTATTGCGCATGACAACGATGCGATCTATATACAGCACAATGGCGAGGTACGAGCGACACAATACAAGTCAGCAACGTATGTGCCTGTTCGTGCATCGTCATTCCCTACGGGATCGTTGGCGGAGTACAAACAAGATATCCATGTGTGGGAAGAATCGGCGCTTGAGAAGATTAGAAACGCGACAATTTATGAATATCGACTCAAATCGGAAGTGGAGGAGGGGAAAGGACGTTGGAGACAAGGACTTGTTATTGGTGAAGGATATAACACGCCGGAAGGAGTGATTGATGGCGACGGGGTCGAACAGTACCTCATGAACACATGGAGCTGGAAGGCGATTCAGGAGCTGGCTGATGAAATTGATCGTCTGAAACAAGAAATTGAAAACTTGAAAGGCGGAGAAGCTAAACAGTTACAAGAAGCTGAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
99ddf78eabd96f72bce896de5da9ecfe0123dcf87cc84b0f18d22e40a8d5081c
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8007
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequence of Geobacillus bacteriophage vB_GthS_PK5.1 Simoliunas,E., Simoliuniene,M. and Kvederaviciute,K. — — GenBank