Genbank accession
BDX35468.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,61
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MKRRVWGPYQNITKDDLNDIGSFAQEAVEMALAAINPPARLSGLQATAISSNTVKVTSGWMVVYDSTVGRPRLGVLAGDTNLTVSGAAGTYLVVATVSEQDLETRTVAPPPRTLPNGNPNPFYDPNLNPYNQVVLKGWRVSLSLKAGGYTPANREAVVAQVVWDGSAITGVTQVLDWPKPVLADKSIPAIKIADDVAGSGLSRNASGGLQVNVDNSTIEITSNSLRVKDGGISDTKLGNRTISDTTVPSSNTGPLTALLSGLANRIKAITGESDWKSNPATTLAELNANAPRKSNNETITGAWTFTGGITITKPTAGANANIARISFPAAGGNDPAYIEHRETTTDVAELRISISDNDGHPNDRLYIGSTFGGVWKPRVAIDTAGKFYWGDGGGTFDTELYRSGAGKLSTSGTLTVSGNLGVGTTSPSYKLDVKGSIRADGHAMQLILAEYGTDKWHLESVGGVLRVVQTGVDFAADFTTSGQLRVYPRASQGIQIIRSGGAGIDTPAEIVFDRTSAGSQYKAAIGMDADASRGLFFWVNGADRIRINPNTGDVHLYDHTLVHGFLTVGGFDLRLGSDDQTTRGNSGQSRALVKDGPPAKLVINYAGDFPEGTHVMGSKLVVDGNVGIGNTSPTEKLHVSGNVKAQQFISTVATGTAPFSVSSTTLVNNLNADLLDGYHASTSPTANTIPVLDSTGRLNLPFADVPVLVDGQAYTYRVFYVNQASGNDNNTGTSSSPFRTLSKAIASVPPGGVGIIYVVGNYNFDDGIVHISRKHIALNIQGTFTVDWESYVLGSVTYDGLKGRFFLYDSSSLQIFVDGWSGGKVVINDRPTNNVINPVERALVVSRESGVNSIEFSLWTVSDNYNPIYLGRDAYLGIAYTWGFVNSFTVFRLQGHYSGTNRHVIVKDPNSSKLMSFATSGGAYFVAYEGGIKDANGNDIDPKTLVGGVVKDANGLPLNVLSNIDLSDGKAFVNKAGDTITGDLIVNGDVRWTGTLQGGTVPWARLSGHPSVIAGTGLTGGGSLSGSVTLSIANGGVTTALLADGSVTTTKLADGAVTASKLADGSVTTTKLADGAVTASKLADGAVTASLGYVPVNKAGDTMTGALTVNDSLTIGGGAGNFVFKVNGGGSHGYIIDITGVTSGWARGLNVLDGGNRLASAGFYGTPGAAESFHVGFGNVWWGADAKLTVKSDGNVGIGTTVPSEKLEVSGNVKASRFISTAGTGVPPLQVSSTTLVNNLNADLLDGYHASDFTRKAENAIITGKWTFNKETEFIRLLGDTDLNNANARSLYVDATIEPTTTMNTYSKVAAFSGYVDVPSGVTLNSIGNHLSVIAVRFQKDGQGNVSAFSAISVTDLNVNYGSVNYLHGLWIGSIGRASGGTGTVGTAYGIRIDGLKTSYVNRAYGVYQVGQEDLNYFAGSVGIGVSVPTYKLDVNGNVRIQGTLYETSDIRLKTNLEPIKNALDKVERLTGYTFDMHGRRLAGLVAQEVQEVLPEAVEEDSEGYLQLNYNAVLALLVNALRALREELDRVRQLERRLEELEGRIKA
Physico‐chemical
properties
protein length:1547 AA
molecular weight: 162802,83260 Da
isoelectric point:5,76162
aromaticity:0,07692
hydropathy:-0,10595

Domains

Domains [InterPro]
DC_0841
STR
140–561
IPR011459
Unmapped
725–765
IPR030392
CHP
1449–1498
IPR030392
CHP
1449–1538
BDX35468.1
1 1547
Architecture
STR
RBD
STR
STR
STR 140-561 | RBD 705-882 | STR 883-1145 | STR 1207-1547
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
BDX35468.1
1 1547
Domain Start End Length (AA) Confidence
N-terminal 1 734 734 0,4092
Central domain 735 1109 376 0,5844
C-terminal 1110 1547 437 0,4637
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-734
Central
735-1109
C-terminal
1110-1547

Taxonomy

  Name Taxonomy ID Lineage
Phage Thermus phage MN1
[NCBI]
3018631 No lineage information
Host Thermus thermophilus HB8
[NCBI]
300852 Bacteria > Deinococcus-Thermus > Deinococci > Thermales > Thermaceae > Thermus

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
BDX35468.1 [NCBI]
Genbank nucleotide accession
LC754405.1 [NCBI]
CDS location
range 43 -> 4686
strand +
CDS
ATGAAGCGCAGGGTGTGGGGACCATACCAGAACATTACCAAGGACGACCTTAACGACATCGGGTCTTTCGCCCAAGAGGCCGTGGAGATGGCCTTGGCGGCCATCAACCCACCGGCTAGGCTGAGCGGCCTCCAAGCTACCGCCATCAGTTCCAACACCGTCAAGGTCACGTCCGGGTGGATGGTGGTCTACGACTCCACGGTGGGGCGCCCCCGCCTAGGGGTCCTGGCGGGGGACACCAACCTCACCGTTTCCGGGGCCGCCGGGACCTACCTGGTAGTTGCCACCGTTTCCGAACAAGATTTGGAAACCAGAACGGTGGCCCCACCCCCACGGACCCTTCCCAACGGCAACCCCAACCCCTTCTACGACCCCAACCTTAATCCCTATAACCAGGTCGTGCTCAAGGGGTGGAGGGTTTCTCTCTCCCTCAAAGCGGGGGGCTACACCCCGGCGAACCGGGAGGCCGTGGTAGCCCAGGTGGTTTGGGACGGCTCCGCCATCACCGGGGTCACCCAAGTCCTGGATTGGCCCAAGCCCGTCCTGGCCGACAAGTCCATCCCGGCCATCAAAATCGCCGATGACGTAGCGGGGAGCGGCCTTTCCCGCAACGCCTCCGGGGGGCTACAGGTTAACGTTGACAACTCCACCATTGAGATTACCTCCAACTCTCTCAGGGTGAAGGACGGCGGTATCTCTGACACGAAGCTAGGAAACCGCACAATCTCTGACACCACCGTCCCCTCCAGCAACACCGGGCCCCTCACCGCTCTCCTCTCCGGCCTTGCCAACAGGATAAAGGCCATTACCGGGGAAAGCGACTGGAAGAGCAACCCCGCCACAACCCTCGCCGAGCTGAACGCCAACGCCCCCCGTAAAAGCAACAACGAAACGATTACGGGGGCTTGGACCTTTACTGGGGGCATTACCATCACCAAACCCACCGCAGGGGCCAACGCCAACATCGCCCGCATCAGCTTCCCCGCCGCAGGGGGGAACGACCCGGCCTATATAGAACATAGGGAAACTACTACCGACGTAGCGGAGTTGAGGATTTCCATTAGTGATAACGATGGGCACCCTAACGACCGCCTCTACATCGGCTCCACTTTTGGAGGAGTTTGGAAGCCCAGAGTAGCGATAGATACCGCCGGGAAGTTCTACTGGGGGGACGGAGGAGGAACCTTTGACACAGAGCTGTACCGTAGTGGAGCCGGGAAGCTTTCTACTAGCGGAACCCTTACCGTAAGCGGAAATCTCGGCGTGGGGACGACCTCCCCTTCCTACAAGTTGGACGTTAAAGGCTCCATTCGCGCCGACGGACACGCCATGCAACTGATACTCGCCGAATATGGTACCGATAAGTGGCATCTGGAGTCTGTCGGTGGTGTGCTCAGGGTAGTCCAAACTGGGGTTGATTTCGCGGCAGATTTCACCACGTCGGGACAACTCCGGGTGTACCCAAGAGCGTCCCAAGGTATCCAAATCATCCGGAGTGGCGGCGCTGGTATTGACACTCCAGCAGAAATCGTCTTTGACCGCACCTCTGCGGGGTCGCAATATAAAGCCGCTATCGGCATGGATGCGGATGCGTCCAGGGGCTTGTTCTTCTGGGTCAACGGAGCTGACCGCATACGCATTAACCCGAATACCGGAGACGTGCACCTGTACGACCATACCCTCGTACACGGCTTCTTAACCGTTGGCGGATTTGACCTCCGCTTAGGTTCTGACGACCAAACTACCAGGGGCAATAGCGGGCAGTCCAGAGCTTTGGTTAAGGATGGACCCCCCGCTAAGCTGGTTATTAACTATGCTGGAGACTTTCCCGAAGGAACGCATGTGATGGGGTCAAAGTTGGTTGTTGATGGCAATGTTGGAATCGGCAACACTTCCCCAACTGAAAAACTGCATGTCAGCGGAAACGTGAAAGCCCAGCAGTTCATTTCTACTGTTGCTACGGGTACTGCCCCATTTTCAGTCTCCAGCACTACGTTGGTTAACAACTTGAACGCCGACCTACTGGACGGGTACCACGCTTCCACCTCTCCCACGGCTAACACCATCCCAGTTTTGGACAGTACGGGCAGACTGAACCTCCCCTTTGCGGACGTTCCCGTCCTTGTGGACGGGCAGGCTTATACCTACCGGGTTTTTTACGTAAACCAGGCTAGCGGTAACGATAACAACACCGGCACATCCAGTAGTCCCTTCAGAACCTTGAGCAAGGCCATCGCTAGCGTCCCGCCTGGCGGTGTCGGTATCATCTACGTCGTTGGGAACTACAACTTTGACGACGGTATTGTGCATATTAGCAGGAAACACATCGCTCTCAACATACAAGGCACATTCACCGTGGATTGGGAAAGTTACGTTTTAGGCTCCGTAACGTACGACGGGCTCAAAGGTAGATTCTTCCTGTACGATAGTTCCTCGCTCCAGATATTCGTAGACGGCTGGAGCGGCGGGAAAGTCGTTATCAACGACCGTCCGACGAATAATGTTATTAACCCTGTTGAACGCGCCCTGGTCGTTTCTAGGGAAAGTGGCGTAAACAGTATTGAGTTCTCCTTGTGGACCGTCTCGGACAATTACAACCCTATTTACCTGGGTAGGGATGCCTACTTAGGCATCGCTTACACTTGGGGCTTCGTCAATAGCTTTACCGTCTTCAGACTCCAAGGGCACTACTCCGGCACAAACCGGCACGTCATCGTCAAGGACCCGAACAGCTCCAAGCTGATGAGCTTTGCTACGAGCGGTGGCGCTTACTTCGTTGCTTATGAAGGCGGTATCAAGGACGCTAACGGCAACGACATAGACCCGAAAACGCTGGTTGGTGGCGTAGTCAAAGACGCTAACGGTTTGCCGTTGAACGTTCTGAGTAACATAGACCTTTCTGACGGAAAAGCGTTCGTCAACAAGGCCGGGGATACGATAACCGGCGACCTGATTGTCAACGGTGATGTTCGTTGGACTGGCACACTCCAAGGCGGTACGGTACCCTGGGCTCGCCTTTCCGGGCACCCGTCCGTTATTGCTGGGACTGGTTTAACCGGCGGCGGCAGTCTCTCTGGCTCTGTAACGCTGTCTATCGCTAACGGAGGCGTCACGACTGCTTTGCTTGCCGATGGGAGTGTTACGACTACCAAGCTTGCCGATGGAGCTGTCACCGCATCTAAGCTTGCCGATGGGAGTGTTACGACTACCAAGCTTGCCGATGGAGCTGTCACCGCATCTAAGCTTGCCGATGGAGCTGTCACCGCTAGTCTTGGCTATGTTCCGGTCAACAAGGCCGGAGACACGATGACCGGAGCTCTGACCGTCAACGACTCCCTCACCATCGGTGGCGGGGCTGGGAACTTCGTATTCAAAGTCAACGGGGGTGGTAGCCATGGTTACATCATAGACATTACCGGCGTTACCAGCGGGTGGGCTAGAGGCTTGAATGTGCTGGACGGTGGTAACCGTCTCGCTAGTGCTGGATTCTACGGCACCCCCGGAGCTGCTGAGTCTTTCCATGTGGGGTTCGGAAATGTTTGGTGGGGTGCTGACGCCAAACTTACCGTTAAGAGTGATGGTAACGTAGGCATTGGTACCACCGTTCCATCAGAAAAGTTGGAGGTTTCAGGGAATGTTAAAGCTTCTAGGTTTATTTCTACCGCTGGTACAGGCGTGCCTCCACTCCAAGTTTCCAGCACTACGCTGGTGAACAACTTGAACGCTGATTTGTTGGATGGTTACCACGCTTCGGACTTCACACGCAAGGCGGAAAACGCCATCATCACTGGGAAGTGGACCTTCAACAAAGAAACTGAGTTTATCAGACTCCTTGGTGACACTGACCTAAACAACGCAAACGCTAGGTCTTTGTACGTAGACGCCACCATAGAACCAACGACTACTATGAACACCTACAGCAAGGTGGCCGCATTCTCCGGGTATGTAGACGTCCCCAGTGGAGTGACGTTGAACTCCATTGGAAATCATCTTAGCGTCATCGCTGTAAGGTTCCAGAAAGACGGCCAAGGGAACGTATCCGCTTTTAGCGCCATCAGCGTCACAGACCTGAACGTAAACTATGGCTCCGTCAACTATCTGCATGGCTTGTGGATTGGAAGTATCGGTCGCGCTTCCGGGGGTACCGGGACTGTAGGTACGGCTTACGGCATTCGCATAGATGGGTTGAAGACGAGTTACGTTAACAGAGCCTACGGTGTTTACCAAGTGGGCCAGGAGGACCTCAACTACTTTGCTGGGTCTGTCGGCATTGGAGTCTCTGTTCCCACTTACAAGCTGGACGTCAATGGCAACGTCCGCATCCAAGGAACGCTCTACGAGACATCGGACATCCGCCTGAAGACGAATCTTGAGCCCATTAAAAATGCCCTAGACAAAGTTGAGCGTCTTACTGGCTACACCTTTGACATGCATGGAAGACGCCTTGCTGGGCTAGTCGCCCAGGAAGTGCAGGAAGTTCTCCCGGAGGCGGTGGAAGAAGACTCAGAAGGGTATCTGCAACTCAACTACAACGCTGTCCTCGCCCTGCTGGTCAACGCTTTGCGGGCTTTGCGGGAGGAACTGGATAGGGTTCGGCAGTTGGAACGTCGGCTTGAAGAGCTGGAAGGTCGCATCAAGGCTTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
89fb726220a6f1a6297afb4195d455820d3d01cc4dc46a28abe2f4abb1e75d49
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,4524
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Thermus phage MN1 DNA, complete genome Tamakoshi,M., Bessho,Y., Oshima,K., Toh,H. and Hattori,M. 2010-01 GenBank