Genbank accession
URO01889.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MRYTLEAEKYGIRWDGTEAAATTQGINRAIFEAAEAGYSEVYIPKGKYLIDAVNRLAVNPEEGAGIRVPSDMTIIRHPKAEFIVDPNNSYGYSCFYLGEVENVTLKGGRIRGDRFKHDFTGHGDLEKKKTHEWGYGINIHGAKNIVIEDINISECTGDCVMVCAKGMLNVTWTDYRPARNVTIRNCILDGARRNNISVTGGEDVLIDDNVITNAGIADGCGPSFGIDIEGYGEGDIDYEEPRNVKVTNNTFLGNVKQSVCNFSGYEVIIENNHSDNTISYGYGTDTIISNNVLIRRDNKETAISSLGVSSGFTGNNAAIIGNSIKGFSSGIDIRGADVVVMSNVISDLSVDGVALGTFEARNVLFAGNVVSNCPCKHCMANRSLDITFENNKLNSSDIHSIEAIDSHNIISRSNKVKNSKKGIVVTRSSAVISDNDIDLTEYSGAVSYAIAFDKGSDVVIKNNHIPDPTNMAIYGESADGREVCIKDNNISNAKCLTAVYLVGGKKPKISNNDITFRRTASGGYGILTKGTSDALLDGNTVYSVNEFKLYNPINTSESINSRVIGNKISGNLALNKTDIETNNIPI
Physico‐chemical
properties
protein length:586 AA
molecular weight: 63425,17330 Da
isoelectric point:5,32254
aromaticity:0,06997
hydropathy:-0,26928

Domains

Domains [InterPro]
IPR011050
STR
284–469
DC_0453
RBD
356–585
IPR006626
Unmapped
455–475
URO01889.1
1 586
Architecture
STR
STR 9-585 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
URO01889.1
1 586
Domain Start End Length (AA) Confidence
N-terminal 1 17 17 0,8802
Central domain 18 575 559 0,9964
C-terminal 576 586 10 0,2766
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-17
Central
18-575
C-terminal
576-586

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage 268TH002
[NCBI]
2950151 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
URO01889.1 [NCBI]
Genbank nucleotide accession
ON210835.1 [NCBI]
CDS location
range 60284 -> 62044
strand -
CDS
ATGCGATATACGTTGGAAGCTGAGAAGTACGGGATACGTTGGGATGGAACAGAGGCGGCCGCAACTACGCAAGGAATCAATCGCGCAATTTTCGAAGCCGCTGAGGCCGGTTATTCTGAGGTTTATATACCGAAAGGTAAATATCTTATAGACGCAGTAAATCGTCTTGCTGTTAATCCGGAAGAAGGCGCAGGGATACGTGTTCCTTCTGATATGACCATAATCAGACACCCAAAAGCCGAATTTATCGTAGACCCTAATAACTCTTACGGATATTCTTGTTTCTATCTCGGTGAAGTGGAAAATGTAACTCTAAAAGGCGGAAGAATTAGAGGCGATCGATTCAAACATGACTTTACAGGTCACGGTGATCTCGAGAAAAAGAAAACTCATGAATGGGGATACGGGATTAACATACACGGAGCAAAAAATATCGTAATCGAGGATATTAATATATCAGAATGTACCGGAGATTGCGTAATGGTGTGCGCCAAAGGAATGTTAAATGTCACATGGACTGATTATAGACCAGCAAGAAATGTAACTATTAGAAATTGTATTCTTGATGGTGCTAGGCGTAATAACATCTCAGTCACAGGTGGAGAAGATGTGTTGATAGATGATAACGTGATCACAAACGCTGGAATAGCTGATGGTTGCGGTCCATCTTTCGGAATTGATATTGAAGGTTATGGAGAAGGCGACATTGATTACGAAGAACCGCGTAATGTAAAGGTCACTAATAATACTTTCTTAGGGAACGTTAAACAATCTGTATGCAACTTCAGTGGTTATGAGGTTATCATTGAGAATAATCACTCCGACAACACTATCTCTTACGGTTATGGAACTGACACCATAATATCTAATAATGTCCTTATCCGCCGCGATAATAAAGAAACAGCGATTTCATCTTTAGGAGTATCCTCAGGCTTTACAGGAAACAACGCAGCCATAATCGGGAACTCAATAAAAGGATTTAGTAGTGGTATTGATATTCGAGGTGCTGATGTCGTTGTTATGAGTAATGTAATATCGGATCTTTCAGTCGATGGGGTTGCGTTAGGGACCTTCGAAGCTAGAAACGTATTATTCGCAGGAAATGTCGTTAGTAATTGTCCATGCAAACATTGTATGGCTAACAGGTCTCTCGATATCACTTTTGAAAACAATAAACTCAACAGCTCCGATATACATTCGATTGAAGCAATTGATTCTCACAACATTATCTCAAGGTCTAATAAAGTGAAAAACAGTAAAAAAGGTATAGTAGTGACTCGATCTTCTGCAGTAATATCCGACAACGATATTGATCTAACGGAGTATTCCGGAGCTGTATCGTACGCCATTGCCTTTGATAAAGGAAGTGACGTGGTTATTAAGAATAATCACATACCAGATCCGACCAATATGGCTATATACGGAGAAAGCGCTGATGGGCGCGAGGTATGTATTAAAGACAATAATATTTCTAACGCCAAGTGCTTAACGGCTGTTTATTTAGTCGGCGGTAAAAAACCAAAGATATCTAACAATGATATAACATTTAGACGTACAGCTTCCGGCGGGTACGGCATACTAACGAAAGGAACATCCGACGCATTACTCGATGGAAATACAGTATACTCCGTCAATGAGTTTAAGCTTTATAATCCGATCAACACCTCCGAATCTATTAATTCGCGAGTTATCGGAAATAAAATATCCGGCAATCTTGCGCTGAACAAAACCGACATTGAAACGAATAATATTCCAATTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
39715c6e5dbea155f1153ecb214d87b34fdd3c8e58063ba628d71c281b53cc21
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,9014
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50