Protein
View in Explore- Genbank accession
- YP_009910556.1 [GenBank]
- Protein name
- tail spike protein
- RBP type
-
TFTFTSPTSPTSP
- Protein sequence
-
MNDFKFSNRVPNMLPQPYQIDYLPTAMDESLSLLQKVNMLIQMSNAVNTNFNDIVKKWNELVEWVTGKGLHDELQKIINKMLQDGVFGDFFLSLPKNVRYYGAMGDGVTDDTDAIKAAVKGGGVIYVPQGQYKITDTIIVKSDTTFEMHPKARIRLEADAYTAFQTGEDDDCGCRFGYDGEKNIKFIGGTIDCGGSETSGIRSGIFLGHNSNVLIEGVHILNVKEAHHIEINASQFVTVRKSRFGKFFGGRTFSEAIQIDGAFNAEVFPPFGEYDDTVCRNILIEDCRFEDCGAGIGTHNAKTLLFHETIRIENCEFYNMKSHLIRMFNFKESTVRSIKGNGDGAGILMTGCYEVTLDDIRIADMGQNGISIENSTYVNVTNGTVKRTAVGVTVFGGSSNVYIDGLRIESTKNNGVVFNGVSKCKIYNTSINSATGLGVYLLNATDCTLDDVYIDGSTGSALNLTTSNNNYFKRVKVTNPVTGSTAVPAVNVLSGNNNEFVECAASKGSGVATFGLALNSNAGSNNRFIDNTFFSTAFAQVAYVVEKEWRTLDLSNGWSNVSSNYPARYKLNGDTVILNGLLNLGTLGGSDSDSNKAGQIVPLAAPKQAQFKVAGGIGGGVADFARINIYPSGRIAIPVANGLTSVDLNTTIYLR
- Physico‐chemical
properties -
protein length: 655 AA molecular weight: 71048,19790 Da isoelectric point: 5,53409 aromaticity: 0,09313 hydropathy: -0,14015
Domains
Domains [InterPro]
IPR012334
STR
95–348
STR
95–348
IPR011050
STR
97–361
STR
97–361
IPR024535
ENZ
97–316
ENZ
97–316
IPR012334
STR
97–348
STR
97–348
IPR051550
Unmapped
113–560
Unmapped
113–560
IPR006626
Unmapped
181–209
Unmapped
181–209
IPR011050
STR
280–490
STR
280–490
1
655
Architecture
STR 95-490 | ENZ 491-531 | RBD 532-655
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
655
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 110 | 110 | 0,9873 |
| Central domain | 111 | 539 | 430 | 0,9954 |
| C-terminal | 540 | 655 | 115 | 0,9895 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-110
1-110
Central
111-539
111-539
C-terminal
540-655
540-655
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Bacillus phage Karezi [NCBI] |
2591398 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
YP_009910556.1
[NCBI]
Genbank nucleotide accession
NC_049970.1
[NCBI]
CDS location
range 11328 -> 13295
strand +
strand +
CDS
ATGAACGACTTCAAATTTAGTAACCGAGTTCCTAATATGTTACCTCAACCATATCAAATAGATTACCTTCCAACAGCAATGGATGAGAGTTTATCCCTCTTACAAAAAGTTAACATGCTGATTCAAATGAGTAATGCTGTTAACACTAACTTTAATGACATCGTGAAAAAATGGAATGAGTTAGTAGAATGGGTTACAGGTAAAGGTCTACACGATGAATTGCAAAAAATTATTAACAAAATGCTTCAAGACGGAGTTTTCGGTGATTTCTTCCTTTCACTTCCTAAGAACGTTCGTTACTATGGTGCAATGGGTGATGGAGTAACTGATGACACAGACGCAATCAAAGCGGCTGTTAAAGGTGGAGGAGTCATTTACGTTCCTCAAGGACAATACAAGATAACAGACACCATCATCGTTAAGAGTGATACAACTTTCGAGATGCACCCTAAAGCAAGAATTAGATTAGAAGCAGATGCGTATACAGCTTTCCAAACAGGTGAAGATGATGACTGTGGATGTAGATTCGGTTATGACGGGGAGAAAAACATCAAATTTATTGGTGGTACAATTGACTGTGGAGGCTCAGAAACATCGGGTATTCGAAGTGGAATCTTCCTCGGACATAACTCAAACGTTTTAATTGAAGGTGTGCACATTCTCAATGTTAAAGAAGCTCACCACATTGAAATTAATGCATCTCAGTTTGTCACAGTTAGAAAGTCGAGATTTGGTAAATTCTTCGGTGGAAGAACCTTCTCGGAAGCTATTCAAATTGATGGTGCTTTCAATGCTGAGGTATTCCCTCCATTTGGTGAGTATGATGACACTGTTTGTAGAAACATTCTAATCGAAGATTGTCGTTTTGAAGATTGCGGTGCGGGTATCGGAACACATAACGCTAAAACATTATTGTTCCATGAAACTATCCGTATTGAGAATTGTGAATTCTACAATATGAAGTCTCACTTAATCAGAATGTTCAACTTCAAAGAGTCTACTGTAAGAAGCATTAAAGGTAATGGAGACGGTGCAGGCATACTTATGACTGGTTGCTATGAAGTAACTCTTGATGATATCAGAATTGCCGATATGGGGCAAAACGGTATTTCAATTGAAAACTCAACTTATGTTAACGTAACTAACGGCACAGTCAAACGTACAGCAGTCGGTGTAACTGTTTTCGGTGGTAGTTCAAATGTTTATATTGATGGGTTAAGAATTGAATCCACTAAAAACAATGGTGTTGTATTCAATGGTGTATCTAAATGTAAAATCTATAACACATCAATTAACTCCGCAACTGGTTTGGGTGTTTATCTCCTAAATGCCACTGATTGCACTTTGGATGATGTTTACATTGATGGTTCTACTGGCTCTGCATTGAACTTAACAACTTCTAACAACAACTATTTCAAGAGAGTTAAAGTCACCAACCCTGTAACAGGATCGACTGCTGTGCCTGCTGTAAACGTCTTGTCAGGGAACAACAACGAGTTCGTTGAGTGTGCAGCTTCTAAAGGTTCAGGTGTTGCCACTTTCGGATTAGCTCTAAACAGTAATGCAGGGAGTAACAACAGATTCATTGACAACACATTCTTCTCAACGGCTTTTGCACAAGTTGCGTACGTTGTTGAAAAAGAGTGGAGAACACTTGATTTGTCAAATGGTTGGTCAAATGTTTCAAGTAACTACCCTGCTAGATATAAACTGAATGGTGACACTGTTATATTGAACGGTTTACTCAACTTGGGTACACTAGGTGGTTCTGACAGTGATAGCAATAAAGCAGGGCAAATTGTACCCCTAGCAGCTCCTAAACAAGCCCAGTTTAAGGTTGCGGGTGGTATTGGTGGGGGAGTTGCGGACTTCGCTAGAATAAACATTTATCCTTCAGGGAGAATTGCTATTCCTGTAGCAAATGGACTGACTAGTGTAGACCTCAACACAACTATCTATCTACGATGA
Genome Context
Genome Context
Tertiary structure
PDB ID
b08ed6abe7160235377887091f1f69eec68c7d8a77f517a52c6da8ccb3779b78
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50