Protein
View in Explore- Genbank accession
- QKN88219.1 [GenBank]
- Protein name
- tail spike protein
- RBP type
-
TFTSPTSPTSP
- Protein sequence
-
MGAKTSNYGFSLWDTGDRIEVTANEQTANWNALEDWIVKRNGYLVNAKGGYRLGSNGKPLVGDATNATLDDQPAIQAALTKCKDDGGGIVFLPAGNYALKNTCVIYSNTTFIMHPQARIYRNKPNIGAFFRNGDTGASYTGYNGHGNIHVIGGYLDGNIENYDYRFNFFSFGHGYNITFENIYMKDTQTYHAIEINSTNKAVFKNLTCDGYSLDSEFQQTTPNRRTEAIQIDGMYGQDVFGSFGAYDNTPCNDITVESCTFRNWNRGVGSHSSATGAHHRNIRVVNNHFENIEDIAVVSCMWDNAVIDSNTFRTVGGGVWLRVKDSTDATFGYAISNNTFRTVTLGTSARHAIRVSGQDDADTSFKLRTVSITGNTIENTTDTSIYVDRVWRTTISGNTINNATTSGIYITGCEFGSITGNSIIGCGSYGIGLNDSNWFAINGNLVSNTDLSGIYLSNSKECAITGNTTRRNGLAGGDNQGIRLVTNSDNCTVTGNSHVSGSGEADRAILCSGSTKKNVTVGNNGGGKSITNNSTDGVSSGNL
- Physico‐chemical
properties -
protein length: 543 AA molecular weight: 58564,52880 Da isoelectric point: 5,88985 aromaticity: 0,09576 hydropathy: -0,41050
Domains
Domains [InterPro]
DC_1696
ATT
1–70
ATT
1–70
IPR012334
STR
61–414
STR
61–414
IPR011050
STR
66–404
STR
66–404
IPR006626
Unmapped
174–197
Unmapped
174–197
IPR011050
STR
336–542
STR
336–542
IPR039448
ENZ
370–524
ENZ
370–524
IPR022441
Unmapped
385–427
Unmapped
385–427
1
543
Architecture
ATT 1-70 | STR 71-543
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
543
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 56 | 56 | 0,9519 |
| Central domain | 57 | 532 | 477 | 0,9869 |
| C-terminal | 533 | 543 | 10 | 0,2544 |
Note: Constraints were applied during segmentation.
C-terminal too short, adjusted boundary
C-terminal too short, adjusted boundary
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-56
1-56
Central
57-532
57-532
C-terminal
533-543
533-543
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Bacillus phage Novomoskovsk [NCBI] |
2736258 | Uroviricota > Caudoviricetes > Ehrlichviridae > Andromedavirus novomoskovsk > |
| Host |
Bacillus pumilus [NCBI] |
1408 | cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QKN88219.1
[NCBI]
Genbank nucleotide accession
MT422786.1
[NCBI]
CDS location
range 19454 -> 21085
strand +
strand +
CDS
ATGGGAGCAAAAACAAGTAATTATGGTTTTAGTTTATGGGACACAGGTGATAGAATCGAAGTAACAGCCAATGAGCAAACAGCCAATTGGAATGCCTTAGAAGATTGGATCGTAAAAAGAAACGGTTACTTAGTAAACGCAAAAGGCGGTTACCGACTAGGCTCAAATGGAAAGCCCCTTGTAGGTGACGCTACTAACGCAACCCTTGATGATCAGCCAGCAATCCAAGCGGCACTAACTAAGTGTAAAGATGATGGAGGCGGCATCGTGTTCCTCCCAGCTGGTAATTATGCTTTGAAGAATACTTGTGTGATTTACTCAAACACAACATTCATCATGCACCCCCAAGCAAGGATATACAGAAATAAGCCAAACATCGGAGCATTCTTCCGTAATGGTGATACAGGAGCTAGCTATACAGGTTATAACGGTCACGGGAACATTCATGTAATTGGTGGCTACCTCGATGGGAACATTGAGAACTATGATTATAGATTCAATTTCTTCTCGTTTGGTCATGGATATAACATTACATTCGAGAACATCTATATGAAGGACACACAGACTTATCATGCTATTGAGATTAACTCAACAAACAAAGCTGTATTTAAAAACCTTACATGCGATGGTTATTCCTTAGATAGCGAGTTCCAACAAACTACACCAAACAGAAGAACAGAGGCGATTCAGATTGATGGTATGTACGGTCAAGATGTGTTCGGAAGCTTTGGAGCATATGACAACACGCCATGTAATGATATCACTGTTGAGTCTTGTACCTTTAGAAACTGGAACCGTGGAGTAGGCTCTCACTCGTCCGCAACAGGAGCGCATCACAGAAATATCAGGGTTGTCAATAACCACTTTGAAAATATCGAGGATATCGCTGTAGTCAGCTGTATGTGGGATAACGCTGTGATTGACTCCAATACCTTCCGGACTGTTGGCGGTGGTGTATGGCTTCGAGTGAAAGACTCAACAGATGCAACCTTTGGATATGCCATCTCGAACAACACTTTCAGAACTGTCACACTAGGAACGTCAGCAAGACACGCCATTCGAGTAAGCGGTCAAGATGATGCTGATACATCTTTCAAACTTCGCACAGTTTCCATTACAGGCAATACCATTGAAAACACAACAGATACATCTATTTATGTTGACCGAGTATGGAGAACTACTATCTCAGGTAATACAATCAACAATGCAACAACCAGCGGAATTTATATCACAGGTTGCGAGTTTGGGTCTATCACAGGTAACAGCATCATTGGTTGTGGGTCATACGGTATTGGTCTTAATGACTCTAATTGGTTTGCCATAAACGGTAACCTAGTGAGTAATACAGACCTTTCAGGAATCTACTTGTCAAACTCTAAGGAATGTGCAATCACAGGTAACACAACAAGACGTAATGGACTCGCTGGTGGAGACAATCAAGGGATTAGACTTGTAACAAATTCTGATAATTGTACTGTCACGGGTAATAGTCATGTATCTGGTAGTGGTGAAGCTGATAGGGCTATACTATGTAGTGGCTCCACAAAGAAAAACGTCACAGTAGGAAACAACGGCGGTGGCAAGTCGATAACAAACAATAGCACTGACGGTGTATCTTCTGGTAACCTATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
82a7d0b3107d5c8f9f54775468fe1f81da63e9cd60b7f09c4319b5915b86832c
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50