Protein
View in Explore- Genbank accession
- XEN22830.1 [GenBank]
- Protein name
- minor tail protein
- RBP type
-
TSP
- Protein sequence
-
MASWDHRAGTSNGAYQLYLYVTEMSFDNTDRGITYLNWELGIIKVGSSGGFASTSNNTAWSVSMHGSGGNNGDQNSTGGFSFAAGDAIGTRRVIATGANWSFIHNADYSGQLSINTFAAVQTNISLGNAQIGWGNVAFTTFYRDSPAPPAPTLVSRDSDTQLTIKGYNSYDWGLGGVAPAHVLAQSDVSNMSANRVDTVYPTTGGGQGHNVVRNGLTPHKTYYFTSNTRARTGNYAGSGVLTVHARPSKPSPPEVSSKTSTSLNLTTAAPSYVGGGLTQRETQLSLDGTFATVLQTSTHLTAPVFNDLTRVQPYKLRTRVHNGVNWSDWSDVATINTPGTPPTAPTGYTVYDIASTSAKVSLGSIADNGGAVPTQARVKVSTTQSDAGLIKTVTTPSWSPTRITGLTENTQYYVSEAAYNAVENGGWGPYGAWVPLKTTNLVPNGPVLSLDSASGSFVTLEWVAPTDLNGATIANYKLRVGSNEALTANVQEFTVPADTFSQVVTGLTPASNYWAEVWTETDKGRGSGSALFAFSTTGGGGSTSGLWLNIAGVNTFCEVWYSGADGVPKLCEVWYNNADGVPKLCGA
- Physico‐chemical
properties -
protein length: 587 AA molecular weight: 61772,22850 Da isoelectric point: 5,85393 aromaticity: 0,09881 hydropathy: -0,24055
Domains
Domains [InterPro]
DC_1246
ATT
1–145
ATT
1–145
IPR013783
STR
241–337
STR
241–337
IPR036116
STR
245–354
STR
245–354
IPR003961
STR
247–335
STR
247–335
IPR003961
STR
247–327
STR
247–327
IPR003961
STR
249–340
STR
249–340
IPR003961
STR
342–425
STR
342–425
IPR003961
STR
349–438
STR
349–438
1
587
Architecture
ATT 1-145 | STR 240-539 | RBD 540-587
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
587
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 148 | 148 | 0,0005 |
| Central domain | 149 | 360 | 213 | 0,5306 |
| C-terminal | 361 | 587 | 226 | 0,4636 |
Note: Constraints were applied during segmentation.
Fixed 151 C-terminal predictions appearing before Central domain
Fixed 151 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-148
1-148
Central
149-360
149-360
C-terminal
361-587
361-587
Taxonomy
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
XEN22830.1
[NCBI]
Genbank nucleotide accession
PP978890
[NCBI]
CDS location
range 36390 -> 38153
strand +
strand +
CDS
ATGGCCTCCTGGGATCATAGAGCGGGAACCAGCAATGGTGCCTATCAGCTCTATCTGTATGTTACTGAGATGTCGTTCGATAACACCGACCGAGGTATCACATACCTCAACTGGGAACTCGGCATCATCAAGGTCGGCTCGTCCGGTGGCTTCGCCTCGACCTCGAACAACACTGCTTGGTCTGTCAGCATGCACGGCAGTGGTGGAAACAACGGCGACCAGAACAGCACCGGCGGTTTCTCCTTCGCTGCCGGTGACGCTATTGGTACGCGACGAGTCATTGCTACAGGAGCAAACTGGTCGTTCATCCACAACGCTGATTACAGCGGTCAGCTGAGCATCAACACCTTTGCTGCTGTTCAGACGAACATCAGTCTCGGTAACGCTCAGATCGGTTGGGGTAACGTTGCGTTCACGACGTTCTACCGTGATTCTCCTGCTCCTCCCGCTCCGACTCTCGTCTCTCGTGACAGCGACACTCAGCTGACCATCAAGGGCTACAACAGCTACGACTGGGGCCTTGGTGGTGTGGCTCCTGCCCACGTCCTCGCTCAATCCGACGTGAGCAACATGTCGGCTAACCGCGTGGATACGGTGTACCCGACGACCGGTGGCGGGCAGGGACACAATGTCGTCCGTAACGGTCTGACGCCTCACAAGACCTACTACTTCACGAGCAACACCCGTGCCCGCACCGGCAACTACGCTGGCTCCGGCGTCCTGACTGTTCATGCTCGACCCAGCAAGCCGTCGCCGCCTGAGGTCTCCTCGAAGACTTCGACATCTCTCAACCTGACGACCGCCGCTCCGTCCTACGTCGGTGGTGGTCTTACCCAGCGAGAGACCCAGCTCAGCCTCGACGGCACGTTCGCAACCGTCCTGCAGACCAGCACCCATCTGACCGCTCCCGTCTTCAACGACCTGACACGCGTGCAGCCATACAAGCTCCGTACGCGAGTACACAACGGCGTCAACTGGAGTGACTGGAGTGACGTCGCGACGATCAACACTCCTGGTACTCCGCCTACGGCTCCGACCGGCTACACGGTCTATGACATCGCCTCGACCTCTGCCAAGGTGTCTCTCGGTTCTATCGCCGACAACGGTGGAGCTGTGCCGACCCAGGCCCGAGTGAAGGTCAGCACGACTCAGAGCGACGCCGGTCTCATCAAGACCGTGACGACGCCGTCCTGGTCCCCGACCCGCATCACCGGCCTCACTGAGAACACGCAGTATTACGTGTCCGAGGCCGCGTACAACGCAGTCGAGAACGGTGGATGGGGACCGTACGGAGCGTGGGTACCGCTCAAGACGACCAACCTCGTCCCGAACGGCCCGGTGCTGTCTCTCGACTCCGCGTCCGGCAGCTTCGTGACGCTGGAGTGGGTTGCGCCCACAGACCTCAACGGTGCAACCATCGCCAATTACAAGCTTCGCGTCGGCTCGAACGAGGCGCTGACCGCGAACGTGCAAGAGTTTACCGTCCCCGCCGACACGTTCAGTCAGGTCGTGACCGGTCTGACCCCTGCCTCGAACTACTGGGCTGAGGTCTGGACCGAGACCGACAAGGGACGCGGCTCCGGCTCTGCCCTGTTCGCCTTCTCTACGACGGGTGGAGGCGGATCGACCAGCGGTCTCTGGCTCAACATCGCTGGCGTCAACACATTCTGCGAGGTCTGGTACAGCGGCGCGGACGGCGTGCCGAAGCTCTGTGAGGTCTGGTACAACAATGCAGACGGCGTTCCGAAGCTGTGTGGTGCATGA
Genome Context
Genome Context
Tertiary structure
PDB ID
2da60be0533815f7e2a7da1a35ea3df921a58ac276440c9c1146d1f4f6c6f131
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50