Protein
View in Explore- UniProt accession
- A0A8S5PAX3 [UniProt]
- Protein name
- Tail protein
- RBP type
-
TSPTSP
- Protein sequence
-
MVNVIIVNNPFKPEQRDIKYLPFKQGKSISYYFSAPGEWVYSVNGHEAAPDTVVNDEDYIVVMPRVEGKFFGVLLSIGMAVFTGGIASGAIFGIQSLIWRSVIAMAVGMIGNAIVSKLTAPKVDRSNSEQSNTYGWGGTETVTGQGYPLAVTYGRMKSAGLLLSRHVISDGEKQYLNLLYCAGEGELSKIEDIRINANPISNYKDVQVNIRNGTNDQTVIPNFNDNFADQSLNYELTESWNTQQVQGDACDAIELTVGFPNGLYYSNDSGGADRTSVTLKAEIRKVGDESWQALPLANQKGMAGHIKRRDAWNFIKSDNSGTNTSDYAGRIEEATNNAFYRVFRFDNLEKARYEIRMRCSAKDGKSLRHVNKVYWVQLTQIIYDDFVHPGKALIGIKALATSQLSGSDPKVTWIQERSEVYVFNPYINKYEAQPADNPAWAAYDLIHICRKIGGEYIVFGQPHTRLDYNAFKAWADKCKTNGFTFNYIYDTAMRLWDALKYPETVGRGKVIPVGTRFTCVSDYQSTPVQLFSVANIKQGSFNEEFQGVEARANSVEISFLNKDKDYERDVIPVYGDTYDESDTLTNPAQVELMGCTSLEQAYKHGKHFLRCNKYEIRTVTIEAFTDAIACTVGDIILIQHDIPEWGEGGRVVAVSGQTITLDKEVSVQPGKNYQLLIRSNSTDIVSTFNVVNVSGLNVIVKEAIPVQPDAVYAFGEVSKSAKPFRVLAITKTLSEMTRKIQCMEYYPELYVSDDGTVPSIDYTNHGASDIQAVGLVSDVYGANGIMYSRIGVTWQLPRDGKVSNVVVNYRNVKSDTWTYIGNYPASTNTTTISDVLLGATYEVRVQAINELGQLTTGITKSINIPKMQAPEDVQNLHVLSRYNQTADKSVYYDLQVLFDPPSNPVNFDVAEIWYLLKSKSGKPVPGQEWQYAGSSNSQVIIKSLGPGEEYRIKAISVDRFGNRAETAQMVDVIVKPMDAIPDMPSNFGITFGKNATASWDEVLNADVDYYELRTDNNPGKDTNALLARVKGTSAVLTLTKRADTVYLYARSTLGKYSTAATYEYNVPQLAAPELVVKSQLGGFNLYFSTKPAQAYAIRCHVIGDERTDDFETTSTMLTYSNSAGIYRIRCSFVDVFGDGLVNEKQVVIKTQIDASLLDLESLGLNKVDERIKELDKKFNTNSEETTRKITNLASHTESRITELAGSIDLQVKKSIGEIDGGELVSRINLSQSGVYIAGELIHITGATKFDDNVIVNKMIQANAVTADKLHVENLAAVSGTIGLLRSKETGARVEIQDNLITGFDDDNNPRIKLGCW
- Physico‐chemical
properties -
protein length: 1316 AA molecular weight: 145846,58100 Da isoelectric point: 5,37966 aromaticity: 0,09498 hydropathy: -0,27880
Domains
Domains [InterPro]
DC_0129
STR
1–978
STR
1–978
IPR053171
Unmapped
191–965
Unmapped
191–965
IPR055385
ATT
229–383
ATT
229–383
NF040662
Unmapped
331–750
Unmapped
331–750
IPR003961
STR
787–853
STR
787–853
IPR036116
STR
788–853
STR
788–853
IPR003961
STR
792–852
STR
792–852
1
1316
Architecture
STR 1-228 | ATT 229-383 | STR 384-522 | ATT 523-654 | STR 655-978 | RBD 979-1301 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1316
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 295 | 295 | 0,7799 |
| Central domain | 296 | 494 | 200 | 0,1404 |
| C-terminal | 495 | 1316 | 821 | 0,0423 |
Note: Constraints were applied during segmentation.
Fixed 32 C-terminal predictions appearing before Central domain
Fixed 32 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-295
1-295
Central
296-494
296-494
C-terminal
495-1316
495-1316
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Myoviridae sp. ctaNG1 [NCBI] |
2825132 | Uroviricota > Caudoviricetes > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
DAE03364.1
[NCBI]
Genbank nucleotide accession
BK015365
[NCBI]
CDS location
range 9110 -> 13060
strand -
strand -
CDS
ATGGTTAATGTAATTATTGTAAATAATCCGTTCAAGCCAGAGCAGCGGGACATAAAATACTTGCCATTTAAACAGGGCAAGTCTATCAGCTATTACTTCAGTGCACCTGGGGAATGGGTGTATTCAGTAAATGGACACGAGGCGGCGCCGGATACAGTTGTGAATGATGAAGACTATATCGTAGTAATGCCCCGAGTTGAGGGCAAATTCTTTGGTGTTCTTCTATCAATAGGGATGGCTGTATTTACCGGTGGTATTGCTTCAGGTGCTATCTTTGGTATCCAAAGCTTGATTTGGCGGTCAGTAATTGCTATGGCGGTAGGGATGATAGGTAATGCTATTGTCTCAAAGTTAACTGCTCCTAAAGTTGACCGTTCGAATTCCGAACAGTCAAATACATATGGCTGGGGAGGTACCGAAACTGTCACTGGGCAGGGCTACCCTTTAGCCGTGACGTATGGCCGAATGAAAAGCGCTGGGTTATTATTATCCCGCCATGTAATTAGTGATGGTGAGAAGCAATATCTTAACCTTTTATACTGTGCCGGTGAGGGCGAATTATCAAAAATAGAAGATATTCGTATTAATGCTAACCCGATTAGTAATTATAAAGATGTACAGGTGAATATCAGAAATGGCACAAATGACCAAACAGTTATCCCAAATTTCAATGATAACTTTGCGGATCAATCCCTAAACTATGAATTGACTGAATCATGGAATACGCAACAGGTACAAGGCGATGCGTGTGACGCGATAGAGTTAACTGTTGGATTCCCAAACGGATTATATTATTCAAATGATAGTGGCGGCGCTGACCGTACGTCTGTTACTTTGAAAGCAGAAATTCGTAAGGTAGGCGATGAGTCCTGGCAGGCATTACCTTTAGCAAATCAAAAAGGTATGGCCGGCCATATTAAACGCCGCGATGCGTGGAACTTTATTAAGTCAGATAATAGCGGGACAAATACATCCGATTATGCAGGACGAATTGAAGAGGCGACAAATAATGCGTTTTATCGTGTATTTCGCTTTGACAATCTCGAAAAGGCTCGCTACGAAATCCGTATGCGATGCAGTGCGAAAGATGGGAAAAGCCTGCGCCATGTCAATAAGGTCTACTGGGTGCAGCTAACTCAAATTATATATGACGATTTCGTGCATCCAGGAAAAGCCCTCATTGGAATTAAGGCTTTGGCTACATCTCAACTAAGCGGAAGCGATCCAAAAGTGACATGGATTCAAGAGCGTTCAGAGGTGTATGTGTTCAATCCGTATATTAATAAGTACGAAGCTCAACCAGCGGATAACCCGGCATGGGCTGCTTATGATTTAATCCATATCTGCCGTAAGATTGGCGGTGAATATATTGTATTCGGACAGCCCCATACGCGCCTTGATTATAACGCGTTTAAGGCATGGGCAGATAAGTGCAAAACAAATGGGTTTACATTCAACTATATATACGACACCGCTATGCGATTATGGGATGCGTTAAAGTATCCAGAAACAGTAGGTCGGGGGAAAGTAATCCCTGTAGGAACCAGGTTTACATGTGTTAGTGATTATCAATCTACTCCGGTACAGTTGTTTTCTGTGGCCAATATAAAACAAGGTAGCTTTAATGAAGAGTTTCAAGGTGTAGAGGCTAGAGCGAACTCTGTTGAAATATCGTTCCTTAACAAGGATAAGGATTATGAACGAGATGTCATTCCCGTGTATGGGGATACTTACGACGAGTCGGATACGCTAACTAATCCGGCACAAGTTGAACTCATGGGGTGCACCAGTCTTGAGCAGGCCTATAAACATGGTAAGCATTTTTTGCGATGCAATAAATACGAAATACGTACTGTGACAATAGAGGCGTTTACGGATGCCATAGCGTGCACGGTAGGAGATATTATTCTAATTCAGCACGACATACCTGAATGGGGCGAGGGCGGTCGTGTGGTTGCGGTAAGTGGACAGACGATTACACTCGATAAGGAAGTGTCGGTACAACCAGGGAAGAATTATCAGTTGCTAATTCGTAGCAATTCTACGGATATTGTCTCTACGTTTAATGTAGTGAATGTATCGGGTCTCAATGTGATCGTTAAAGAGGCTATACCGGTGCAGCCTGATGCGGTATATGCATTCGGAGAGGTTTCTAAATCGGCTAAGCCATTTCGTGTGTTAGCCATTACGAAAACATTATCAGAAATGACTCGTAAGATCCAATGCATGGAATATTATCCAGAACTCTATGTATCAGATGATGGCACAGTGCCAAGTATTGATTATACGAATCACGGTGCATCTGATATTCAAGCAGTAGGGTTAGTGAGTGATGTGTATGGCGCTAATGGCATTATGTATTCACGCATAGGTGTAACGTGGCAGTTACCTCGTGATGGAAAAGTCTCAAACGTAGTTGTGAATTACCGAAATGTAAAGAGCGATACGTGGACATATATTGGAAACTACCCAGCATCCACAAATACTACCACAATATCCGATGTGTTGCTAGGTGCGACATATGAGGTGCGCGTGCAAGCTATTAATGAGTTAGGACAGCTGACTACAGGTATTACGAAATCGATTAATATACCTAAAATGCAAGCACCAGAGGATGTGCAAAATTTGCACGTACTCAGTCGATATAATCAGACTGCAGATAAGAGCGTGTACTACGATTTGCAAGTGTTATTTGACCCGCCTAGTAATCCAGTCAACTTCGATGTGGCGGAGATTTGGTATCTCTTAAAGTCAAAAAGTGGAAAGCCTGTGCCAGGGCAAGAATGGCAGTATGCTGGCAGTAGTAATAGTCAGGTTATTATCAAATCATTAGGTCCTGGTGAGGAGTATCGAATCAAAGCAATTTCGGTTGACAGATTTGGTAACAGGGCAGAAACCGCCCAAATGGTTGATGTGATAGTCAAACCGATGGACGCGATACCTGATATGCCTAGTAATTTCGGTATTACTTTCGGCAAAAATGCCACCGCATCATGGGATGAGGTGCTGAATGCTGACGTAGACTATTACGAATTACGTACCGATAATAATCCTGGTAAAGATACGAATGCTTTATTGGCAAGAGTTAAAGGTACCTCTGCTGTACTTACTTTAACTAAACGAGCAGATACTGTTTATCTTTATGCTCGCAGTACGTTGGGCAAATACTCGACTGCAGCAACATACGAGTATAACGTTCCGCAGTTGGCCGCGCCTGAGCTTGTAGTAAAAAGCCAGTTAGGGGGATTTAATCTTTATTTCTCAACTAAGCCGGCACAAGCATATGCAATCAGATGCCACGTGATCGGAGATGAACGCACCGATGATTTTGAAACTACTAGCACCATGCTGACATATTCGAACTCAGCCGGAATATACCGGATACGTTGCTCGTTTGTTGATGTGTTCGGAGACGGACTCGTTAACGAGAAGCAAGTCGTGATTAAGACACAAATTGATGCGAGCTTGCTAGACCTTGAGTCTCTCGGGCTGAATAAAGTTGATGAGCGAATTAAGGAGCTTGATAAGAAATTCAATACGAATTCTGAAGAGACCACCAGAAAAATTACGAATTTGGCATCACATACGGAATCTCGCATTACTGAGTTAGCTGGTAGCATCGATTTGCAAGTTAAAAAAAGTATTGGCGAGATTGATGGTGGTGAGTTGGTGTCTCGCATTAACCTCAGCCAGTCCGGTGTATACATTGCGGGGGAATTGATTCACATCACCGGAGCGACTAAGTTCGATGATAACGTCATTGTTAATAAGATGATTCAGGCTAACGCAGTCACTGCCGACAAATTACATGTTGAAAATTTAGCGGCAGTGTCCGGTACAATCGGGTTACTTCGTTCAAAAGAGACCGGCGCTCGTGTTGAGATTCAGGATAATCTTATTACAGGTTTTGATGATGACAATAACCCTCGGATTAAACTTGGGTGCTGGTAG
Genome Context
Genome Context
Tertiary structure
PDB ID
9f4ead1da349ffb0320fc32d8d8739d3cc1f18ab6f467d74c07484e0bb1c0384
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50