Protein
View in Explore- UniProt accession
- A0A8S5UET0 [UniProt]
- Protein name
- Tail protein
- RBP type
-
TSPTF
- Protein sequence
-
MINVVLVRNPFKPDQHETQYRPYKANMPLSIYAKQDGDWVYSINGQEATLDTIVNDGDYIVAMPQIDGKFFGIILTIGLSIATGGIASGAIFGIQSLIWRTVLSMAIGMIGNMLVNKLTQPKADRSHADSAQANTYGWGGAKTVTGQGYPLAVTYGRMKSAGLLLSRHIISDGEKQYLNLLYCAGEGELSKIEDIRINANPISNYQDVQVDIRLGTNDQTVIPNFNDNYADQVLNYELKTGWSTQRVQGDACNAIELTISFPNGLYYSNDTGGMDATSVTLDAEIRKVGEDEEWHKLPLSNQKGMQAFVKKSGDGWSFTRQKSDAEIAEGDYSGKVTEATNTAFYRVYRFDNLDKAQYEVRVRCSSKDGNSIRYNNKVYWNQLTQIIYDDFVHPGKALIGIKALATSQLNGSDPEVSWIQERSAVYVFNPYQQKYEVQRADNPAWAAYDLLHMARKFGDEYVVFGQPHGRMDYDAFKAWANNCDKNGFTFNYIYDSASRLWDALKYPENVGRGKVIPQGTRFTCVSDYKSTPVQLFTVANIKQGSFSEEFQGIQSRANSVEISFLNKDKDYERDVIPVYGDTYDESDTLTNPAQIELMGCTSLDQAFKHGKHYLRCNKYEVRTVSIEAFTDAIACTIGDIILIQHDVPEWGEGGRVVAVTGSTITLDKDVSTLPGKQYQLLIRNSATDAVTTLTVLSVIGHNVTVKESITVEPGSVYAFGELTKAAKPFRVLAITEGGTDLTRKIQCMEYYPEVYTSDDGTVPTIDYKSEVGSDIEDIGLVSDIYGANGIMYSRIAVRWQLPRDGKITNVVVNYRNAKSDTWKYVGNFPASPNSTEISDVLLGATYEVKVQAINDLGQLTTGVTKEIVIPKMQAPGDVQNLHVISRYNLTADKSVYYDLQVMFEPPANPGNFDSAEVWYKLKSKNGQAVTGQDWQYAGSSNSQVIIKALGPGEEYEVKAVAVDRFGNRSDTAQVVDVVVKAMDEVPDMPKNFTVSFKDHATASWNDVLNADVDYYELRTDNDPGKDTNALLAKVKGTSANLPLTKRSGTVYLYARSTLGKYSTPATYSYNLPQLEAPTFEVKDQLGGFSLYFGAKPPQAYVIRCHVIGDDRTDDLETTSSMLTYSNKAGVYRVRCEYVDVFGSSLVTEKSVTIKDRVDKSLLDAEALGLKAMDESIQAMSSEIGTMKTSVNGFESKLIQLDKGITQKVTDLNQNLSGQITTLSNGIDLRVTQAIGNMSGKDIVSRINLSTEGTRIDGKLLHVTGQALFDNNIIAEGMLQANSVSADKIQALSISSDKLQADSVTADKLKVNRLDTITATIGTLRTKTSGARVEISDNLIQVFDDNNVLRVRLGLWDD
- Physico‐chemical
properties -
protein length: 1357 AA molecular weight: 149969,69020 Da isoelectric point: 5,13042 aromaticity: 0,09064 hydropathy: -0,33029
Domains
Domains [InterPro]
DC_0129
STR
1–979
STR
1–979
IPR053171
Unmapped
193–976
Unmapped
193–976
IPR055385
ATT
231–388
ATT
231–388
NF040662
Unmapped
251–756
Unmapped
251–756
IPR003961
STR
792–858
STR
792–858
IPR003961
STR
793–857
STR
793–857
IPR036116
STR
793–863
STR
793–863
1
1357
Architecture
STR 1-230 | ATT 231-388 | STR 389-529 | ATT 530-659 | STR 660-979 | RBD 980-1350 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1357
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 287 | 287 | 0,8272 |
| Central domain | 288 | 486 | 200 | 0,2112 |
| C-terminal | 487 | 1357 | 870 | 0,0361 |
Note: Constraints were applied during segmentation.
Fixed 21 C-terminal predictions appearing before Central domain
Fixed 21 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-287
1-287
Central
288-486
288-486
C-terminal
487-1357
487-1357
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Myoviridae sp. ct0mD26 [NCBI] |
2825015 | Uroviricota > Caudoviricetes > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
DAF92948.1
[NCBI]
Genbank nucleotide accession
BK016077
[NCBI]
CDS location
range 4991 -> 9064
strand -
strand -
CDS
ATGATTAATGTAGTGCTAGTAAGGAATCCGTTTAAACCGGATCAGCATGAAACACAATACCGCCCTTATAAGGCAAACATGCCATTAAGCATTTATGCTAAACAAGATGGCGATTGGGTATACTCCATTAATGGCCAAGAGGCTACGCTTGATACCATTGTTAATGATGGCGATTATATCGTGGCCATGCCACAGATTGATGGTAAGTTCTTTGGAATCATCTTAACCATAGGCCTTAGTATCGCAACCGGGGGTATCGCAAGCGGTGCCATCTTCGGTATTCAAAGCCTAATATGGCGTACAGTACTTTCCATGGCCATTGGTATGATTGGCAATATGCTCGTCAATAAGTTAACTCAGCCAAAGGCTGACCGGTCTCATGCGGACTCAGCACAGGCTAACACGTATGGATGGGGCGGCGCTAAGACTGTAACCGGTCAAGGGTACCCTCTAGCCGTTACGTACGGCCGTATGAAGAGTGCAGGGCTCCTCTTATCTCGTCACATTATCAGTGACGGCGAAAAGCAGTATCTCAACCTCTTATATTGTGCCGGTGAAGGCGAGTTGTCCAAAATAGAGGATATCCGTATCAACGCTAACCCTATTAGTAACTACCAGGATGTGCAAGTAGATATCAGATTAGGTACCAATGACCAAACTGTTATCCCTAACTTCAACGATAACTATGCAGACCAAGTACTCAACTATGAACTTAAAACCGGATGGAGTACGCAACGTGTACAAGGTGACGCGTGCAATGCTATCGAGTTAACTATCAGCTTCCCTAATGGCTTGTATTACTCCAACGATACGGGCGGTATGGATGCTACCTCGGTTACTCTTGATGCGGAAATCCGGAAAGTTGGGGAGGACGAGGAGTGGCATAAGTTACCACTCTCCAATCAAAAGGGTATGCAAGCCTTCGTTAAGAAATCCGGTGACGGATGGTCCTTTACTCGTCAAAAGTCTGATGCAGAAATCGCTGAAGGCGACTATAGTGGCAAGGTTACAGAGGCTACTAACACCGCGTTCTATCGAGTGTACCGATTCGATAATCTCGATAAGGCGCAGTATGAAGTCCGTGTTCGTTGTTCCAGTAAGGATGGCAACTCAATCCGATACAACAATAAGGTGTACTGGAACCAGTTAACGCAGATTATATATGATGACTTCGTCCATCCAGGCAAAGCATTAATCGGTATCAAAGCTTTGGCCACATCTCAACTTAACGGCTCTGACCCTGAAGTATCCTGGATACAAGAACGTTCCGCCGTGTATGTGTTCAACCCTTATCAACAAAAGTACGAAGTCCAACGTGCGGATAACCCGGCATGGGCGGCGTATGATCTACTTCACATGGCTCGTAAGTTTGGCGATGAGTATGTAGTGTTTGGCCAGCCTCATGGACGTATGGACTACGATGCATTTAAAGCCTGGGCCAATAACTGCGATAAGAACGGATTCACGTTCAACTATATCTACGATAGCGCTAGTCGCTTATGGGATGCGCTCAAATATCCGGAAAACGTAGGGCGAGGTAAAGTCATTCCACAGGGGACTCGGTTCACCTGTGTTAGCGATTATAAGTCGACACCGGTGCAGTTATTTACTGTGGCCAATATTAAGCAAGGAAGCTTCTCCGAAGAGTTCCAAGGTATCCAAAGCCGTGCCAACTCCGTGGAAATCTCCTTCCTTAATAAGGATAAGGACTACGAACGTGATGTTATCCCCGTGTATGGTGACACCTACGATGAATCGGATACACTTACCAACCCTGCTCAAATAGAGCTCATGGGGTGTACTAGCCTAGACCAGGCGTTTAAACATGGTAAGCACTACCTACGATGCAACAAGTACGAGGTGCGTACTGTATCTATCGAAGCTTTCACCGACGCTATAGCGTGTACCATAGGGGATATTATTCTTATCCAACATGACGTACCTGAATGGGGCGAAGGTGGCCGGGTAGTAGCTGTTACAGGTAGCACGATCACCCTTGATAAGGACGTATCGACATTACCTGGTAAGCAGTACCAACTACTGATTCGTAACAGTGCCACGGATGCGGTGACTACGCTCACAGTACTCAGCGTGATTGGCCATAACGTAACGGTTAAGGAATCAATTACAGTCGAGCCTGGCAGTGTGTATGCATTTGGTGAGTTAACTAAAGCAGCTAAACCCTTCAGGGTACTAGCTATCACGGAAGGAGGTACTGACCTTACTCGTAAAATACAGTGCATGGAATACTATCCAGAAGTATATACGAGTGATGATGGCACTGTACCAACTATCGACTATAAATCGGAAGTTGGGAGCGATATCGAGGATATAGGCCTTGTGAGTGATATATATGGTGCTAATGGCATTATGTACTCACGAATTGCCGTCCGTTGGCAACTTCCTCGTGATGGCAAGATAACCAACGTAGTGGTTAACTATCGAAACGCTAAAAGCGATACCTGGAAATATGTTGGGAATTTCCCCGCATCACCTAATAGCACGGAGATATCCGATGTACTATTAGGCGCTACCTACGAGGTTAAGGTGCAAGCGATTAACGATTTAGGTCAACTCACTACAGGGGTTACCAAGGAAATCGTGATTCCTAAGATGCAAGCGCCTGGCGATGTGCAGAACCTACACGTCATTAGCCGCTATAACCTAACCGCTGATAAGAGCGTGTACTATGACCTTCAAGTGATGTTCGAACCACCTGCTAACCCTGGTAACTTTGACAGTGCTGAGGTGTGGTACAAGCTTAAATCTAAGAATGGCCAAGCCGTAACCGGTCAAGATTGGCAGTATGCGGGTAGCAGTAACAGCCAGGTTATTATCAAGGCATTAGGCCCTGGCGAAGAGTACGAGGTTAAGGCCGTAGCCGTGGATAGGTTCGGTAATCGTTCCGATACAGCCCAGGTAGTTGACGTCGTAGTCAAGGCGATGGACGAAGTACCGGACATGCCTAAGAACTTTACCGTATCATTCAAGGACCACGCCACCGCATCTTGGAACGATGTATTGAACGCTGACGTGGACTATTATGAACTACGCACCGATAATGACCCCGGCAAGGACACCAACGCACTACTTGCGAAGGTGAAAGGTACCTCAGCTAACTTACCGCTTACGAAACGAAGTGGTACGGTGTACTTGTACGCACGAAGTACGCTAGGCAAGTACTCAACGCCAGCAACATATTCGTATAACTTGCCACAGTTAGAGGCTCCTACGTTCGAGGTCAAGGACCAACTCGGAGGGTTCAGCCTCTACTTTGGGGCGAAGCCACCACAGGCATATGTAATCCGTTGCCACGTTATCGGTGATGATCGTACGGACGATTTAGAGACTACATCGAGTATGCTTACGTACTCCAATAAAGCCGGGGTGTATCGTGTGCGGTGTGAATATGTCGACGTGTTCGGTAGTAGCTTAGTCACTGAGAAGTCGGTCACTATTAAGGACAGAGTTGATAAGAGCCTACTTGATGCGGAAGCATTGGGGCTAAAAGCTATGGACGAATCAATCCAAGCGATGAGCTCTGAAATCGGCACGATGAAAACATCTGTTAACGGGTTCGAATCTAAATTGATTCAACTTGATAAGGGAATTACCCAAAAAGTAACTGACCTTAATCAGAACCTATCTGGTCAAATTACTACGCTATCCAATGGTATCGACCTTAGAGTGACACAGGCTATCGGTAATATGAGTGGTAAGGATATTGTTAGCCGAATTAACTTATCCACTGAAGGTACTCGAATCGATGGCAAGCTATTACACGTAACAGGCCAAGCGCTGTTCGATAATAACATTATCGCGGAGGGTATGCTCCAAGCTAACTCGGTAAGCGCGGATAAGATACAAGCCTTATCCATTAGTAGTGATAAGCTCCAAGCGGATAGCGTTACCGCGGATAAGCTAAAGGTGAATAGACTTGACACTATCACGGCAACGATTGGTACGCTCCGAACTAAGACGAGTGGCGCTCGTGTTGAGATATCGGATAACTTAATCCAGGTGTTCGACGATAACAATGTACTGAGAGTGAGGTTAGGGCTATGGGACGACTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
435feaa8efada0cc84a6e89db1cd9dc30f7244568135fb45ace87c9f08bc8f6a
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50