Protein
View in Explore- UniProt accession
- A0A8S5QL22 [UniProt]
- Protein name
- Tail protein
- RBP type
-
TSPTF
- Protein sequence
-
MINVVLVRNPFKPDQHETQYRPYKANMPLSFYIKQDGDWVYSINGQEATLDTIVSDGDYIVAMPQIDGKFFGIILTIGLSIATGGIASGAIFGIQSLIWRTVLSMAIGMIGNMLVNKLTQPKADRSHTDSAQANTYGWGGAKTVTGQGYPLAVTYGRMKSAGLLLSRHIISDGEKQYLNLLYCAGEGELSKIEDIRINANPVSNYQDVQVDIRLGTNDQTVIPNFNDNYADQVLNYELKTGWSTQRVQGDACNAIELTISFPNGLYYSNDTGGMDATSVTLDAEIRKVGEDEEWHKLPLSNQKGMQAFVKKSGDGWSFTRQKSDAEIAEGDYKGRVTEATNTAFYRVYRFDNLDKAQYEVRVRCSSKDGSSIRYNNKVYWNQLTQIIYDDFVHPGKALIGIKALATSQLNGSDPEVSWIQERSAVYVFNPYQQKYEVQRADNPAWAAYDLLHMARKFGDEYVVFGQPHGRMDYDAFKAWANNCDKNGFTFNYIYDSASRLWDALKYPENVGRGKVIPQGTRFTCVSDYKSTPVQLFTVANIKQGSFSEEFQGIQSRANSVEISFLNKDKDYERDVIPVYGDTYDESDTLTNPAQIELMGCTSLDQAFKHGKHYLRCNKYEVRTVSIEAFTDAIACTIGDIILIQHDVPEWGEGGRVVAVTGSTITLDKDVSTLPGKQYQLLIRNSATDAVTTLTVLSVIGHNVTVKESITVEPGSVYAFGELTKAAKPFRVLAITEGGTDLTRKIQCMEYYPEVYTSDDGTVPTIDYKSEVGSDIEDIGLVSDVYGANGIMYSRIAVRWQLPRDGKITNVVVNYRNAKSDTWKYVGNFPASPNSTEISDVLLGATYEVKVQAINDLGQLTTGVTKEIVIPKMQAPGDVQNLHVISRYNLTADKSVYYDLQVMFEPPANPGNFDSAEVWYKLKSRSGQAVAGQDWQYAGSSNSQVIIKALGPGEEYEVKAVAVDRFGNRSDTAQVVDVVVKAMDEVPDMPKNFTVAFKDHATASWNDVLNADVDYYELRTDNDPGKDTNALLAKVKGTSANLPLTKRSGTVYLYARSTLGKYSTPATYSYNLPQLEAPTFEVKDQLGGFSLYFGAKPSQAYVIRCHVIGDDRTDDLETTSSMLTYSNKAGVYRVRCEYVDVFGSSLVAEKSVTIKDRVDKSLLDAEALGLKAMDESIQAMNAEVGTMKTSVNGFESKLVQLDKGITQKVTDLNKNLSGQITTLSEGIDLRVTHAIGNLNGAEIVSRINLSPEGTRIDGKLLHVTGQALFDNNIITEGMLQANSVSADKIQALSISSDKLQADSVTADKLKVNSLAAITATIGTLRTKTSGARVEISDNLIQVFDDNNVLRVRLGLWND
- Physico‐chemical
properties -
protein length: 1357 AA molecular weight: 149832,58050 Da isoelectric point: 5,17948 aromaticity: 0,09138 hydropathy: -0,31385
Domains
Domains [InterPro]
DC_0129
STR
1–932
STR
1–932
IPR053171
Unmapped
194–976
Unmapped
194–976
IPR055385
ATT
231–388
ATT
231–388
NF040662
Unmapped
251–756
Unmapped
251–756
IPR003961
STR
792–858
STR
792–858
IPR003961
STR
793–857
STR
793–857
IPR036116
STR
793–863
STR
793–863
1
1357
Architecture
STR 1-230 | ATT 231-388 | STR 389-529 | ATT 530-659 | STR 660-932 | RBD 933-1351 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1357
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 287 | 287 | 0,8176 |
| Central domain | 288 | 486 | 200 | 0,2069 |
| C-terminal | 487 | 1357 | 870 | 0,0393 |
Note: Constraints were applied during segmentation.
Fixed 21 C-terminal predictions appearing before Central domain
Fixed 21 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-287
1-287
Central
288-486
288-486
C-terminal
487-1357
487-1357
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Siphoviridae sp. ctR1X1 [NCBI] |
2826331 | Uroviricota > Caudoviricetes > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
DAE19698.1
[NCBI]
Genbank nucleotide accession
BK015683
[NCBI]
CDS location
range 4424 -> 8497
strand +
strand +
CDS
ATGATTAATGTAGTGCTTGTAAGAAATCCGTTTAAACCGGATCAGCATGAAACACAATACCGCCCTTATAAGGCGAATATGCCATTAAGCTTTTATATTAAACAAGATGGCGACTGGGTATACTCCATTAATGGCCAAGAGGCTACGCTTGATACCATCGTGAGTGATGGCGATTATATCGTGGCCATGCCACAGATTGACGGTAAGTTCTTTGGAATTATTTTAACCATAGGCCTTAGTATCGCAACCGGGGGTATCGCAAGCGGTGCCATCTTCGGTATTCAAAGCCTAATATGGCGTACAGTACTCTCCATGGCCATTGGTATGATTGGCAATATGCTCGTTAATAAATTAACTCAGCCAAAGGCTGACCGGTCTCATACGGACTCCGCACAGGCGAATACCTATGGATGGGGAGGGGCCAAAACTGTAACCGGTCAAGGGTACCCACTAGCCGTTACGTACGGCCGTATGAAGAGCGCGGGGCTCCTTTTATCACGTCACATTATCAGTGACGGTGAAAAGCAGTACCTCAACCTCTTATATTGCGCCGGTGAAGGCGAGTTATCCAAAATCGAGGATATCCGCATCAACGCCAACCCTGTTAGTAACTACCAGGATGTACAAGTCGATATCCGATTAGGTACCAATGACCAAACTGTTATCCCTAACTTCAATGATAACTACGCAGACCAAGTACTCAACTATGAACTTAAGACGGGGTGGAGTACACAACGTGTACAAGGTGACGCGTGCAATGCTATCGAGTTAACTATCAGCTTCCCTAATGGCTTGTACTACTCCAACGATACAGGCGGAATGGACGCTACATCGGTTACTCTTGATGCGGAAATCCGGAAAGTTGGGGAGGACGAGGAGTGGCATAAGTTACCGCTATCCAATCAAAAGGGTATGCAGGCCTTTGTTAAGAAATCCGGTGACGGATGGTCCTTCACGCGTCAAAAGTCTGATGCGGAAATCGCTGAAGGCGACTATAAGGGCAGGGTTACCGAGGCGACAAACACCGCGTTCTATCGAGTGTATCGATTTGATAACCTCGATAAGGCGCAGTATGAAGTCCGTGTTCGTTGCTCCAGTAAGGACGGTAGCTCTATTCGATACAACAATAAAGTGTACTGGAACCAGTTAACGCAGATTATATATGATGACTTCGTACATCCTGGTAAGGCCTTAATTGGTATTAAAGCTTTGGCCACATCTCAACTTAACGGCTCTGACCCTGAAGTATCCTGGATACAAGAACGCTCCGCCGTGTATGTGTTCAACCCTTATCAACAAAAGTACGAAGTCCAACGTGCGGATAACCCGGCATGGGCGGCGTATGATCTACTTCACATGGCTCGTAAGTTTGGTGATGAATACGTCGTGTTTGGCCAACCTCATGGACGTATGGACTACGATGCATTTAAGGCTTGGGCGAATAACTGCGATAAGAACGGATTCACGTTCAACTATATCTACGATAGCGCTAGTCGCTTATGGGATGCACTCAAATATCCGGAAAACGTAGGGCGAGGTAAAGTCATTCCACAGGGGACCAGGTTCACCTGTGTCAGTGATTATAAGTCAACGCCTGTACAACTATTTACGGTGGCCAACATTAAACAAGGCAGTTTCTCCGAAGAGTTCCAGGGTATCCAAAGCCGTGCCAACTCCGTGGAAATCTCCTTCCTTAATAAGGATAAGGACTACGAACGTGATGTTATCCCCGTGTATGGTGACACCTACGATGAATCGGATACACTTACCAACCCTGCTCAAATAGAGCTCATGGGGTGTACTAGCCTAGACCAGGCGTTTAAACATGGTAAGCACTACCTACGATGCAACAAGTACGAGGTGCGTACTGTATCTATCGAAGCTTTCACCGACGCTATAGCGTGTACCATAGGGGATATTATTCTTATCCAACATGACGTACCTGAATGGGGCGAAGGTGGCCGGGTAGTAGCTGTTACAGGTAGCACGATCACCCTTGATAAGGACGTATCGACATTACCTGGTAAGCAGTACCAACTACTGATTCGTAACAGTGCCACGGATGCGGTGACTACGCTCACAGTACTCAGCGTGATTGGCCATAACGTAACGGTTAAGGAATCAATTACAGTCGAGCCTGGCAGTGTGTATGCATTTGGTGAGTTAACTAAAGCAGCTAAACCCTTCAGGGTACTAGCTATCACGGAAGGAGGTACTGACCTTACTCGTAAAATACAGTGCATGGAATACTATCCAGAGGTGTATACGAGTGATGATGGCACTGTACCAACTATCGACTATAAGTCTGAGGTTGGCAGTGATATCGAGGATATAGGCCTCGTGAGTGATGTATACGGTGCTAATGGCATTATGTACTCACGAATCGCCGTCCGTTGGCAACTCCCTCGTGATGGCAAGATAACCAACGTAGTGGTTAACTATCGGAACGCTAAAAGTGATACCTGGAAATATGTGGGGAACTTCCCCGCATCACCTAATAGTACCGAGATATCCGATGTACTGTTAGGAGCTACGTACGAGGTTAAGGTTCAAGCGATTAACGATTTAGGCCAACTCACTACAGGGGTTACTAAGGAAATTGTCATTCCTAAGATGCAAGCACCTGGCGATGTGCAGAATCTACACGTCATAAGCCGTTATAATCTAACCGCTGATAAGAGCGTGTACTATGACCTTCAAGTGATGTTCGAACCACCTGCTAACCCCGGCAACTTTGACAGCGCTGAGGTGTGGTACAAGCTTAAATCTAGGAGTGGGCAAGCCGTAGCCGGCCAAGATTGGCAGTATGCGGGCAGTAGTAACAGCCAGGTCATCATCAAAGCTTTGGGCCCTGGTGAAGAGTACGAGGTTAAGGCCGTAGCCGTGGATAGGTTCGGTAATCGCTCAGATACCGCCCAGGTAGTTGACGTCGTAGTTAAGGCCATGGACGAAGTACCGGACATGCCTAAGAACTTCACTGTAGCCTTTAAGGACCACGCCACCGCATCATGGAACGATGTGTTGAACGCTGACGTAGACTACTATGAACTACGCACAGATAATGACCCTGGAAAGGACACCAACGCGCTCCTTGCGAAGGTGAAAGGTACCTCAGCTAACCTACCACTTACGAAACGAAGTGGCACGGTGTACTTGTACGCACGTAGTACGCTAGGGAAGTACTCAACGCCTGCAACGTATTCGTACAACTTGCCACAGTTAGAGGCGCCTACGTTCGAGGTCAAGGACCAACTCGGAGGATTCAGCCTGTACTTTGGGGCGAAGCCATCACAGGCATACGTTATCCGTTGCCACGTTATTGGTGATGATCGTACGGACGATTTAGAGACCACGTCTAGCATGCTCACATACTCTAATAAGGCCGGGGTGTATCGTGTTCGATGTGAATACGTCGATGTGTTCGGTAGTAGCTTAGTGGCTGAGAAGTCAGTCACGATTAAGGATAGGGTTGATAAGAGCCTACTTGATGCGGAGGCATTAGGGCTAAAGGCGATGGACGAATCAATTCAAGCGATGAACGCTGAAGTTGGAACGATGAAAACCTCTGTTAATGGGTTCGAATCTAAATTGGTTCAACTTGATAAGGGCATTACCCAAAAGGTAACTGACCTTAATAAGAACTTATCTGGCCAAATTACTACATTATCCGAGGGTATCGACCTCAGAGTGACACATGCTATCGGTAATTTGAACGGTGCGGAAATTGTTAGCCGGATTAACTTATCCCCTGAAGGTACTCGAATCGACGGCAAGTTATTACACGTAACAGGCCAAGCACTGTTCGATAATAACATCATCACGGAGGGTATGCTCCAAGCTAACTCTGTGAGTGCGGATAAGATACAAGCCCTATCCATTAGTAGTGACAAGTTACAAGCGGATAGTGTTACCGCGGATAAGTTAAAAGTAAATAGCTTAGCCGCTATCACGGCTACAATCGGCACTCTTCGAACTAAAACGAGTGGTGCTAGGGTTGAAATATCGGATAATTTAATTCAAGTGTTCGATGATAACAATGTACTGAGAGTGAGGTTAGGCCTATGGAACGACTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
c405da1485471d6728faa6def3265e1aa6d0ff4b791ac4ddb79575ffc697cfbb
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50