Protein
View in Explore- UniProt accession
- A0A8S5VBT2 [UniProt]
- Protein name
- Tail protein
- RBP type
-
TSPTF
- Protein sequence
-
MIQLVIVRNPFDVAKREMQEVVCRDGMPVRSYFCEPGRWQYSINGILCDPDVVPLDGDCIVIVPYVEGKVFGMILSVGLSFLTAGIAGGAILGGLSMGWRMVTAIAIGMIGGALVSRLNRPRVDTSNADQSQSQTYGWGGTSTLTGQGHPLAITYGAMKSGGVLLSRHIISDGARQYLHLLYCAGEGELQDIRNIRINENPADNYKDVQIDIRLGTNDQTIIPNFADNYADQPLNYELSGGWATHEVQGNLCTGIELTVALPNGLYYSNDEGGMDSTSVTLAAECHIVGSAEAWTALPLCDSTGTDAFLTRKDGAWVRSLNAASLGGNYSGRINEATNRAIYRVYRFEGLPPGRYEVRVRCVHKDGNTIRYVNRVYWTQLTQIVYDDFVHPGKALIGIRALATEQLSGNDPAVTWVQERSKLYVWNPYAKAYEEKRADNPAWACYDILHQCRRIGGRYIVRGEPADRLSYDMFKAWAEQCDSKGYTFNYIYDSAMQVWEALRYPETVGRGKVIMQGTRFTCVYDYAAQPSQLFTVGNIKQDSFKEEFQGTQGRANVIEISFMNKDKNFERDVLPVFSDDYDASEALSTPTQIELMGCTDLKQAYAHGKHALRANKYELRTCTFDAFVDAIACTIGDVILLQHDVTEWGSGGRVVSVDGAAVTLDRTVTMAEGKQYRLMVRDSKTDTLHTYEVQSVSGAVVTLTQTAEIAADDLYTFGEATKEAKPFRVLSISKGMTEQTRKITCMEYYPELYADDNTDVPIIDYTTQSDKLTVNNLLVIVEIKTLPDGTTLYDLAVSWRLPRSAVAKQIKVEYRRDGETKYTTQGVYDGNATSSVITGVAAAVSYTVRVTCYNDLGLAGNAAMQTVYTAPKDAPPSKVQDFTVAQDAGNSSVLQLAWKANPETDILGYRLFDGADAVLVDLIGGTSYSYFIPTSGTYAFGIRAVNRSGVVSAETADVSITATVAAGSVAVPDAPHSGEVRLQGGAVTVAWEAVTNTYIDYYEVRTNSNTGQLAGLLAKTADIRSAVVLSARSGAVLVYGHNPQKGYGEPLSIHYDFPAPTAPTIKITNTLQGFSVSIQNRPEHISGTRVHISGGGVNETIETTGTFVSYAGAPGIYTVQAACFDSFGDGELSLAQEVIVKAKIDKNDIENLSIAEKDLDAALAERMRDVQTTKESVSSIVAKLSGNPQESGYSAITQIYNGLQLKVNQGDVVAAINVAPTGVKIDGRLLHITGNTIIDGNVIANHMLQAGAITADKLAVDSLSAVSAKIGKLRTKDTGARTEISDNLIEVFDEGEKTRVRIGIFE
- Physico‐chemical
properties -
protein length: 1305 AA molecular weight: 141969,25440 Da isoelectric point: 5,17038 aromaticity: 0,08429 hydropathy: -0,15418
Domains
Domains [InterPro]
DC_0129
STR
1–969
STR
1–969
IPR053171
Unmapped
184–955
Unmapped
184–955
IPR055385
ATT
231–385
ATT
231–385
IPR003961
STR
239–368
STR
239–368
NF040662
Unmapped
334–753
Unmapped
334–753
IPR036116
STR
796–931
STR
796–931
IPR003961
STR
796–856
STR
796–856
1
1305
Architecture
STR 1-230 | ATT 231-385 | STR 386-526 | ATT 527-653 | STR 654-969 | STR 971-1047 | STR 1142-1303 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1305
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 196 | 196 | 0,8689 |
| Central domain | 197 | 397 | 202 | 0,4714 |
| C-terminal | 398 | 1305 | 907 | 0,1105 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-196
1-196
Central
197-397
197-397
C-terminal
398-1305
398-1305
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Siphoviridae sp. ctDxv33 [NCBI] |
2825392 | Uroviricota > Caudoviricetes > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
DAG04158.1
[NCBI]
Genbank nucleotide accession
BK016239
[NCBI]
CDS location
range 6977 -> 10894
strand +
strand +
CDS
ATGATACAGCTCGTCATCGTCCGCAATCCCTTTGACGTGGCAAAGCGGGAGATGCAGGAGGTTGTGTGCCGTGACGGCATGCCGGTCAGGTCGTATTTCTGCGAGCCAGGGCGATGGCAATATTCCATCAACGGCATACTCTGCGATCCGGACGTCGTGCCCCTTGATGGGGACTGCATCGTTATCGTCCCGTATGTCGAGGGTAAGGTATTCGGCATGATCCTCTCGGTCGGCCTGTCATTTCTGACGGCTGGCATCGCGGGCGGCGCAATCCTCGGTGGGCTCTCAATGGGCTGGCGCATGGTAACGGCCATCGCCATCGGCATGATCGGCGGCGCGCTTGTCTCGCGTCTCAATCGTCCGCGGGTTGACACGAGCAACGCGGATCAGTCGCAGTCGCAGACGTACGGCTGGGGCGGCACATCGACGCTGACGGGGCAGGGGCATCCGCTCGCCATTACGTACGGCGCCATGAAATCGGGCGGTGTCCTACTCTCACGACATATCATCAGCGACGGGGCGCGGCAGTATCTGCATCTGCTCTACTGCGCCGGCGAGGGAGAGCTGCAGGACATCCGCAATATCCGCATCAATGAAAATCCTGCGGACAACTACAAAGATGTGCAGATCGATATCCGTCTCGGCACAAACGATCAGACGATCATCCCGAATTTTGCCGATAACTACGCCGATCAGCCGCTCAATTACGAACTATCCGGAGGATGGGCAACGCATGAAGTACAGGGCAATCTCTGCACGGGCATTGAGCTCACTGTCGCGCTCCCCAACGGCCTCTATTACAGCAATGATGAGGGCGGCATGGACTCGACAAGCGTAACGCTTGCCGCGGAATGCCATATCGTAGGCAGTGCAGAGGCATGGACGGCACTGCCGCTCTGCGACTCGACGGGCACGGATGCATTTCTGACCCGCAAAGATGGCGCATGGGTGCGATCCCTGAATGCTGCATCGCTCGGCGGAAATTACTCCGGGCGCATCAACGAGGCAACCAATCGGGCGATCTATCGCGTCTACCGTTTTGAGGGCCTTCCTCCGGGGCGTTATGAGGTGCGTGTGCGCTGCGTCCACAAAGACGGCAATACCATCCGATATGTCAATCGCGTCTATTGGACGCAGCTGACGCAGATCGTCTATGACGACTTCGTGCATCCGGGCAAGGCGCTCATCGGCATCCGTGCACTCGCAACGGAGCAGCTGAGCGGCAACGATCCCGCCGTGACATGGGTGCAGGAGCGATCCAAACTCTACGTCTGGAATCCGTATGCCAAGGCGTATGAGGAAAAACGCGCAGATAATCCCGCGTGGGCTTGTTATGACATCCTGCATCAGTGCCGACGCATCGGCGGGCGTTACATCGTCCGCGGCGAGCCTGCCGACCGACTGTCCTACGACATGTTCAAAGCGTGGGCGGAGCAGTGCGACAGCAAGGGGTATACATTTAACTACATATATGATTCGGCGATGCAGGTGTGGGAGGCGCTGCGTTATCCGGAGACGGTCGGGCGCGGCAAGGTCATCATGCAGGGGACACGATTCACCTGCGTTTATGATTACGCCGCGCAACCGTCTCAGCTCTTTACGGTCGGCAATATTAAGCAGGACAGCTTCAAAGAGGAGTTCCAAGGCACACAGGGGCGCGCGAATGTTATCGAAATATCCTTTATGAATAAGGATAAGAACTTTGAGAGAGATGTGCTCCCTGTATTTTCGGACGACTATGACGCGAGCGAGGCGCTTTCCACGCCGACGCAGATCGAGCTCATGGGCTGTACGGATCTCAAGCAGGCGTATGCGCACGGCAAGCACGCCCTGCGTGCCAACAAGTACGAGCTGCGGACATGCACGTTTGATGCCTTTGTGGATGCGATCGCCTGCACGATCGGCGATGTGATCCTCCTGCAGCACGACGTGACAGAGTGGGGGAGCGGCGGGCGCGTGGTCAGCGTTGATGGGGCTGCCGTTACGCTCGATCGCACTGTCACGATGGCAGAGGGAAAGCAGTATCGTCTTATGGTACGCGACAGCAAGACCGACACACTCCACACGTATGAGGTGCAGAGTGTATCCGGCGCGGTCGTTACACTCACGCAGACGGCAGAGATTGCCGCCGATGACCTCTATACCTTCGGGGAGGCAACCAAGGAGGCAAAGCCTTTTCGGGTGCTCTCGATCTCGAAGGGCATGACGGAGCAGACACGCAAGATCACCTGCATGGAATACTATCCGGAGCTCTACGCGGATGATAACACGGACGTGCCGATCATCGACTACACGACGCAGAGCGATAAGCTCACAGTCAACAATCTCTTGGTCATCGTAGAGATCAAGACGTTACCGGACGGCACGACGCTCTACGATCTGGCCGTTTCGTGGCGTCTGCCGCGCAGTGCCGTCGCGAAACAGATCAAGGTTGAGTACAGGCGTGACGGAGAGACGAAGTACACAACGCAGGGCGTATACGACGGCAACGCAACAAGCTCCGTGATCACGGGCGTTGCAGCAGCCGTCAGTTATACCGTGCGCGTCACCTGTTACAACGACCTCGGGCTTGCCGGAAACGCGGCAATGCAGACCGTCTATACCGCACCGAAGGATGCGCCGCCCTCGAAGGTGCAGGACTTCACTGTCGCGCAGGATGCGGGCAACAGCAGTGTCCTGCAGCTGGCGTGGAAAGCGAATCCGGAGACAGATATTCTCGGCTATCGGCTCTTTGACGGAGCGGACGCCGTGCTTGTCGATCTGATCGGCGGCACAAGCTACAGCTATTTTATCCCGACATCGGGGACGTACGCATTCGGCATCCGAGCAGTCAACCGCTCCGGCGTAGTCTCTGCAGAGACCGCAGATGTATCAATCACTGCGACGGTCGCAGCGGGCAGTGTTGCCGTACCCGATGCACCGCACAGCGGCGAAGTACGACTGCAGGGCGGAGCTGTAACGGTCGCATGGGAGGCTGTGACAAACACCTACATTGATTATTATGAGGTGCGTACAAACAGCAATACCGGTCAGCTGGCAGGCTTGCTTGCCAAGACGGCGGACATCCGCTCTGCTGTCGTGCTCTCAGCGCGCAGCGGGGCTGTCTTGGTCTACGGGCACAATCCGCAGAAAGGATACGGTGAGCCGCTGAGCATCCATTACGATTTTCCGGCGCCGACAGCACCGACGATCAAGATCACAAATACGCTGCAGGGCTTTAGCGTCTCCATCCAAAATAGGCCGGAGCATATAAGCGGTACGCGTGTGCATATCTCGGGCGGCGGCGTCAACGAGACCATCGAAACAACGGGGACTTTTGTGTCTTATGCCGGTGCACCGGGTATCTATACCGTACAGGCGGCGTGTTTTGACTCCTTCGGGGACGGCGAATTGTCACTGGCGCAGGAAGTGATCGTAAAGGCAAAAATCGACAAAAACGATATCGAAAATCTGTCGATCGCGGAGAAAGATCTTGACGCGGCACTCGCCGAACGTATGCGGGACGTGCAGACGACCAAGGAGAGCGTATCGTCGATCGTTGCGAAGCTGTCCGGCAATCCGCAGGAATCCGGCTACAGCGCGATCACGCAGATCTACAACGGTCTGCAGCTCAAAGTCAATCAAGGTGATGTTGTAGCGGCTATCAACGTAGCTCCCACCGGCGTAAAGATCGATGGTCGACTCCTGCATATCACGGGGAACACGATCATTGATGGCAATGTTATCGCAAATCACATGCTGCAGGCAGGCGCGATAACCGCAGATAAGCTTGCAGTAGACAGCCTGTCTGCTGTATCGGCAAAGATCGGAAAGCTTCGCACGAAGGATACAGGAGCGAGGACGGAGATATCGGATAATCTCATCGAAGTATTCGACGAGGGCGAAAAGACCCGCGTCCGAATTGGGATATTTGAATAG
Genome Context
Genome Context
Tertiary structure
PDB ID
60826e1077437b88a8a48bdb6a491216c9de44b536b82877755bc38ebdcd2f65
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50