Protein
View in Explore- UniProt accession
- A0A8S5MVR7 [UniProt]
- Protein name
- Tail protein
- RBP type
-
TSPTF
- Protein sequence
-
MINVVLVRNPFKPDQHETQYRPYKANMPLSFYAKQDGDWVYSINGQEATLDTIVSDGDYIVAMPQIDGKFFGIILTIGLSIATGGIASGAIFGIQSLIWRTVLSMAIGMIGNMLVNKLTQPKADRSHTDSAQANTYGWGGAKTVTGQGYPLAVTYGRMKSAGLLLSRHIISDGEKQYLNLLYCAGEGELSKIEDIRINANPISNYQDVQVDIRLGTNDQTVIPNFNDNYADQVLNYELKTGWSTQRVQGDACNAIELTISFPNGLYYSNDTGGMDATSVTIDAEIRKVGENEEWHKLPLSNQKGMQAFVKKSGDGWSFTRQKSDAEIAEGDYRGKVTEATNTAFYRVYRFDNLDKAQYEVRVRCSSKDGSSIRYNNKVYWNQLTQIIYDDFVHPGKALIGIKALATSQLNGSDPEVSWVQERSAVYVFNPYQQKYEIQRADNPAWAAYDLLHMARKFGDEYVVFGQPHGRMDYDAFKAWANNCDKNGFTFNYIYDSASRLWDALKYPENVGRGKVIPQGTRFTCVSDYKSTPVQLFTVANIKQGSFSEEFQGIQSRANSVEISFLNKDKDYERDVIPVYGDTYDESDTLTNPAQIEIMGCTSLDQAFKHGKHYLRCNKYEVRTVSIEAFTDAIACTIGDIILIQHDVPEWGEGGRVVAVTGNTITLDKEVSTLPGKQYQLLIRNNATDAVTTLTVLNVIGRNVTVKETITVEPGSVYAFGELTKAAKPFRVLAITEGGTDLTRKIQCMEYYPEVYTSDDGTVPTIDYKSEVGSDIEDIGLVSDVYGANGIMYSRIAVRWQLPRDGKITNVVVNYRNAKSDTWKYVGNFPASPNSTEISDVLLGATYEVKVQAINDLGQLTTGVTKEIVIPKMQAPGDVRNLHVISRYNLTADKSVYYDLQVMFEPPANPGNFDSAEVWYKLKSKNGQAVTGQDWQYAGSSNSQVIIKALGPGEEYEVKAVAVDRFGNRSDTAQVVDVVVKAMDEVPDMPKNFTVAFKDHATASWNDVLNADVDYYELRTDNDPGKDTNALLAKVKGTSANLPLTKRSGAVYLYARSTLGKYSTPATYSYNLPQLEAPTFGVKDQLGGFSLYFGAKPPQAYVIRCHVIGDDRTDDLETTSSMLTYSNKAGVYRVQCEYVDVFGSSLVAEKSVTIKDRVDKSLLDAEALGLKAMDESIQAMNAEVGTMKTSVNGFASKLVQLDKGITQKVTDLNKNLSGQITTLSNGIDLRVTQAIGSLNGTEIVSRINLSPEGTRIDGKLLHVTGQALFDNNIITNGMLQANSVSADKIQALSISSDKLQADSVTADKLKVDSLDAITATIGTLRTKTSGARVEISDNLIQVFDDNNVLRVRLGVFK
- Physico‐chemical
properties -
protein length: 1356 AA molecular weight: 149665,55080 Da isoelectric point: 5,28213 aromaticity: 0,09145 hydropathy: -0,31630
Domains
Domains [InterPro]
DC_0129
STR
1–931
STR
1–931
IPR053171
Unmapped
193–976
Unmapped
193–976
IPR055385
ATT
231–388
ATT
231–388
NF040662
Unmapped
314–755
Unmapped
314–755
IPR003961
STR
792–858
STR
792–858
IPR003961
STR
793–857
STR
793–857
IPR036116
STR
793–861
STR
793–861
1
1356
Architecture
STR 1-230 | ATT 231-388 | STR 389-931 | RBD 932-1351 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1356
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 287 | 287 | 0,8220 |
| Central domain | 288 | 486 | 200 | 0,2027 |
| C-terminal | 487 | 1356 | 869 | 0,0359 |
Note: Constraints were applied during segmentation.
Fixed 22 C-terminal predictions appearing before Central domain
Fixed 22 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-287
1-287
Central
288-486
288-486
C-terminal
487-1356
487-1356
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Myoviridae sp. ctv1i11 [NCBI] |
2826709 | Uroviricota > Caudoviricetes > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
DAD85995.1
[NCBI]
Genbank nucleotide accession
BK014992
[NCBI]
CDS location
range 31070 -> 35140
strand +
strand +
CDS
ATGATTAATGTAGTGCTAGTAAGGAATCCGTTTAAACCGGATCAGCATGAAACACAATACCGCCCCTATAAGGCAAACATGCCATTAAGCTTTTACGCTAAACAAGATGGCGACTGGGTATACTCCATTAATGGCCAAGAGGCTACGCTTGATACCATCGTGAGTGATGGCGATTATATCGTGGCCATGCCACAGATTGACGGTAAGTTCTTTGGAATTATTTTAACCATAGGCCTTAGTATCGCCACAGGCGGTATCGCAAGCGGTGCCATCTTCGGTATCCAAAGCCTAATATGGCGTACAGTACTTTCCATGGCCATTGGTATGATTGGCAATATGCTCGTTAATAAGCTAACTCAGCCAAAGGCTGATAGGTCTCATACGGACTCCGCACAGGCTAACACCTATGGATGGGGAGGGGCAAAAACTGTAACCGGGCAAGGGTACCCTCTAGCCGTTACGTATGGCCGTATGAAGAGCGCGGGGCTCCTCTTATCTCGTCACATTATCAGTGATGGTGAAAAGCAGTACCTCAACCTCTTATATTGTGCCGGTGAAGGCGAGCTATCTAAAATCGAGGATATCCGTATCAATGCTAACCCTATTAGTAACTACCAGGATGTACAAGTAGATATCAGATTAGGTACCAATGACCAAACGGTTATCCCTAATTTTAATGATAACTATGCAGACCAAGTACTCAACTACGAACTTAAAACCGGGTGGAGTACACAACGTGTACAAGGTGACGCATGCAATGCTATCGAGTTAACTATCAGCTTCCCTAATGGCTTGTATTACTCCAACGATACAGGCGGTATGGACGCAACATCAGTTACCATTGATGCGGAAATTCGTAAAGTAGGTGAAAACGAAGAGTGGCATAAGTTGCCACTCTCCAACCAAAAGGGTATGCAAGCCTTCGTTAAGAAATCCGGAGACGGATGGTCCTTTACTCGTCAAAAGTCTGATGCAGAAATCGCTGAAGGCGACTATAGGGGCAAGGTTACAGAGGCTACTAACACCGCGTTCTATCGAGTGTACCGATTCGATAACCTTGATAAGGCGCAGTATGAAGTCCGTGTTCGTTGCTCCAGTAAGGACGGTAGCTCTATTCGATACAACAATAAAGTGTACTGGAACCAATTGACGCAGATTATATACGATGATTTCGTGCATCCTGGTAAGGCTCTTATTGGTATTAAAGCATTGGCCACATCTCAACTTAACGGTTCTGACCCTGAAGTATCCTGGGTTCAAGAACGCTCCGCTGTGTACGTATTCAACCCGTATCAACAAAAGTACGAAATCCAACGCGCGGATAACCCGGCATGGGCGGCGTATGATCTACTTCACATGGCTCGTAAGTTTGGCGATGAGTATGTGGTGTTTGGCCAACCTCATGGACGCATGGACTACGATGCATTTAAAGCCTGGGCGAATAACTGCGATAAGAACGGATTCACGTTCAACTATATCTACGATAGCGCTAGCCGGTTATGGGATGCGCTCAAATATCCGGAGAACGTAGGGCGCGGTAAAGTCATTCCACAGGGGACTCGATTCACCTGTGTTAGTGACTATAAGTCGACACCGGTACAACTATTTACTGTGGCCAACATTAAGCAAGGTAGTTTCTCCGAGGAGTTCCAAGGTATCCAAAGCCGTGCTAACTCCGTGGAAATCTCCTTTCTTAATAAGGATAAGGACTACGAGCGTGATGTTATCCCCGTGTATGGCGACACCTACGATGAATCGGATACACTTACCAACCCTGCACAAATAGAGATCATGGGATGTACTAGCCTTGACCAGGCGTTCAAACATGGTAAGCACTACCTACGATGCAACAAGTACGAGGTGCGTACTGTATCTATTGAAGCTTTCACCGACGCCATAGCGTGTACCATAGGCGATATCATTCTTATTCAACATGACGTACCTGAATGGGGCGAAGGTGGCCGAGTAGTAGCTGTTACTGGTAATACTATCACCCTTGATAAGGAAGTATCGACATTACCTGGCAAGCAGTACCAACTACTGATCCGTAACAACGCTACCGATGCGGTGACTACGCTCACAGTACTAAATGTGATTGGCCGTAACGTAACGGTTAAGGAAACGATTACAGTCGAACCAGGCAGCGTGTACGCCTTTGGCGAGTTAACCAAAGCAGCTAAACCATTTAGGGTGCTAGCTATTACAGAGGGCGGTACAGACCTTACTCGCAAGATACAGTGCATGGAATACTATCCTGAAGTGTATACGAGTGATGATGGCACTGTACCAACTATCGACTATAAGTCTGAGGTTGGTAGCGATATTGAGGATATCGGCCTCGTGAGTGATGTCTACGGCGCTAATGGCATTATGTACTCACGGATAGCCGTCCGTTGGCAACTACCGCGTGATGGCAAGATAACCAACGTAGTCGTTAACTATCGGAACGCTAAAAGCGATACCTGGAAATACGTGGGGAACTTCCCCGCATCACCTAATAGCACGGAGATATCCGATGTACTATTAGGTGCTACCTACGAGGTTAAGGTGCAAGCGATTAACGATTTAGGGCAACTCACTACAGGGGTTACTAAGGAAATCGTGATTCCTAAGATGCAAGCGCCTGGCGATGTGCGGAACCTACACGTCATAAGTCGCTATAACCTAACAGCTGATAAGAGCGTGTACTATGACCTTCAAGTGATGTTCGAACCACCGGCTAATCCTGGCAACTTTGACAGCGCTGAGGTGTGGTACAAGCTCAAATCTAAGAACGGCCAAGCTGTAACCGGTCAAGATTGGCAGTATGCGGGTAGTAGTAACAGCCAGGTTATTATCAAGGCTTTGGGCCCTGGCGAAGAGTACGAGGTTAAGGCTGTGGCCGTGGATAGGTTTGGTAATCGTTCTGATACTGCCCAGGTAGTTGACGTCGTAGTCAAGGCGATGGACGAAGTACCGGACATGCCTAAGAACTTTACGGTAGCCTTTAAGGACCACGCCACCGCATCATGGAACGATGTTCTAAACGCTGACGTGGATTACTATGAATTACGCACAGATAATGACCCCGGCAAGGACACCAACGCGCTACTTGCGAAGGTGAAAGGTACCTCAGCTAACTTACCGCTTACAAAACGAAGTGGTGCGGTGTACTTATACGCACGAAGTACGTTAGGTAAGTACTCAACGCCGGCAACGTATTCGTACAACTTGCCACAGTTAGAGGCGCCTACGTTCGGGGTCAAGGACCAACTCGGAGGATTCAGCCTCTACTTTGGTGCGAAGCCACCACAGGCATATGTAATCCGTTGCCACGTTATTGGTGATGATCGTACGGACGATTTAGAGACTACCTCGAGTATGCTTACCTACTCTAATAAAGCCGGGGTATATCGTGTGCAGTGTGAATATGTCGATGTGTTCGGTAGTAGCTTAGTCGCTGAGAAGTCGGTCACTATTAAGGATAGAGTCGATAAGAGCCTACTTGATGCGGAAGCATTGGGGCTAAAAGCTATGGACGAATCAATTCAAGCGATGAACGCTGAAGTTGGAACGATGAAAACCTCTGTTAACGGGTTTGCATCTAAATTAGTCCAACTCGATAAGGGCATTACCCAAAAGGTAACTGACCTTAATAAGAACTTATCTGGCCAAATTACTACACTATCCAACGGCATCGACCTTAGAGTGACACAGGCTATCGGTAGTCTAAACGGCACGGAAATTGTTAGCCGGATTAACTTATCACCTGAAGGCACTCGAATCGATGGCAAGTTATTACATGTAACCGGCCAAGCACTGTTCGATAACAACATCATCACAAATGGCATGCTCCAAGCTAACTCGGTGAGTGCGGATAAGATACAAGCCTTATCCATCAGTAGTGACAAGCTACAAGCGGATAGTGTTACCGCTGATAAGTTAAAGGTGGATAGCTTAGATGCTATCACGGCAACGATTGGTACGCTCCGTACCAAGACGAGTGGTGCTCGTGTTGAGATATCTGATAACTTAATCCAGGTATTTGATGATAACAATGTACTGAGAGTGAGGTTAGGGGTGTTTAAATGA
Genome Context
Genome Context
Tertiary structure
PDB ID
b52ff52475b277b1e6057c9a267a608eb4d6b1f49c61456c6a0552bac03f60b5
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50