Protein
View in Explore- Genbank accession
- CAH0447827.1 [GenBank]
- Protein name
- hypothetical protein
- RBP type
-
TSPTSP
- Protein sequence
-
MSTFVRLFKYDGDGDVELNYGIIPTSINADPERVISRYSPTTDYPANSFIVRDGDVYHSPHGSAPGPFNSAEWNNVEGLFALVQTFDTDAAYDADSVMLHPRDDAPYYAEAATGPGSLDGDAWVPFTETDAAVTLHCYLDPDSDTELPTVIAGKCVEIKDISLQESDYLDYFAGFYDATNSSEMAVNADGTGTVTNGSIVRWIRDLTGKGNHGIQTDDTLCPRFVAKPGGGGYLRFDPGGHFKVPTITTPTDHWLSCAGRGEAVFLGIDNDRDESNPGATLGMKNHTDTKAWIWSGEAIATERVIQEHEDYVLEDLKELTAKAEGDVSPLGGCFENESRLYRVIPGFNTLGQTMAQTFKNCTIFTGGVSGWDVRFITSLIETFYGCANFNESIGNWQTNNLQLLTSTFQGAFKFNQDLSAWDVSKVRTFDYCFADTTAYNNGGVNLLNWTTPAAESMTGMFLNAQSFNQELGYWDTSSVTSMESMFDGAETFNQDIGSWDVSLVANMDRMFYGTTDFNQDISWWCADSIPTEPTDFDTDSGFVDQAALQPNWGGCLPTGFIAIYEYDDPATMGAATTGVGGVTDGTKVAYVTDITGNDNHAIQADPLLQPTFREVADGKGYLEFTNDQHLVCAAITNPTHCASAHEGRGTVRHATMDNTAGMKVGINFAAADKKWELASQSFAETTVLQDDWDFEFDRRGAVAKQNAIPAGSQVKSMFEDEQYVTDGVAALTLPDLTDMTAMMKGCFRWNEDIDAWDVSSCTDMTSAFEGCVAFNGTCSSWNVSSVVSFNSMFKTAALFNQDITSWVTSSATDMSGMFMFAGSFTQDLSGWNTEFVTDMSQMFERSSVNFDLSALDTAAVVNFNRMFADSNFFNQDINAVDFSAAEDMGGMFYGAKAFNNGGQALAINAPVATTLNQFLSFSDVFNQDISAMNLPAVETLGGFLSGAQSFNNIIAGFSAPVATDVNSFFAYAPGFNQDISEMVLPNVTGVSAFVRGCPLYDNGGMAVTHDPAKFNFANVVSLDNFFEDCPVFNQDVSTMAAGTLTRTNATFKNCAAFNQDVSSWNMSNVIITEDMFSGCTNFDGDLTLWSLDSLENANYMFLDAVSFTGTGVGGWSFGALITAEEMFRGCTVVGDVFSAWDFTGVSSTDAFTDAPLVVSFPIGYV
- Physico‐chemical
properties -
protein length: 1165 AA molecular weight: 126522,19060 Da isoelectric point: 4,07515 aromaticity: 0,12275 hydropathy: -0,13725
Domains
Domains [InterPro]
DC_1912
STR
20–224
STR
20–224
IPR005046
STR
353–441
STR
353–441
DC_1384
RBD
440–609
RBD
440–609
1
1165
Architecture
STR 20-224 | RBD 283-352 | STR 353-529 | RBD 530-713 | STR 714-831 | RBD 832-912 | STR 913-1158 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1165
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 127 | 127 | 0,2496 |
| Central domain | 128 | 538 | 412 | 0,6701 |
| C-terminal | 539 | 1165 | 626 | 0,0759 |
Note: Constraints were applied during segmentation.
Fixed 92 C-terminal predictions appearing before Central domain
Fixed 92 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-127
1-127
Central
128-538
128-538
C-terminal
539-1165
539-1165
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Vibrio phage vB_VpaM_sm033 [NCBI] |
2893233 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
CAH0447827.1
[NCBI]
Genbank nucleotide accession
OV032902
[NCBI]
CDS location
range 9265 -> 12762
strand +
strand +
CDS
ATGTCTACTTTTGTACGTTTATTTAAATATGACGGCGATGGTGACGTAGAACTTAACTACGGCATCATTCCTACTTCTATTAACGCTGACCCAGAACGAGTAATCAGTCGCTACAGTCCAACTACGGATTATCCGGCTAACTCTTTTATTGTTCGTGATGGCGATGTGTACCATTCTCCTCATGGTTCTGCACCTGGTCCGTTTAACTCGGCAGAGTGGAATAACGTTGAAGGTTTATTTGCGTTAGTTCAAACGTTTGATACTGATGCTGCTTATGATGCAGATAGTGTTATGCTTCATCCTCGCGATGATGCTCCGTATTATGCTGAGGCAGCAACAGGCCCAGGCTCTCTAGATGGCGATGCATGGGTTCCGTTTACTGAAACTGATGCAGCTGTAACCCTTCACTGTTATCTCGACCCAGATAGCGATACAGAGCTTCCTACGGTCATCGCAGGTAAGTGCGTAGAGATCAAAGACATCTCTCTTCAAGAATCAGACTACCTGGATTACTTTGCTGGTTTCTATGATGCAACAAACTCGTCAGAAATGGCAGTGAATGCAGACGGTACAGGCACAGTAACTAATGGCTCTATTGTTCGCTGGATTCGTGACTTGACTGGTAAAGGCAATCACGGTATCCAAACAGACGATACGCTATGTCCTCGTTTCGTAGCCAAGCCAGGCGGCGGTGGTTATCTTCGATTTGACCCAGGCGGTCACTTTAAAGTTCCTACGATTACAACACCTACTGACCATTGGTTATCATGTGCTGGTCGTGGTGAAGCTGTCTTCCTTGGTATCGATAACGACCGTGATGAATCTAATCCTGGTGCTACTCTAGGTATGAAGAACCACACTGATACCAAAGCATGGATCTGGAGTGGTGAAGCTATCGCAACTGAGCGTGTCATCCAAGAACACGAAGATTATGTTCTAGAAGACTTGAAAGAACTAACCGCTAAAGCTGAAGGCGATGTCTCTCCGCTAGGTGGCTGTTTTGAAAACGAGTCTCGTTTGTATCGTGTTATCCCTGGATTCAATACGCTTGGTCAGACAATGGCACAGACGTTCAAGAACTGTACTATCTTTACTGGTGGTGTTTCTGGATGGGATGTTCGCTTTATTACAAGTCTTATCGAAACGTTCTATGGTTGTGCAAACTTTAACGAGTCAATCGGTAACTGGCAAACTAATAACTTGCAGCTATTGACGTCTACATTCCAAGGTGCTTTCAAGTTTAACCAAGACTTATCGGCATGGGATGTATCTAAGGTGCGTACGTTTGATTACTGTTTTGCAGATACCACTGCTTACAATAATGGCGGTGTTAATCTACTTAACTGGACAACTCCAGCAGCAGAATCAATGACGGGCATGTTCCTTAATGCGCAATCCTTTAATCAAGAGCTTGGTTACTGGGATACGTCAAGCGTTACGTCTATGGAAAGTATGTTTGATGGCGCAGAAACATTTAACCAAGACATTGGTTCTTGGGATGTTTCCTTAGTTGCTAACATGGACCGTATGTTTTACGGTACGACTGATTTCAATCAAGACATCTCTTGGTGGTGTGCGGATTCTATTCCTACCGAACCAACTGACTTTGATACGGATTCTGGTTTTGTAGACCAAGCCGCATTACAGCCTAACTGGGGCGGTTGTTTACCTACGGGCTTCATTGCCATCTATGAATACGATGATCCTGCTACAATGGGTGCAGCAACAACTGGCGTTGGTGGTGTTACTGATGGCACTAAAGTCGCATACGTTACGGACATTACTGGTAATGACAATCACGCTATCCAAGCAGACCCATTACTTCAGCCTACGTTCCGTGAAGTTGCAGATGGCAAAGGTTACTTAGAGTTTACTAATGACCAACATCTAGTTTGTGCGGCTATCACTAATCCAACTCACTGCGCATCTGCTCATGAAGGTCGTGGTACTGTACGTCACGCTACAATGGACAATACTGCTGGCATGAAAGTCGGCATTAACTTTGCAGCAGCGGATAAGAAATGGGAACTGGCTTCTCAGTCTTTTGCTGAAACAACTGTACTTCAAGATGATTGGGATTTCGAATTCGATCGCCGTGGAGCAGTGGCTAAGCAGAATGCTATTCCTGCTGGCTCTCAAGTTAAGTCTATGTTTGAAGACGAACAATACGTCACTGATGGCGTAGCTGCACTGACACTTCCTGACCTAACTGACATGACAGCTATGATGAAAGGCTGTTTCCGTTGGAATGAAGATATTGATGCATGGGATGTATCGTCTTGTACTGATATGACTTCTGCCTTTGAAGGCTGTGTAGCGTTTAATGGTACTTGTTCTTCTTGGAATGTGTCTTCTGTTGTGTCGTTTAACTCTATGTTTAAAACAGCAGCGCTATTCAATCAGGACATCACGAGTTGGGTTACGTCTTCTGCAACTGACATGTCTGGCATGTTTATGTTTGCTGGTAGCTTCACTCAAGATCTATCTGGTTGGAACACAGAGTTCGTTACTGACATGTCTCAGATGTTTGAGCGTTCATCAGTTAACTTCGACTTGTCTGCTTTAGATACAGCTGCGGTAGTTAACTTCAATCGAATGTTTGCTGACTCGAACTTCTTTAACCAAGACATCAACGCCGTAGATTTCTCTGCTGCTGAAGACATGGGTGGAATGTTCTACGGTGCAAAAGCATTTAACAACGGTGGTCAGGCCCTAGCTATTAATGCTCCTGTTGCTACAACACTTAATCAGTTCCTGAGCTTCAGTGATGTTTTCAATCAAGACATTTCTGCTATGAATCTGCCTGCTGTAGAAACACTAGGTGGCTTCCTGTCTGGCGCTCAGTCGTTTAACAACATCATTGCTGGTTTTAGTGCTCCTGTTGCCACAGATGTGAATTCGTTCTTTGCTTATGCTCCTGGTTTTAACCAAGACATTTCTGAGATGGTTCTACCTAACGTTACTGGCGTAAGTGCATTTGTACGTGGTTGTCCACTATATGACAATGGCGGCATGGCGGTTACGCATGACCCTGCTAAGTTTAACTTTGCTAATGTGGTTTCGTTAGATAACTTCTTTGAAGATTGTCCAGTATTCAATCAAGACGTAAGCACTATGGCTGCGGGTACACTTACTCGTACTAATGCTACGTTTAAGAATTGTGCTGCCTTCAATCAAGATGTATCTAGCTGGAACATGTCTAATGTTATTATTACGGAAGATATGTTTTCTGGTTGTACGAACTTTGATGGCGATCTAACTCTATGGTCTCTTGACTCACTAGAGAATGCTAACTACATGTTCTTGGATGCTGTGTCATTCACAGGTACAGGTGTTGGCGGTTGGTCGTTTGGTGCACTAATTACGGCAGAAGAAATGTTCCGTGGATGTACAGTAGTGGGTGACGTGTTTAGCGCATGGGACTTTACTGGTGTTAGTTCTACGGATGCATTTACAGATGCTCCATTAGTCGTTAGCTTCCCTATCGGTTACGTTTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
2d6502ad9caba98d7fce6c62075ff22bd50a4f276539f97f9651cfb60570d2bd
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50