Protein
View in Explore- Genbank accession
- XYH46218.1 [GenBank]
- Protein name
- virion structural protein
- RBP type
-
TSP
- Protein sequence
-
MSIIQGTALSAGGGGFYPYELNQSLRFNDDDSAYLSWTPASAGNRKTWTWSGWVKRGNLGIYADLFTADATTPQTAIRFQNDDRLQVDYWNGSSYSFRLKTNAVYRDTSSWYHFVVAVDTTQATSSDRVKIYVNGQEVTSFNVASYPSINFETEINNTRSHGIGSFTGGAVLELFDGYLSEVNFIDGTALDATSFGEFKDGIWVPKKYGGSYGTNGFYLPFNNDYTVEGFNTVTYTGNGGDHYIGGVGFEPDFVWVKDRDTGSSHRLHDSVRGAGLKLSSDSTAAESDESSSFTAFNADGFSLAGSAGAYNTSGRKYVAWAWDMGTGSPVSNTDGSITSTVKANPDYGFSIATYTGNGTAGATVGHGLSSAPQMVIIKNRIDGTRPWTIYHEAVHPTDPADYRLQFDTSAITNDNTTWNDTEPTASVVTLGSSTWNNKSGDSNVMYCFHSVAGYSDFGSYTGTGASGNTVTTGFKPAFVMIKGATELTDWIMFDNTRDPSNSFDNRLRANTSGAEDTAAYVDITDTGFEMTSNAYNTSSETYIYMAFADKREAAFWLDQSGNNNDWTNNNMQESDISLDSPTNNFATLSPIACGKNSTGGLPVLSEGNLAVYESTASYSTSLSTIPVSSGKWYFEVLINDVTYPAVGWINVDEPSTFFSENNMYLGKKANSYAYFYTGVTYNNNTAAAYGTGFSAGDVIGCALDLDAGTMTFYRNNTSQGTAFSSLSGTFVGGVTVQSSKQYANFGQDSSFAGNKVAQGNVDGNGRGDFYYSPPAGYLALCTANLPEPAILDAGQHFNTVLYTGNGSTQSITGVGFQPDFTWIKERNDNSSHQLHDVIRGATKRLESNNTTAEGTFTNGLTSFDADGFSLGNYVAVNQSGISHVAWNWKADNTSGTTNTDGTITSTVSANPTAGFSIVTYTGANSSGADTVGHGLSSKPEFIIVKSRTASGLTWDSWTVGHTSLDWLNNSTMWLNQTNAVTDGYLRAPWDNRRPTNTVFYVYNNSGSGINYSGENYVAYCWHGVEGYSKFGSYTGNYSTDGPFVYTGFKPAFVLIKNTGYTGDWVLFDTARSTYNYMDDVLYPHLSSAEQTSIGAANSIDVVSNGFKIRANWTAINDTYTYIYMAFAENPFKYSNAR
- Physico‐chemical
properties -
protein length: 1137 AA molecular weight: 123086,16510 Da isoelectric point: 4,65281 aromaticity: 0,13720 hydropathy: -0,39367
Domains
Domains [InterPro]
IPR013320
STR
22–187
STR
22–187
G3DSA:2.60.120.200
STR
23–194
STR
23–194
PF13385
LEC
30–187
LEC
30–187
IPR043136
STR
595–790
STR
595–790
IPR013320
STR
595–727
STR
595–727
IPR003877
STR
629–749
STR
629–749
cd11709
STR
630–729
STR
630–729
IPR003877
STR
631–746
STR
631–746
1
1137
Architecture
STR 22-194 | STR 230-790 | STR 793-1130 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1137
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 581 | 581 | 0,0944 |
| Central domain | 582 | 780 | 200 | 0,5587 |
| C-terminal | 781 | 1137 | 356 | 0,9850 |
Note: Constraints were applied during segmentation.
Fixed 505 C-terminal predictions appearing before Central domain
Fixed 505 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-581
1-581
Central
582-780
582-780
C-terminal
781-1137
781-1137
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Roseobacter phage CRP-406 [NCBI] |
3417978 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Roseobacter sp. [NCBI] |
1907202 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Alphaproteobacteria > Rhodobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
XYH46218.1
[NCBI]
Genbank nucleotide accession
PV211008
[NCBI]
CDS location
range 9490 -> 12903
strand -
strand -
CDS
ATGTCAATCATTCAAGGTACTGCGCTGTCTGCTGGTGGGGGTGGGTTTTATCCTTACGAATTAAATCAGTCACTACGCTTTAACGATGATGACAGTGCTTATCTAAGCTGGACCCCTGCAAGTGCTGGCAACCGCAAGACGTGGACTTGGAGTGGTTGGGTTAAGCGTGGTAATTTAGGTATATACGCTGATTTATTTACGGCTGATGCAACCACCCCACAGACAGCTATACGATTTCAAAATGACGATAGACTTCAAGTAGATTATTGGAATGGGTCTAGTTATAGTTTTCGTTTAAAAACAAACGCTGTTTATCGGGACACTTCTTCTTGGTATCATTTTGTTGTTGCAGTAGACACCACGCAAGCAACATCATCAGATCGTGTAAAAATATATGTTAATGGTCAGGAAGTAACGTCATTTAACGTGGCTTCTTATCCATCAATTAATTTTGAAACAGAGATTAATAATACACGATCACATGGCATTGGTAGTTTTACAGGTGGTGCAGTCCTTGAGCTTTTCGACGGCTACCTATCCGAAGTCAACTTCATCGACGGTACAGCCCTAGACGCAACCAGCTTTGGTGAATTTAAGGATGGCATCTGGGTTCCTAAGAAATACGGCGGCAGCTATGGCACGAATGGGTTTTACCTACCGTTTAACAACGACTACACAGTCGAAGGGTTTAACACTGTTACTTATACAGGAAACGGGGGTGATCATTACATTGGTGGGGTTGGTTTTGAACCAGACTTTGTTTGGGTAAAGGACAGAGATACTGGATCATCACATAGACTGCATGACAGTGTAAGGGGGGCGGGTCTAAAGTTATCTAGTGACAGTACCGCCGCAGAAAGTGATGAAAGTTCGTCTTTTACAGCTTTTAACGCAGATGGCTTTTCTTTAGCTGGAAGCGCAGGTGCATACAATACATCAGGACGGAAATACGTCGCATGGGCATGGGACATGGGGACCGGCTCACCCGTATCAAACACAGACGGATCAATTACCAGCACGGTGAAGGCTAACCCTGACTATGGGTTTAGTATTGCTACATATACAGGCAATGGCACTGCGGGGGCAACCGTAGGTCACGGTTTGTCATCTGCTCCGCAAATGGTAATTATTAAGAACCGCATTGATGGGACTAGACCTTGGACTATTTATCACGAAGCTGTCCACCCAACTGACCCTGCGGATTACAGGTTGCAGTTTGACACATCAGCGATAACAAACGACAACACGACTTGGAACGACACAGAGCCAACAGCTAGTGTTGTTACGTTAGGGTCTTCCACTTGGAACAATAAGTCTGGTGATAGCAATGTAATGTACTGCTTCCACTCAGTCGCAGGGTATAGTGACTTTGGGTCATACACGGGGACAGGTGCTTCGGGCAACACAGTGACAACAGGGTTCAAACCTGCGTTTGTTATGATTAAAGGTGCAACTGAACTTACTGATTGGATCATGTTTGACAATACAAGAGATCCATCTAATTCTTTTGACAATCGTTTGAGGGCAAATACAAGTGGGGCAGAGGATACAGCCGCTTATGTAGATATAACCGATACTGGCTTTGAAATGACCAGCAATGCTTATAACACATCAAGCGAAACCTACATCTACATGGCCTTTGCCGACAAGCGTGAGGCTGCATTCTGGCTAGACCAATCAGGCAACAACAACGATTGGACTAACAACAATATGCAGGAGAGTGACATCTCCTTGGATAGCCCGACGAATAACTTTGCTACACTGTCACCGATTGCGTGTGGTAAAAACTCTACTGGTGGGTTGCCTGTTTTGTCTGAAGGTAACTTAGCAGTTTATGAAAGCACAGCTTCTTATTCTACGTCCTTGTCTACAATCCCTGTATCAAGCGGCAAGTGGTATTTTGAAGTTTTAATAAACGATGTCACATATCCTGCCGTTGGCTGGATAAATGTCGATGAACCTTCAACATTCTTTTCTGAAAACAATATGTATTTAGGAAAGAAAGCAAATAGTTATGCTTATTTTTACACTGGGGTAACGTATAATAATAATACAGCTGCGGCTTATGGCACAGGCTTTAGTGCAGGGGATGTTATTGGTTGTGCTTTAGATTTAGATGCTGGTACGATGACATTTTATCGCAACAATACTAGCCAAGGTACTGCATTTAGCTCTTTGTCTGGAACTTTTGTAGGTGGTGTCACTGTTCAATCTTCTAAGCAATATGCCAACTTCGGGCAAGACAGTTCATTCGCAGGGAACAAAGTTGCGCAAGGGAACGTCGATGGCAATGGACGTGGTGACTTCTACTATAGCCCACCCGCAGGATACCTAGCACTGTGTACAGCTAACCTGCCTGAACCTGCTATCCTTGATGCTGGTCAGCATTTTAATACTGTGTTGTATACGGGTAATGGCTCTACGCAGAGCATCACAGGTGTTGGGTTCCAGCCTGACTTTACTTGGATTAAAGAACGTAATGATAATTCATCACATCAGTTACATGATGTTATTCGTGGTGCAACAAAGCGTCTTGAGAGTAACAACACTACGGCAGAAGGCACATTTACAAACGGGTTAACATCATTTGACGCTGATGGGTTTTCTCTTGGTAATTATGTTGCGGTTAACCAAAGCGGGATAAGCCATGTCGCATGGAACTGGAAGGCAGACAACACATCAGGAACCACCAACACCGACGGGACAATCACAAGCACTGTCTCTGCAAACCCAACGGCTGGGTTTAGTATTGTAACATACACAGGTGCAAACTCTAGCGGAGCAGATACGGTTGGTCATGGTTTAAGTAGCAAACCAGAGTTTATTATTGTTAAATCTAGAACAGCTTCTGGATTGACGTGGGATAGCTGGACCGTTGGTCACACATCGTTAGATTGGTTGAATAACTCAACGATGTGGTTAAACCAAACTAATGCTGTTACGGATGGTTATCTACGTGCCCCTTGGGATAATAGACGTCCAACAAATACCGTTTTCTATGTATATAACAACTCTGGTTCAGGTATAAACTATAGCGGAGAAAACTATGTTGCATATTGCTGGCATGGTGTCGAAGGCTACAGCAAGTTTGGCAGCTACACAGGGAACTACAGCACAGATGGGCCGTTTGTGTACACTGGGTTTAAACCTGCGTTTGTGCTTATAAAAAATACTGGTTATACTGGAGATTGGGTGCTTTTTGATACTGCACGTTCAACATATAACTATATGGATGATGTCCTTTATCCTCATCTATCTAGTGCAGAACAAACATCCATAGGTGCAGCTAACTCTATAGACGTAGTTTCAAACGGGTTCAAGATAAGGGCTAACTGGACAGCAATAAATGACACTTACACCTACATATACATGGCCTTCGCAGAGAACCCATTCAAATACAGTAACGCACGATAG
Genome Context
Genome Context
Tertiary structure
PDB ID
976af6e773e8e3b6c7b95fab5c716a563767ca6b8a8d0294b5e4088d335e48fa
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50