Protein
View in Explore- Genbank accession
- AGC34300.1 [GenBank]
- Protein name
- hypothetical protein
- RBP type
-
TSPTF
- Protein sequence
-
MSGTKLNDDGLKIEAQDLSLLSPTNEDDNRLFNHDGSSAITLAGGTTTSNAGYYMWDNAAGAWAPMKENVERVGGYTASEIAKLAENESVSGLWDFGQNPTVNGNPVFHGGNKIDSTDLAFDPAEQVELDAHVSRSNPHNTTASDVGAAPESHATDKSNPHSVTAAQVGALENPISSAVNMNGNYLDNRKGVFFGYGASHGGMDGGVHANVANNVVVSNGYSKNSSSSVQVNRSGLYKINYSINFHQTGGGGRAVMAARVEVNGSAKGGQSESRCYIRNTADGDMNHVTAECVLNLNSGDDIQVYAWRHHGVTGHDITHGRISMEYLG
- Physico‐chemical
properties -
protein length: 328 AA molecular weight: 34633,20410 Da isoelectric point: 5,25922 aromaticity: 0,06707 hydropathy: -0,51280
Domains
Domains [InterPro]
DC_1552
STR
1–150
STR
1–150
DC_2167
RBD
130–327
RBD
130–327
1
328
Architecture
STR 1-150 | RBD 151-327 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
328
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 117 | 117 | 0,7983 |
| Central domain | 118 | 316 | 200 | 0,0356 |
| C-terminal | 317 | 328 | 11 | 0,9944 |
Note: Constraints were applied during segmentation.
Fixed 21 C-terminal predictions appearing before Central domain
Fixed 21 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-117
1-117
Central
118-316
118-316
C-terminal
317-328
317-328
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Halorubrum sodomense tailed virus 2 [NCBI] |
1262527 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Halorubrum sodomense [NCBI] |
35743 | cellular organisms > Archaea > Methanobacteriati > Methanobacteriota > Stenosarchaea group > Halobacteria |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
AGC34300.1
[NCBI]
Genbank nucleotide accession
KC117376
[NCBI]
CDS location
range 22228 -> 23214
strand +
strand +
CDS
ATGAGCGGGACTAAGTTGAACGACGATGGGCTGAAGATTGAGGCTCAAGACCTCTCGCTTCTCAGCCCGACGAACGAGGACGACAACCGGCTGTTCAATCACGACGGCTCATCGGCTATCACACTCGCTGGCGGAACCACGACCTCGAACGCGGGGTACTACATGTGGGACAACGCCGCCGGGGCTTGGGCACCGATGAAAGAGAACGTCGAGCGAGTCGGCGGCTACACGGCTTCTGAAATCGCCAAACTGGCCGAGAACGAGTCTGTCTCCGGGCTGTGGGACTTCGGACAGAACCCCACGGTTAACGGAAACCCGGTGTTTCACGGCGGAAACAAGATAGACTCGACCGACCTCGCTTTCGACCCCGCCGAGCAAGTCGAACTCGACGCTCACGTTTCGCGGTCGAATCCTCACAACACAACGGCAAGCGACGTAGGCGCGGCCCCGGAATCTCACGCTACAGACAAGAGCAATCCACACAGCGTGACCGCGGCGCAGGTTGGAGCATTAGAAAATCCAATCTCGTCCGCGGTAAATATGAACGGGAACTACCTCGACAACCGCAAGGGAGTGTTCTTCGGCTATGGAGCATCACACGGCGGGATGGACGGAGGAGTTCACGCAAACGTTGCTAACAACGTTGTTGTTTCTAATGGCTACTCCAAAAATTCTTCTTCTTCTGTTCAAGTAAACCGCTCTGGTCTGTACAAAATTAACTACTCCATCAATTTCCATCAAACTGGAGGAGGTGGGCGAGCCGTTATGGCGGCCCGCGTTGAAGTTAACGGGTCAGCAAAGGGAGGCCAAAGCGAATCTCGGTGTTACATCCGCAACACAGCAGATGGTGACATGAACCACGTCACCGCAGAGTGCGTGTTAAATCTGAACTCTGGTGACGACATCCAAGTTTATGCTTGGAGGCATCACGGAGTTACTGGACACGACATCACGCACGGTCGAATTTCGATGGAGTATCTTGGCTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
cb2d35706ddac83367ac245b2a0d924a1a2a6b4fba95e49abaf93518be6c1f0c
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50
Literature
| Title | Authors | Date | PMID | Source |
|---|---|---|---|---|
| Insights into head-tailed viruses infecting extremely halophilic archaea | Pietila,M.K., Laurinmaki,P., Russell,D.A., Ko,C.C., Jacobs-Sera,D., Butcher,S.J., Bamford,D.H. and Hendrix,R.W. | 2013 | 23283946 | GenBank |