Genbank accession
WGL31339.1 [GenBank]
Protein name
major capsid protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MSIFNTVNLPKPFRSKYNLTHERKFSCQIGRLVPFFCEEVLPDDKWSVQSAFRLELAPLIAPLMHNVDVYQYFFYVPNYLLSSAWNTWISQGEPADSPNIPYPCRFVLSDTDFVGLNDDVLAAYVGPGTVLDYLGFSNEYARTGKGYAPTVKGVDLKDYSCFPFLAYNAIWLNYFRNENFEPLPTEWGNPGGYVQGIDQTQNINLSDWKSWNFYYRNNVVAPIVYYLNPFDEDLDDADNVERFMPHARPRRANFMHDYFTSALPFTQRGPVVKIPLGDTAKVVGTAQVNGVIDIDKPVLSSSSSSGLSFVTEGTTVRNKEVLNFYNSSGSSANIVGDGHLDNPITGISGNNMNGIAAANVDTSNLEVDLSEATGISILDLRRFAKLQSWLEKNAIGGNTPGENIRNHFGVRPSDQSLDKPIFLGGGRVPIDISNVLQTSQSTDTSALATPSGYARANGYAGFRNRYFREHGWILGLLYVMPRSTYMQGTRRYWDRKSRFDYFWMEFERIGEQPVYGYEIYDDGLASDENNGEFGYNPRYSDYKYIPSSVHGDFKTSLSFWHAARIFSERPKLNSSFLHLGDDINRIFAVDESVSDQKCWFWIRNSVKVRRPMLKNPTSILG
Physico‐chemical
properties
protein length:621 AA
molecular weight: 70329,87200 Da
isoelectric point:5,59059
aromaticity:0,13849
hydropathy:-0,38116

Domains

Domains [InterPro]
IPR037002
ATT
10–269
IPR037002
ATT
10–275
IPR016184
Unmapped
14–549
IPR003514
STR
14–181
WGL31339.1
1 621
Architecture
ATT
STR
ATT
ATT 10-275 | STR 276-324 | ATT 325-621
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
WGL31339.1
1 621
Domain Start End Length (AA) Confidence
N-terminal 1 291 291 0,8601
Central domain 292 490 200 0,1865
C-terminal 491 621 130 0,6798
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-291
Central
292-490
C-terminal
491-621

Taxonomy

  Name Taxonomy ID Lineage
Phage Dipodfec virus UOA04_Rod_951
[NCBI]
3038763 Viruses > Monodnaviria > Sangervirae > Phixviricota > Malgrandaviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WGL31339.1 [NCBI]
Genbank nucleotide accession
OQ686933 [NCBI]
CDS location
range 1 -> 1866
strand +
CDS
ATGTCTATTTTTAATACAGTTAATTTACCGAAGCCGTTCCGTTCTAAGTATAATTTGACGCATGAGCGGAAATTTTCGTGTCAAATAGGTCGGTTGGTTCCTTTTTTTTGTGAGGAGGTTCTCCCGGATGACAAATGGTCTGTTCAGTCAGCATTTCGGCTTGAGCTCGCACCATTGATTGCTCCTTTGATGCACAATGTGGATGTGTATCAATACTTTTTTTATGTTCCTAATTATCTTCTTTCCAGTGCCTGGAATACGTGGATAAGTCAAGGTGAGCCCGCGGATAGTCCTAACATCCCCTATCCTTGTCGGTTTGTCCTTTCTGATACTGATTTTGTAGGTTTAAATGATGATGTTTTAGCAGCTTATGTAGGTCCCGGTACAGTTTTAGATTATTTGGGTTTTTCGAATGAGTATGCCCGGACGGGTAAAGGTTATGCTCCTACTGTCAAGGGTGTTGATTTGAAAGATTATTCTTGTTTTCCTTTTTTGGCTTATAATGCGATATGGCTGAATTATTTTCGTAATGAGAACTTTGAGCCTCTTCCCACTGAGTGGGGTAATCCCGGAGGTTATGTGCAAGGTATAGACCAAACGCAAAATATTAATCTCTCGGATTGGAAGTCTTGGAATTTTTATTATAGAAATAATGTTGTTGCTCCTATTGTTTATTATTTAAATCCTTTTGATGAAGATTTAGATGATGCTGATAATGTTGAGCGTTTTATGCCTCATGCGCGGCCTCGCAGGGCTAATTTTATGCATGATTATTTCACTTCTGCCCTACCGTTTACTCAGCGTGGCCCGGTTGTAAAGATTCCTCTTGGAGATACGGCGAAAGTTGTTGGTACTGCGCAAGTTAATGGTGTAATTGATATTGATAAACCTGTACTTAGTAGTTCGTCTTCTTCCGGTTTGAGTTTTGTTACTGAGGGTACCACCGTGCGTAATAAGGAGGTTTTGAATTTTTATAACTCCAGCGGTTCTTCGGCTAATATTGTAGGAGATGGTCACTTGGATAATCCTATTACTGGTATTTCCGGAAATAATATGAATGGTATTGCTGCTGCTAATGTAGATACCTCTAATTTGGAGGTTGATTTGTCTGAGGCGACAGGTATTTCTATTCTTGATTTGCGCCGCTTTGCGAAATTACAGTCTTGGTTAGAGAAAAACGCTATAGGAGGAAATACGCCTGGTGAAAATATCCGTAATCATTTTGGTGTTCGTCCGTCTGACCAATCTTTGGATAAACCTATTTTCCTTGGTGGAGGACGCGTTCCTATCGATATTTCGAATGTATTACAAACGTCTCAGTCGACGGATACCTCTGCTCTGGCTACTCCGTCCGGTTATGCTCGTGCGAATGGTTATGCCGGGTTTCGTAATCGTTACTTCCGTGAACATGGTTGGATACTTGGTTTGCTCTACGTGATGCCTCGTTCGACGTATATGCAAGGTACACGCCGCTATTGGGATAGGAAGAGCCGTTTTGATTATTTTTGGATGGAATTCGAACGCATTGGAGAACAGCCGGTGTATGGTTATGAAATCTATGATGATGGTTTGGCGTCTGATGAAAATAACGGCGAATTTGGTTATAATCCGCGTTATTCGGACTACAAGTACATTCCGTCTTCTGTGCATGGAGATTTTAAAACGTCGCTTTCGTTTTGGCATGCTGCGCGTATTTTTTCCGAGCGTCCAAAGCTTAACTCCTCGTTCCTACATCTTGGTGATGATATTAACCGTATCTTTGCCGTGGATGAATCAGTGAGTGACCAAAAGTGTTGGTTTTGGATACGTAATTCTGTTAAAGTGCGTAGACCTATGCTAAAGAATCCGACTTCGATACTCGGATAG

Genome Context

Genome Context

Tertiary structure

PDB ID
dd8072c0a43aa16160863d9cb7db56512e18f8bcaeaf5fffe4746341afbfba09
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5180
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Towards deciphering the DNA virus diversity associated with rodent species in the families Cricetidae and Heteromyidae Lund,M., Larsen,B.B., Gryseels,S., Kraberger,S., Rowsey,D.M., Steger,L., Yule,K.M., Upham,N.S., Worobey,M., Van Doorslaer,K. and Varsani,A. — — GenBank