UniProt accession
M4QF90 [UniProt]
Protein name
Polymorphic membrane protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,89
TSP
Evidence RBPdetect2
Probability 0,87
Protein sequence
MADFRLGRLKFNWRGDWTVATAYVIDDIVKFGANTFVCISNHTSASNEAQWYGSDGARWQLHTEGIYHRGEWADATFYRTNDIVKYGNDQYRVVNPHTSSGSFAAANFVSYINGLKFEDTWDTNTEYQPGDIVTFGGYSYVAQTISTGSQPNSTIGSDWEILTTGFKVVGTWSNSTEYKPGDVVLLGGNSYVAKTTNTNSTPGSNPSDWDFVVGGFTWRGTWDTSTTYQPGDAVTRASNSYICVAETTGNEPELDVNGDYWNSLTQGAQSNVLTDAGDVLYISGSGAARLPIGTTGQVLSVDSNGFPAWENNNVTDPVYYVTTNGNDLNDGSNISKAFASLSHAVSLVTGPATIYVKAGIYNETLPIIVPENVSIIGDNMRTSTVKPNVGQPSNIQRLTLATIPLAAERVIGETCTNGAGDKTAQIMDVRDGGASIDVMPLTGGVWTTSDTFDNGGANIALNTVNTLNNENATLFYLSNRSMLKDLVMDGMAGFVPSVSDPKDMNTSTPDGVFVRLNPNSPISKSPYVSQCSAFSQTGIGAIVDGGVHDKYDGTGTPSNKSIVFDSWTNIHESGGVGFWITNNGAAEIVSCFTYYCHISYTSTRGGRIRSLAGNSSWGTYAIVSSGFNENESTLDGFIDGIELNYDPLTLSTGATFESAENVTGGTSGAVGEITSFQPSADKILIRPLKGNFAQNEVVTGSNSTATATLVNNSDAQKGMSGFTFVLGGLTAAPDPGGSIEYITGPGGLGSDLFTYVVANSSYAGPTGRGELTVTRGLLGSAATTHDGLSTVARYQTGTATSLSAPVSDAVGTVIQVASITGINTGGYVIIEDEMMEVVSFPTATSVEVIRGVEGTTGAAHNSGVTVRALQIKVPTETTTARDLTASDTVILVETSTGTLSSDYIKIDSEFMQVSQSATITTGTVLVVLAEEKPSATYDRQATRIRYLYSQVRLTGHDFLDIGTGNKTQTNWPGQPLSAPAPGNEVTENFPGRVFFVSTDQDGNFTVGRYFKVNQATGSTTLNASSFDLSGLSSLRLGSIGAQIGESINEFSADVTMSANSNAKVPTQKAVKTYVDTKTKTKGFTFWAGAM
Physico‐chemical
properties
protein length:1090 AA
molecular weight: 115381,76650 Da
isoelectric point:4,60989
aromaticity:0,09174
hydropathy:-0,18954

Domains

Domains [InterPro]
G3DSA:2.10.10.20
ATT
119–166
DC_1011
STR
160–217
M4QF90
1 1090
Architecture
STR
ATT
STR
ATT
STR
STR 1-15 | ATT 16-108 | STR 109-118 | ATT 119-265 | STR 266-1088 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
M4QF90
1 1090
Domain Start End Length (AA) Confidence
N-terminal 1 369 369 0,9864
Central domain 370 697 329 0,8763
C-terminal 698 1090 392 0,2600
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-369
Central
370-697
C-terminal
698-1090

Taxonomy

  Name Taxonomy ID Lineage
Phage Synechococcus phage S-CAM1
[NCBI]
754037 Uroviricota > Caudoviricetes > Pantevenvirales > Anaposvirus > Anaposvirus socalone
Host Synechococcus sp.
[NCBI]
1131 cellular organisms > Bacteria > Bacillati > Cyanobacteriota/Melainabacteria group > Cyanobacteriota > Cyanophyceae
Host Synechococcus sp. WH 7803
[NCBI]
32051 Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AGH26964.1 [NCBI]
Genbank nucleotide accession
HQ634177 [NCBI]
CDS location
range 185835 -> 189107
strand -
CDS
ATGGCAGATTTCAGATTAGGCAGACTTAAGTTTAATTGGAGGGGCGACTGGACAGTTGCCACTGCATACGTCATCGATGACATCGTTAAGTTTGGTGCAAACACTTTTGTTTGTATTTCAAACCACACGTCAGCATCGAATGAGGCGCAATGGTATGGATCGGATGGTGCCAGATGGCAACTCCATACCGAAGGCATTTACCACAGAGGTGAATGGGCAGATGCAACCTTCTATAGAACTAATGATATTGTCAAGTATGGCAATGATCAGTATAGGGTTGTCAACCCCCACACTTCCAGCGGATCTTTCGCTGCTGCAAACTTCGTCTCGTATATTAACGGACTGAAGTTTGAAGATACGTGGGACACCAATACTGAATACCAACCAGGTGACATTGTAACTTTCGGTGGTTACTCTTATGTTGCTCAAACAATCTCTACTGGTTCACAACCCAATAGCACTATTGGTAGTGACTGGGAGATCCTAACTACTGGTTTCAAGGTAGTTGGTACATGGAGCAACAGCACCGAATACAAGCCTGGTGACGTTGTACTCCTTGGTGGTAACTCCTACGTTGCTAAAACAACCAACACAAACTCCACACCTGGATCTAATCCTTCTGATTGGGACTTCGTTGTTGGTGGTTTCACCTGGAGAGGCACTTGGGATACAAGCACAACTTACCAACCTGGTGATGCTGTCACCAGAGCAAGTAACTCCTACATCTGTGTTGCCGAAACAACTGGCAACGAACCTGAACTAGATGTTAACGGAGACTACTGGAACTCCCTGACCCAAGGCGCACAGTCTAACGTACTAACCGATGCTGGTGATGTTCTTTACATCTCTGGTTCAGGTGCTGCAAGACTACCTATTGGAACAACTGGTCAAGTTCTATCCGTTGATTCTAACGGATTCCCCGCATGGGAAAACAACAATGTTACCGACCCTGTTTACTATGTTACCACAAATGGTAACGACCTAAACGACGGTTCTAACATCAGCAAAGCATTTGCTTCACTCTCTCATGCAGTAAGTCTTGTTACTGGTCCTGCTACCATTTATGTTAAGGCAGGTATCTATAACGAAACTCTACCAATCATCGTTCCCGAGAACGTTTCGATCATTGGTGACAACATGAGAACGTCCACCGTTAAACCAAACGTTGGACAACCTTCTAACATCCAAAGACTAACACTTGCAACGATTCCTCTTGCTGCAGAGAGAGTCATTGGCGAGACATGCACAAATGGTGCTGGCGATAAGACCGCACAGATCATGGATGTCAGAGACGGTGGTGCTAGCATCGACGTTATGCCTCTTACTGGCGGCGTCTGGACTACCTCCGATACTTTCGACAATGGTGGTGCTAATATCGCACTTAACACCGTGAACACTCTCAATAACGAGAACGCAACTCTCTTCTATCTGTCTAACAGATCGATGCTGAAGGATCTCGTTATGGACGGTATGGCAGGATTCGTTCCTTCTGTATCCGATCCAAAGGATATGAACACCTCTACTCCAGATGGTGTATTCGTTAGACTGAACCCCAACTCCCCAATCTCCAAGTCTCCTTACGTTTCGCAGTGTTCTGCATTCTCCCAGACTGGTATTGGTGCAATTGTTGACGGTGGTGTTCACGATAAGTATGACGGAACTGGAACTCCTTCTAACAAGTCTATCGTTTTTGACTCCTGGACTAACATCCACGAAAGCGGTGGTGTAGGTTTCTGGATTACGAACAACGGCGCTGCTGAAATCGTATCCTGCTTCACCTACTATTGCCACATCTCTTACACCTCTACTAGAGGCGGTAGAATCAGATCCTTGGCAGGTAACTCCTCCTGGGGTACTTACGCTATTGTTTCCTCTGGTTTCAACGAAAATGAGTCTACTCTCGATGGATTCATCGACGGTATCGAACTCAACTACGATCCCCTTACCCTATCTACAGGCGCAACTTTTGAAAGTGCCGAGAATGTTACGGGTGGTACTTCTGGTGCAGTTGGCGAAATTACTAGTTTCCAACCTTCGGCAGACAAGATTCTTATCCGTCCTCTCAAAGGTAACTTTGCACAGAACGAAGTTGTCACTGGTAGCAATTCTACAGCAACTGCAACTCTGGTCAACAACTCTGACGCTCAAAAGGGTATGTCAGGTTTCACCTTTGTTCTCGGTGGTCTAACCGCTGCTCCTGACCCAGGTGGTTCTATTGAATACATCACTGGTCCTGGTGGACTCGGTTCTGATCTATTCACTTATGTTGTTGCTAACTCTTCTTACGCTGGTCCTACTGGACGTGGAGAACTGACTGTAACCAGAGGACTTCTTGGTTCTGCTGCTACAACTCATGATGGTTTGAGCACTGTTGCTAGATACCAAACTGGTACTGCAACATCTCTATCTGCTCCTGTTAGTGACGCGGTTGGCACTGTCATCCAAGTTGCTTCAATTACTGGCATTAACACTGGTGGTTATGTCATCATCGAAGACGAGATGATGGAAGTCGTTTCGTTCCCAACTGCAACTTCTGTTGAAGTTATCAGAGGAGTAGAAGGCACCACTGGTGCTGCACATAACTCTGGCGTTACAGTCAGAGCACTTCAGATCAAGGTTCCTACCGAGACAACTACCGCTAGAGACCTAACAGCATCTGACACAGTTATTCTTGTTGAAACGTCTACGGGTACTCTATCCTCTGACTACATCAAGATTGACAGTGAGTTCATGCAGGTTTCCCAATCCGCAACAATTACAACTGGTACTGTACTGGTTGTTCTTGCAGAAGAGAAGCCTAGTGCAACTTACGATCGTCAAGCTACAAGAATCAGATACCTGTATTCACAAGTCAGACTAACTGGTCATGACTTCCTGGATATCGGTACTGGTAACAAGACCCAGACTAACTGGCCAGGTCAGCCTCTATCGGCACCTGCACCAGGTAATGAGGTTACTGAAAACTTCCCTGGTCGTGTGTTCTTCGTATCCACGGACCAAGATGGTAACTTCACCGTTGGTCGTTACTTCAAAGTTAACCAGGCAACTGGTAGCACAACCTTGAACGCATCTTCCTTCGACTTGTCTGGTCTATCATCCTTGAGACTTGGTTCCATCGGTGCTCAAATCGGTGAATCTATTAACGAGTTCTCGGCGGATGTAACCATGTCTGCAAATAGCAACGCTAAAGTTCCTACGCAGAAGGCAGTCAAGACTTACGTTGACACAAAGACGAAGACGAAAGGCTTCACTTTCTGGGCGGGAGCAATGTGA

Genbank protein accession
AOV57357.1 [NCBI]
Genbank nucleotide accession
KU686192 [NCBI]
CDS location
range 102180 -> 105452
strand +
CDS
ATGGCAGATTTCAGATTAGGCAGACTTAAGTTTAATTGGAGGGGCGACTGGACAGTTGCCACTGCATACGTCATCGATGACATCGTTAAGTTTGGTGCAAACACTTTTGTTTGTATTTCAAACCACACGTCAGCATCGAATGAGGCGCAATGGTATGGATCGGATGGTGCCAGATGGCAACTCCATACCGAAGGCATTTACCACAGAGGTGAATGGGCAGATGCAACCTTCTATAGAACTAATGATATTGTCAAGTATGGCAATGATCAGTATAGGGTTGTCAACCCCCACACTTCCAGCGGATCTTTCGCTGCTGCAAACTTCGTCTCGTATATTAACGGACTGAAGTTTGAAGATACGTGGGACACCAATACTGAATACCAACCAGGTGACATTGTAACTTTCGGTGGTTACTCTTATGTTGCTCAAACAATCTCTACTGGTTCACAACCCAATAGCACTATTGGTAGTGACTGGGAGATCCTAACTACTGGTTTCAAGGTAGTTGGTACATGGAGCAACAGCACCGAATACAAGCCTGGTGACGTTGTACTCCTTGGTGGTAACTCCTACGTTGCTAAAACAACCAACACAAACTCCACACCTGGATCTAATCCTTCTGATTGGGACTTCGTTGTTGGTGGTTTCACCTGGAGAGGCACTTGGGATACAAGCACAACTTACCAACCTGGTGATGCTGTCACCAGAGCAAGTAACTCCTACATCTGTGTTGCCGAAACAACTGGCAACGAACCTGAACTAGATGTTAACGGAGACTACTGGAACTCCCTGACCCAAGGCGCACAGTCTAACGTACTAACCGATGCTGGTGATGTTCTTTACATCTCTGGTTCAGGTGCTGCAAGACTACCTATTGGAACAACTGGTCAAGTTCTATCCGTTGATTCTAACGGATTCCCCGCATGGGAAAACAACAATGTTACCGACCCTGTTTACTATGTTACCACAAATGGTAACGACCTAAACGACGGTTCTAACATCAGCAAAGCATTTGCTTCACTCTCTCATGCAGTAAGTCTTGTTACTGGTCCTGCTACCATTTATGTTAAGGCAGGTATCTATAACGAAACTCTACCAATCATCGTTCCCGAGAACGTTTCGATCATTGGTGACAACATGAGAACGTCCACCGTTAAACCAAACGTTGGACAACCTTCTAACATCCAAAGACTAACACTTGCAACGATTCCTCTTGCTGCAGAGAGAGTCATTGGCGAGACATGCACAAATGGTGCTGGCGATAAGACCGCACAGATCATGGATGTCAGAGACGGTGGTGCTAGCATCGACGTTATGCCTCTTACTGGCGGCGTCTGGACTACCTCCGATACTTTCGACAATGGTGGTGCTAATATCGCACTTAACACCGTGAACACTCTCAATAACGAGAACGCAACTCTCTTCTATCTGTCTAACAGATCGATGCTGAAGGATCTCGTTATGGACGGTATGGCAGGATTCGTTCCTTCTGTATCCGATCCAAAGGATATGAACACCTCTACTCCAGATGGTGTATTCGTTAGACTGAACCCCAACTCCCCAATCTCCAAGTCTCCTTACGTTTCGCAGTGTTCTGCATTCTCCCAGACTGGTATTGGTGCAATTGTTGACGGTGGTGTTCACGATAAGTATGACGGAACTGGAACTCCTTCTAACAAGTCTATCGTTTTTGACTCCTGGACTAACATCCACGAAAGCGGTGGTGTAGGTTTCTGGATTACGAACAACGGCGCTGCTGAAATCGTATCCTGCTTCACCTACTATTGCCACATCTCTTACACCTCTACTAGAGGCGGTAGAATCAGATCCTTGGCAGGTAACTCCTCCTGGGGTACTTACGCTATTGTTTCCTCTGGTTTCAACGAAAATGAGTCTACTCTCGATGGATTCATCGACGGTATCGAACTCAACTACGATCCCCTTACCCTATCTACAGGCGCAACTTTTGAAAGTGCCGAGAATGTTACGGGTGGTACTTCTGGTGCAGTTGGCGAAATTACTAGTTTCCAACCTTCGGCAGACAAGATTCTTATCCGTCCTCTCAAAGGTAACTTTGCACAGAACGAAGTTGTCACTGGTAGCAATTCTACAGCAACTGCAACTCTGGTCAACAACTCTGACGCTCAAAAGGGTATGTCAGGTTTCACCTTTGTTCTCGGTGGTCTAACCGCTGCTCCTGACCCAGGTGGTTCTATTGAATACATCACTGGTCCTGGTGGACTCGGTTCTGATCTATTCACTTATGTTGTTGCTAACTCTTCTTACGCTGGTCCTACTGGACGTGGAGAACTGACTGTAACCAGAGGACTTCTTGGTTCTGCTGCTACAACTCATGATGGTTTGAGCACTGTTGCTAGATACCAAACTGGTACTGCAACATCTCTATCTGCTCCTGTTAGTGACGCGGTTGGCACTGTCATCCAAGTTGCTTCAATTACTGGCATTAACACTGGTGGTTATGTCATCATCGAAGACGAGATGATGGAAGTCGTTTCGTTCCCAACTGCAACTTCTGTTGAAGTTATCAGAGGAGTAGAAGGCACCACTGGTGCTGCACATAACTCTGGCGTTACAGTCAGAGCACTTCAGATCAAGGTTCCTACCGAGACAACTACCGCTAGAGACCTAACAGCATCTGACACAGTTATTCTTGTTGAAACGTCTACGGGTACTCTATCCTCTGACTACATCAAGATTGACAGTGAGTTCATGCAGGTTTCCCAATCCGCAACAATTACAACTGGTACTGTACTGGTTGTTCTTGCAGAAGAGAAGCCTAGTGCAACTTACGATCGTCAAGCTACAAGAATCAGATACCTGTATTCACAAGTCAGACTAACTGGTCATGACTTCCTGGATATCGGTACTGGTAACAAGACCCAGACTAACTGGCCAGGTCAGCCTCTATCGGCACCTGCACCAGGTAATGAGGTTACTGAAAACTTCCCTGGTCGTGTGTTCTTCGTATCCACGGACCAAGATGGTAACTTCACCGTTGGTCGTTACTTCAAAGTTAACCAGGCAACTGGTAGCACAACCTTGAACGCATCTTCCTTCGACTTGTCTGGTCTATCATCCTTGAGACTTGGTTCCATCGGTGCTCAAATCGGTGAATCTATTAACGAGTTCTCGGCGGATGTAACCATGTCTGCAAATAGCAACGCTAAAGTTCCTACGCAGAAGGCAGTCAAGACTTACGTTGACACAAAGACGAAGACGAAAGGCTTCACTTTCTGGGCGGGAGCAATGTGA

Genbank protein accession
AOV57607.1 [NCBI]
Genbank nucleotide accession
KU686193 [NCBI]
CDS location
range 102183 -> 105455
strand +
CDS
ATGGCAGATTTCAGATTAGGCAGACTTAAGTTTAATTGGAGGGGCGACTGGACAGTTGCCACTGCATACGTCATCGATGACATCGTTAAGTTTGGTGCAAACACTTTTGTTTGTATTTCAAACCACACGTCAGCATCGAATGAGGCGCAATGGTATGGATCGGATGGTGCCAGATGGCAACTCCATACCGAAGGCATTTACCACAGAGGTGAATGGGCAGATGCAACCTTCTATAGAACTAATGATATTGTCAAGTATGGCAATGATCAGTATAGGGTTGTCAACCCCCACACTTCCAGCGGATCTTTCGCTGCTGCAAACTTCGTCTCGTATATTAACGGACTGAAGTTTGAAGATACGTGGGACACCAATACTGAATACCAACCAGGTGACATTGTAACTTTCGGTGGTTACTCTTATGTTGCTCAAACAATCTCTACTGGTTCACAACCCAATAGCACTATTGGTAGTGACTGGGAGATCCTAACTACTGGTTTCAAGGTAGTTGGTACATGGAGCAACAGCACCGAATACAAGCCTGGTGACGTTGTACTCCTTGGTGGTAACTCCTACGTTGCTAAAACAACCAACACAAACTCCACACCTGGATCTAATCCTTCTGATTGGGACTTCGTTGTTGGTGGTTTCACCTGGAGAGGCACTTGGGATACAAGCACAACTTACCAACCTGGTGATGCTGTCACCAGAGCAAGTAACTCCTACATCTGTGTTGCCGAAACAACTGGCAACGAACCTGAACTAGATGTTAACGGAGACTACTGGAACTCCCTGACCCAAGGCGCACAGTCTAACGTACTAACCGATGCTGGTGATGTTCTTTACATCTCTGGTTCAGGTGCTGCAAGACTACCTATTGGAACAACTGGTCAAGTTCTATCCGTTGATTCTAACGGATTCCCCGCATGGGAAAACAACAATGTTACCGACCCTGTTTACTATGTTACCACAAATGGTAACGACCTAAACGACGGTTCTAACATCAGCAAAGCATTTGCTTCACTCTCTCATGCAGTAAGTCTTGTTACTGGTCCTGCTACCATTTATGTTAAGGCAGGTATCTATAACGAAACTCTACCAATCATCGTTCCCGAGAACGTTTCGATCATTGGTGACAACATGAGAACGTCCACCGTTAAACCAAACGTTGGACAACCTTCTAACATCCAAAGACTAACACTTGCAACGATTCCTCTTGCTGCAGAGAGAGTCATTGGCGAGACATGCACAAATGGTGCTGGCGATAAGACCGCACAGATCATGGATGTCAGAGACGGTGGTGCTAGCATCGACGTTATGCCTCTTACTGGCGGCGTCTGGACTACCTCCGATACTTTCGACAATGGTGGTGCTAATATCGCACTTAACACCGTGAACACTCTCAATAACGAGAACGCAACTCTCTTCTATCTGTCTAACAGATCGATGCTGAAGGATCTCGTTATGGACGGTATGGCAGGATTCGTTCCTTCTGTATCCGATCCAAAGGATATGAACACCTCTACTCCAGATGGTGTATTCGTTAGACTGAACCCCAACTCCCCAATCTCCAAGTCTCCTTACGTTTCGCAGTGTTCTGCATTCTCCCAGACTGGTATTGGTGCAATTGTTGACGGTGGTGTTCACGATAAGTATGACGGAACTGGAACTCCTTCTAACAAGTCTATCGTTTTTGACTCCTGGACTAACATCCACGAAAGCGGTGGTGTAGGTTTCTGGATTACGAACAACGGCGCTGCTGAAATCGTATCCTGCTTCACCTACTATTGCCACATCTCTTACACCTCTACTAGAGGCGGTAGAATCAGATCCTTGGCAGGTAACTCCTCCTGGGGTACTTACGCTATTGTTTCCTCTGGTTTCAACGAAAATGAGTCTACTCTCGATGGATTCATCGACGGTATCGAACTCAACTACGATCCCCTTACCCTATCTACAGGCGCAACTTTTGAAAGTGCCGAGAATGTTACGGGTGGTACTTCTGGTGCAGTTGGCGAAATTACTAGTTTCCAACCTTCGGCAGACAAGATTCTTATCCGTCCTCTCAAAGGTAACTTTGCACAGAACGAAGTTGTCACTGGTAGCAATTCTACAGCAACTGCAACTCTGGTCAACAACTCTGACGCTCAAAAGGGTATGTCAGGTTTCACCTTTGTTCTCGGTGGTCTAACCGCTGCTCCTGACCCAGGTGGTTCTATTGAATACATCACTGGTCCTGGTGGACTCGGTTCTGATCTATTCACTTATGTTGTTGCTAACTCTTCTTACGCTGGTCCTACTGGACGTGGAGAACTGACTGTAACCAGAGGACTTCTTGGTTCTGCTGCTACAACTCATGATGGTTTGAGCACTGTTGCTAGATACCAAACTGGTACTGCAACATCTCTATCTGCTCCTGTTAGTGACGCGGTTGGCACTGTCATCCAAGTTGCTTCGATTACTGGCATTAACACTGGTGGTTATGTCATCATCGAAGACGAGATGATGGAAGTCGTTTCGTTCCCAACTGCAACTTCTGTTGAAGTTATCAGAGGAGTAGAAGGCACCACTGGTGCTGCACATAATTCTGGCGTTACAGTCAGAGCACTTCAGATCAAGGTTCCTACCGAGACAACTACCGCTAGAGACCTAACAGCATCTGACACAGTTATTCTTGTTGAAACGTCTACGGGTACTCTATCCTCTGACTACATCAAGATTGACAGTGAGTTCATGCAGGTTTCCCAATCCGCAACAATTACAACTGGTACTGTACTGGTTGTTCTTGCAGAAGAGAAGCCTAGTGCAACTTACGATCGTCAAGCTACAAGAATCAGATACCTGTATTCACAAGTCAGACTAACTGGTCATGACTTCCTGGATATCGGTACTGGTAACAAGACCCAGACTAACTGGCCAGGTCAGCCTCTATCGGCACCTGCACCAGGTAATGAGGTTACTGAAAACTTCCCTGGTCGTGTGTTCTTCGTATCCACGGACCAAGATGGTAACTTCACCGTTGGTCGTTACTTCAAAGTTAACCAGGCAACTGGTAGCACAACCTTGAACGCATCTTCCTTCGACTTGTCTGGTCTATCATCCTTGAGACTTGGTTCCATCGGTGCTCAAATCGGTGAATCTATTAACGAGTTCTCGGCGGATGTAACCATGTCTGCAAATAGCAACGCTAAAGTTCCTACGCAGAAGGCAGTCAAGACTTACGTTGACACAAAGACGAAGACGAAAGGCTTCACTTTCTGGGCGGGAGCAATGTGA

Genbank protein accession
AOV57857.1 [NCBI]
Genbank nucleotide accession
KU686194 [NCBI]
CDS location
range 102181 -> 105453
strand +
CDS
ATGGCAGATTTCAGATTAGGCAGACTTAAGTTTAATTGGAGGGGCGACTGGACAGTTGCCACTGCATACGTCATCGATGACATCGTTAAGTTTGGTGCAAACACTTTTGTTTGTATTTCAAACCACACGTCAGCATCGAATGAGGCGCAATGGTATGGATCGGATGGTGCCAGATGGCAACTCCATACCGAAGGCATTTACCACAGAGGTGAATGGGCAGATGCAACCTTCTATAGAACTAATGATATTGTCAAGTATGGCAATGATCAGTATAGGGTTGTCAACCCCCACACTTCCAGCGGATCTTTCGCTGCTGCAAACTTCGTCTCGTATATTAACGGACTGAAGTTTGAAGATACGTGGGACACCAATACTGAATACCAACCAGGTGACATTGTAACTTTCGGTGGTTACTCTTATGTTGCTCAAACAATCTCTACTGGTTCACAACCCAATAGCACTATTGGTAGTGACTGGGAGATCCTAACTACTGGTTTCAAGGTAGTTGGTACATGGAGCAACAGCACCGAATACAAGCCTGGTGACGTTGTACTCCTTGGTGGTAACTCCTACGTTGCTAAAACAACCAACACAAACTCCACACCTGGATCTAATCCTTCTGATTGGGACTTCGTTGTTGGTGGTTTCACCTGGAGAGGCACTTGGGATACAAGCACAACTTACCAACCTGGTGATGCTGTCACCAGAGCAAGTAACTCCTACATCTGTGTTGCCGAAACAACTGGCAACGAACCTGAACTAGATGTTAACGGAGACTACTGGAACTCCCTGACCCAAGGCGCACAGTCTAACGTACTAACCGATGCTGGTGATGTTCTTTACATCTCTGGTTCAGGTGCTGCAAGACTACCTATTGGAACAACTGGTCAAGTTCTATCCGTTGATTCTAACGGATTCCCCGCATGGGAAAACAACAATGTTACCGACCCTGTTTACTATGTTACCACAAATGGTAACGACCTAAACGACGGTTCTAACATCAGCAAAGCATTTGCTTCACTCTCTCATGCAGTAAGTCTTGTTACTGGTCCTGCTACCATTTATGTTAAGGCAGGTATCTATAACGAAACTCTACCAATCATCGTTCCCGAGAACGTTTCGATCATTGGTGACAACATGAGAACGTCCACCGTTAAACCAAACGTTGGACAACCTTCTAACATCCAAAGACTAACACTTGCAACGATTCCTCTTGCTGCAGAGAGAGTCATTGGCGAGACATGCACAAATGGTGCTGGTGATAAGACCGCACAGATCATGGATGTCAGAGACGGTGGTGCTAGCATCGACGTTATGCCTCTTACTGGCGGCGTCTGGACTACCTCCGATACTTTCGACAATGGTGGTGCTAATATCGCACTTAACACCGTGAACACTCTCAATAACGAGAACGCAACTCTCTTCTATCTGTCTAACAGATCGATGCTGAAGGATCTCGTTATGGACGGTATGGCAGGATTCGTTCCTTCTGTATCCGATCCAAAGGATATGAACACCTCTACTCCAGATGGTGTATTCGTTAGACTGAACCCCAACTCCCCAATCTCCAAGTCTCCTTACGTTTCGCAGTGTTCTGCATTCTCCCAGACTGGTATTGGTGCAATTGTTGACGGTGGTGTTCACGATAAGTATGACGGAACTGGAACTCCTTCTAACAAGTCTATCGTTTTTGACTCCTGGACTAACATCCACGAAAGCGGTGGTGTAGGTTTCTGGATTACGAACAACGGCGCTGCTGAAATCGTATCCTGCTTCACCTACTATTGCCACATCTCTTACACCTCTACTAGAGGCGGTAGAATCAGATCCTTGGCAGGTAACTCCTCCTGGGGTACTTACGCTATTGTTTCCTCTGGTTTCAACGAAAATGAGTCTACTCTCGATGGATTCATCGACGGTATCGAACTCAACTACGATCCCCTTACCCTATCTACAGGCGCAACTTTTGAAAGTGCCGAGAATGTTACGGGTGGTACTTCTGGTGCAGTTGGCGAAATTACTAGTTTCCAACCTTCGGCAGACAAGATTCTTATCCGTCCTCTCAAAGGTAACTTTGCACAGAACGAAGTTGTCACTGGTAGCAATTCTACAGCAACTGCAACTCTGGTCAACAACTCTGACGCTCAAAAGGGTATGTCAGGTTTCACCTTTGTTCTCGGTGGTCTAACCGCTGCTCCTGACCCAGGTGGTTCTATTGAATACATCACTGGTCCTGGTGGACTCGGTTCTGATCTATTCACTTATGTTGTTGCTAACTCTTCTTACGCTGGTCCTACTGGACGTGGAGAACTGACTGTAACCAGAGGACTTCTTGGTTCTGCTGCTACAACTCATGATGGTTTGAGCACTGTTGCTAGATACCAAACTGGTACTGCAACATCTCTATCTGCTCCTGTTAGTGACGCGGTTGGCACTGTCATCCAAGTTGCTTCGATTACTGGCATTAACACTGGTGGTTATGTCATCATCGAAGACGAGATGATGGAAGTCGTTTCGTTCCCAACTGCAACTTCTGTTGAAGTTATCAGAGGAGTAGAAGGCACCACTGGTGCTGCACATAACTCTGGCGTTACAGTCAGAGCACTTCAGATCAAGGTTCCTACCGAGACAACTACCGCTAGAGACCTAACAGCATCTGACACAGTTATTCTTGTTGAAACGTCTACGGGTACTCTATCCTCTGACTACATCAAGATTGACAGTGAGTTCATGCAGGTTTCCCAATCCGCAACAATTACAACTGGTACTGTACTGGTTGTTCTTGCAGAAGAGAAGCCTAGTGCAACTTACGATCGTCAAGCTACAAGAATCAGATACCTGTATTCACAAGTCAGACTAACTGGTCATGACTTCCTGGATATCGGTACTGGTAACAAGACCCAGACTAACTGGCCAGGTCAGCCTCTATCGGCACCTGCACCAGGTAATGAGGTTACTGAAAACTTCCCTGGTCGTGTGTTCTTCGTATCCACGGACCAAGATGGTAACTTCACCGTTGGTCGTTACTTCAAAGTTAACCAGGCAACTGGTAGCACAACCTTGAACGCATCTTCCTTCGACTTGTCTGGTCTATCATCCTTGAGACTTGGTTCCATCGGTGCTCAAATCGGTGAATCTATTAACGAGTTCTCGGCGGATGTAACCATGTCTGCAAATAGCAACGCTAAAGTTCCTACGCAGAAGGCAGTCAAGACTTACGTTGACACAAAGACGAAGACGAAAGGCTTCACTTTCTGGGCGGGAGCAATGTGA

Genbank protein accession
AOV58107.1 [NCBI]
Genbank nucleotide accession
KU686195 [NCBI]
CDS location
range 102181 -> 105453
strand +
CDS
ATGGCAGATTTCAGATTAGGCAGACTTAAGTTTAATTGGAGGGGCGACTGGACAGTTGCCACTGCATACGTCATCGATGACATCGTTAAGTTTGGTGCAAACACTTTTGTTTGTATTTCAAACCACACGTCAGCATCGAATGAGGCGCAATGGTATGGATCGGATGGTGCCAGATGGCAACTCCATACCGAAGGCATTTACCACAGAGGTGAATGGGCAGATGCAACCTTCTATAGAACTAATGATATTGTCAAGTATGGCAATGATCAGTATAGGGTTGTCAACCCCCACACTTCCAGCGGATCTTTCGCTGCTGCAAACTTCGTCTCGTATATTAACGGACTGAAGTTTGAAGATACGTGGGACACCAATACTGAATACCAACCAGGTGACATTGTAACTTTCGGTGGTTACTCTTATGTTGCTCAAACAATCTCTACTGGTTCACAACCCAATAGCACTATTGGTAGTGACTGGGAGATCCTAACTACTGGTTTCAAGGTAGTTGGTACATGGAGCAACAGCACCGAATACAAGCCTGGTGACGTTGTACTCCTTGGTGGTAACTCCTACGTTGCTAAAACAACCAACACAAACTCCACACCTGGATCTAATCCTTCTGATTGGGACTTCGTTGTTGGTGGTTTCACCTGGAGAGGCACTTGGGATACAAGCACAACTTACCAACCTGGTGATGCTGTCACCAGAGCAAGTAACTCCTACATCTGTGTTGCCGAAACAACTGGCAACGAACCTGAACTAGATGTTAACGGAGACTACTGGAACTCCCTGACCCAAGGCGCACAGTCTAACGTACTAACCGATGCTGGTGATGTTCTTTACATCTCTGGTTCAGGTGCTGCAAGACTACCTATTGGAACAACTGGTCAAGTTCTATCCGTTGATTCTAACGGATTCCCCGCATGGGAAAACAACAATGTTACCGACCCTGTTTACTATGTTACCACAAATGGTAACGACCTAAACGACGGTTCTAACATCAGCAAAGCATTTGCTTCACTCTCTCATGCAGTAAGTCTTGTTACTGGTCCTGCTACCATTTATGTTAAGGCAGGTATCTATAACGAAACTCTACCAATCATCGTTCCCGAGAACGTTTCGATCATTGGTGACAACATGAGAACGTCCACCGTTAAACCAAACGTTGGACAACCTTCTAACATCCAAAGACTAACACTTGCAACGATTCCTCTTGCTGCAGAGAGAGTCATTGGCGAGACATGCACAAATGGTGCTGGCGATAAGACCGCACAGATCATGGATGTCAGAGACGGTGGTGCTAGCATCGACGTTATGCCTCTTACTGGCGGCGTCTGGACTACCTCCGATACTTTCGACAATGGTGGTGCTAATATCGCACTTAACACCGTGAACACTCTCAATAACGAGAACGCAACTCTCTTCTATCTGTCTAACAGATCGATGCTGAAGGATCTCGTTATGGACGGTATGGCAGGATTCGTTCCTTCTGTATCCGATCCAAAGGATATGAACACCTCTACTCCAGATGGTGTATTCGTTAGACTGAACCCCAACTCCCCAATCTCCAAGTCTCCTTACGTTTCGCAGTGTTCTGCATTCTCCCAGACTGGTATTGGTGCAATTGTTGACGGTGGTGTTCACGATAAGTATGACGGAACTGGAACTCCTTCTAACAAGTCTATCGTTTTTGACTCCTGGACTAACATCCACGAAAGCGGTGGTGTAGGTTTCTGGATTACGAACAACGGCGCTGCTGAAATCGTATCCTGCTTCACCTACTATTGCCACATCTCTTACACCTCTACTAGAGGCGGTAGAATCAGATCCTTGGCAGGTAACTCCTCCTGGGGTACTTACGCTATTGTTTCCTCTGGTTTCAACGAAAATGAGTCTACTCTCGATGGATTCATCGACGGTATCGAACTCAACTACGATCCCCTTACCCTATCTACAGGCGCAACTTTTGAAAGTGCCGAGAATGTTACGGGTGGTACTTCTGGTGCAGTTGGTGAAATTACTAGTTTCCAACCTTCGGCAGATAAGATTCTTATCCGTCCTCTCAAAGGTAACTTTGCACAGAACGAAGTTGTCACTGGTAGCAATTCTACAGCAACTGCAACTCTGGTCAACAACTCTGACGCTCAAAAGGGTATGTCAGGTTTCACCTTTGTTCTCGGTGGTCTAACCGCTGCTCCTGACCCAGGTGGTTCTATTGAATACATCACTGGTCCTGGTGGACTCGGTTCTGATCTATTCACTTATGTTGTTGCTAACTCTTCTTACGCTGGTCCTACTGGACGTGGAGAACTGACTGTAACCAGAGGACTTCTTGGTTCTGCTGCTACAACTCATGATGGTTTGAGCACTGTTGCTAGATACCAAACTGGTACTGCAACATCTCTATCTGCTCCTGTTAGTGACGCGGTTGGCACTGTCATCCAAGTTGCTTCGATTACTGGCATTAACACTGGTGGTTATGTCATCATCGAAGACGAGATGATGGAAGTCGTTTCGTTCCCAACTGCAACTTCTGTTGAAGTTATCAGAGGAGTAGAAGGCACCACTGGTGCTGCACATAACTCTGGCGTTACAGTCAGAGCACTTCAGATCAAGGTTCCTACCGAGACAACTACCGCTAGAGACCTAACAGCATCTGACACAGTTATTCTTGTTGAAACGTCTACGGGTACTCTATCCTCTGACTACATCAAGATTGACAGTGAGTTCATGCAGGTTTCCCAATCCGCAACAATTACAACTGGTACTGTACTGGTTGTTCTTGCAGAAGAGAAGCCTAGTGCAACTTACGATCGTCAAGCTACAAGAATCAGATACCTGTATTCACAAGTCAGACTAACTGGTCATGACTTCCTGGATATCGGTACTGGTAACAAGACCCAGACTAACTGGCCAGGTCAGCCTCTATCGGCACCTGCACCAGGTAATGAGGTTACTGAAAACTTCCCTGGTCGTGTGTTCTTCGTATCCACGGACCAAGATGGTAACTTCACCGTTGGTCGTTACTTCAAAGTTAACCAGGCAACTGGTAGCACAACCTTGAACGCATCTTCCTTCGACTTGTCTGGTCTATCATCCTTGAGACTTGGTTCCATCGGTGCTCAAATCGGTGAATCTATTAACGAGTTCTCGGCGGATGTAACCATGTCTGCAAATAGCAACGCTAAAGTTCCTACGCAGAAGGCAGTCAAGACTTACGTTGACACAAAGACGAAGACGAAAGGCTTCACTTTCTGGGCGGGAGCAATGTGA

Genbank protein accession
AOV58357.1 [NCBI]
Genbank nucleotide accession
KU686196 [NCBI]
CDS location
range 102181 -> 105453
strand +
CDS
ATGGCAGATTTCAGATTAGGCAGACTTAAGTTTAATTGGAGGGGCGACTGGACAGTTGCCACTGCATACGTCATCGATGACATCGTTAAGTTTGGTGCAAACACTTTTGTTTGTATTTCAAACCACACGTCAGCATCGAATGAGGCGCAATGGTATGGATCGGATGGTGCCAGATGGCAACTCCATACCGAAGGCATTTACCACAGAGGTGAATGGGCAGATGCAACCTTCTATAGAACTAATGATATTGTCAAGTATGGCAATGATCAGTATAGGGTTGTCAACCCCCACACTTCCAGCGGATCTTTCGCTGCTGCAAACTTCGTCTCGTATATTAACGGACTGAAGTTTGAAGATACGTGGGACACCAATACTGAATACCAACCAGGTGACATTGTAACTTTCGGTGGTTACTCTTATGTTGCTCAAACAATCTCTACTGGTTCACAACCCAATAGCACTATTGGTAGTGACTGGGAGATCCTAACTACTGGTTTCAAGGTAGTTGGTACATGGAGCAACAGCACCGAATACAAGCCTGGTGACGTTGTACTCCTTGGTGGTAACTCCTACGTTGCTAAAACAACCAACACAAACTCCACACCTGGATCTAATCCTTCTGATTGGGACTTCGTTGTTGGTGGTTTCACCTGGAGAGGCACTTGGGATACAAGCACAACTTACCAACCTGGTGATGCTGTCACCAGAGCAAGTAACTCCTACATCTGTGTTGCCGAAACAACTGGCAACGAACCTGAACTAGATGTTAACGGAGACTACTGGAACTCCCTGACCCAAGGCGCACAGTCTAACGTACTAACCGATGCTGGTGATGTTCTTTACATCTCTGGTTCAGGTGCTGCAAGACTACCTATTGGAACAACTGGTCAAGTTCTATCCGTTGATTCTAACGGATTCCCCGCATGGGAAAACAACAATGTTACCGACCCTGTTTACTATGTTACCACAAATGGTAACGACCTAAACGACGGTTCTAACATCAGCAAAGCATTTGCTTCACTCTCTCATGCAGTAAGTCTTGTTACTGGTCCTGCTACCATTTATGTTAAGGCAGGTATCTATAACGAAACTCTACCAATCATCGTTCCCGAGAACGTTTCGATCATTGGTGACAACATGAGAACGTCCACCGTTAAACCAAACGTTGGACAACCTTCTAACATCCAAAGACTAACACTTGCAACGATTCCTCTTGCTGCAGAGAGAGTCATTGGCGAGACATGCACAAATGGTGCTGGCGATAAGACCGCACAGATCATGGATGTCAGAGACGGTGGTGCTAGCATCGACGTTATGCCTCTTACTGGCGGCGTCTGGACTACCTCCGATACTTTCGACAATGGTGGTGCTAATATCGCACTTAACACCGTGAACACTCTCAATAACGAGAACGCAACTCTCTTCTATCTGTCTAACAGATCGATGCTGAAGGATCTCGTTATGGACGGTATGGCAGGATTCGTTCCTTCTGTATCCGATCCAAAGGATATGAACACCTCTACTCCAGATGGTGTATTCGTTAGACTGAACCCCAACTCCCCAATCTCCAAGTCTCCTTACGTTTCGCAGTGTTCTGCATTCTCCCAGACTGGTATTGGTGCAATTGTTGACGGTGGTGTTCACGATAAGTATGACGGAACTGGAACTCCTTCTAACAAGTCTATCGTTTTTGACTCCTGGACTAACATCCACGAAAGCGGTGGTGTAGGTTTCTGGATTACGAACAACGGCGCTGCTGAAATCGTATCCTGCTTCACCTACTATTGCCACATCTCTTACACCTCTACTAGAGGCGGTAGAATCAGATCCTTGGCAGGTAACTCCTCCTGGGGTACTTACGCTATTGTTTCCTCTGGTTTCAACGAAAATGAGTCTACTCTCGATGGATTCATCGACGGTATCGAACTCAACTACGATCCCCTTACCCTATCTACAGGCGCAACTTTTGAAAGTGCCGAGAATGTTACGGGTGGTACTTCTGGTGCAGTTGGTGAAATTACTAGTTTCCAACCTTCGGCAGATAAGATTCTTATCCGTCCTCTCAAAGGTAACTTTGCACAGAACGAAGTTGTCACTGGTAGCAATTCTACAGCAACTGCAACTCTGGTCAACAACTCTGACGCTCAAAAGGGTATGTCAGGTTTCACCTTTGTTCTCGGTGGTCTAACCGCTGCTCCTGACCCAGGTGGTTCTATTGAATACATCACTGGTCCTGGTGGACTCGGTTCTGATCTATTCACTTATGTTGTTGCTAACTCTTCTTACGCTGGTCCTACTGGACGTGGAGAACTGACTGTAACCAGAGGACTTCTTGGTTCTGCTGCTACAACTCATGATGGTTTGAGCACTGTTGCTAGATACCAAACTGGTACTGCAACATCTCTATCTGCTCCTGTTAGTGACGCGGTTGGCACTGTCATCCAAGTTGCTTCGATTACTGGCATTAACACTGGTGGTTATGTCATCATCGAAGACGAGATGATGGAAGTCGTTTCGTTCCCAACTGCAACTTCTGTTGAAGTTATCAGAGGAGTAGAAGGCACCACTGGTGCTGCACATAACTCTGGCGTTACAGTCAGAGCACTTCAGATCAAGGTTCCTACCGAGACAACTACCGCTAGAGACCTCACGGCATCTGATACAGTTATTCTTGTTGAAACGTCTACGGGTACTCTATCCTCTGACTACATCAAGATTGACAGTGAGTTCATGCAGGTTTCCCAATCCGCAACAATTACAACTGGTACTGTACTGGTTGTTCTTGCAGAAGAGAAGCCTAGTGCAACTTACGATCGTCAAGCTACAAGAATCAGATACCTGTATTCACAAGTCAGACTAACTGGTCATGACTTCCTGGATATCGGTACTGGTAACAAGACCCAGACTAACTGGCCAGGTCAGCCTCTATCGGCACCTGCACCAGGTAATGAGGTTACTGAAAACTTCCCTGGTCGTGTGTTCTTCGTATCCACGGACCAAGATGGTAACTTCACCGTTGGTCGTTACTTCAAAGTTAACCAGGCAACTGGTAGCACAACCTTGAACGCATCTTCCTTCGACTTGTCTGGTCTATCATCCTTGAGACTTGGTTCCATCGGTGCTCAAATCGGTGAATCTATTAACGAGTTCTCGGCGGATGTAACCATGTCTGCAAATAGCAACGCTAAAGTTCCTACGCAGAAGGCAGTCAAGACTTACGTTGACACAAAGACGAAGACGAAAGGCTTCACTTTCTGGGCGGGAGCAATGTGA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0005576 extracellular region Cellular Component IEA:InterPro (UniProt)
GO:0044423 virion component Cellular Component IEA:UniProtKB-KW (UniProt)
GO:0030246 carbohydrate binding Molecular Function IEA:InterPro (UniProt)
GO:0004553 hydrolase activity, hydrolyzing O-glycosyl compounds Molecular Function IEA:InterPro (UniProt)
GO:0051701 biological process involved in interaction with host Biological Process IEA:UniProtKB-ARBA (UniProt)
GO:0005975 carbohydrate metabolic process Biological Process IEA:InterPro (UniProt)
GO:0019058 viral life cycle Biological Process IEA:UniProtKB-ARBA (UniProt)

Tertiary structure

PDB ID
65f5a9c149c695d04ef7af0bcfd58707e73259af3320c46d83fb96d17fb214cb
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6618
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50