Genbank accession
YP_003097272.1 [GenBank]
Protein name
virion structural protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,84
TF
Evidence RBPdetect2
Probability 0,97
Protein sequence
MADRFPLIVNAVSKKIEEIVAGDRMDLTGNGIVVSGDGGAGKYLYSDGTVVSWNSPGDVYLNQTQIITNKTFETCIISGSVNTLTNIPNSALLNPGITINGSTVNLGGTISTPDTNTTYSISAADGAIASEKVIRLSAGGSGTGSDDITLIAGSNMTIQRTGDELTFISSYVDTDTITTLAAATGGTAQSGAITIAASGAASVSQNSGTKTITINATDTDTITRLRATTGSAYNSGDITFLASGSSTVSQGVDAGTGSPTITYDSTDTITRVKGGAVGSFQSGDITISGGLNTTVSQTGSNITIDSTDTNTITRVASGSNSVQSGDFVFTSSGATSISQSTVGGVTTINISSVNTDSGAAITASGGLIFSASDISLKNNANLVTNTLTKWDGGNNQLANSIITDDGSTVTIGGDLLVTGTQTVLEVSTLVVEDNIIELRKGNSIVGADGGIQINRTTDSAGNVTSYQRLEWFESGGRWRFNDGSVQKEIITASDTQTLSNKTLTSPIMSSPTLGAASATSINGLEITPTASAVLTFTDGKELEVKRDLVFTSDNNEAAITTNFRSGGNVAYTSDTLAVFNSTTSTQLRALINGTTGTDKLVFNTNPQIETGFITASSSLTLFNTAATDITLFGAATTITMGAAGGTTDLNQSLHVFEDIEIGVDSGGAVTDGDLLVHGIANFDKKDILIRGTSGDPLSIGRGGGSVSTNTRVGVSALDNNSSGSQNTALGYRALLATNSGASNTGIGYRALNQTGNGQKNVAVGADAMLDNTSGQKNVAVGKSSLENNQAGVGNVCIGHYAGWGVTGTGNVLIGPADDENSTNATHTPDDPSGDRQLVIGSGTGTWIKGDSNFAITIPNNFTVEGDTVVQGQLTVNGTLTSINSNIIQIDDKNLELAAVVNTTFEAVTLDGSNIISAINPTANLIPGMEVTSTTGGISVPVGTLITTITGNQAELSNSVSGTGTASFTATGPSDTSANGGGVIVKGTTNHSILYDNRTDKFFTSTDNFELAFGKSYYINNQLALSTTTLGSTVVNSSLTSVGVLVGPSGSPALEVDGAAVLGGRVIEKVFSSFSSNFVLAGNTLNITTAAANTICGTTPTTAINTWAFTTADPDGNTLQNGQSITVTVIIDANTAASYGDACTVDGNSIVSGVQWAGGSPPLATSNTDILSFIIIKDNSGVVRVYGQGNTDFS
Physico‐chemical
properties
protein length:1193 AA
molecular weight: 121118,38780 Da
isoelectric point:4,26545
aromaticity:0,04946
hydropathy:-0,00897

Domains

Domains [InterPro]
DC_0299
STR
420–941
DC_1864
STR
930–1193
YP_003097272.1
1 1193
Architecture
STR
STR 420-1193
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_003097272.1
1 1193
Domain Start End Length (AA) Confidence
N-terminal 1 711 711 0,4456
Central domain 712 910 200 0,6455
C-terminal 911 1193 282 0,8747
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-711
Central
712-910
C-terminal
911-1193

Taxonomy

  Name Taxonomy ID Lineage
Phage Synechococcus phage S-RSM4
[NCBI]
555387 Uroviricota > Caudoviricetes > Pantevenvirales > Gibbetvirus > Gibbetvirus rsm4
Host Synechococcus sp. WH 7803
[NCBI]
32051 Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_003097272.1 [NCBI]
Genbank nucleotide accession
NC_013085 [NCBI]
CDS location
range 21315 -> 24896
strand -
CDS
ATGGCTGATCGTTTTCCTCTTATTGTTAATGCTGTTTCTAAGAAAATTGAAGAAATTGTAGCAGGCGACAGAATGGACTTGACTGGCAACGGAATCGTTGTTAGTGGAGATGGTGGCGCGGGAAAATATTTGTATAGTGATGGAACCGTAGTTTCTTGGAATTCTCCTGGCGATGTTTATTTAAATCAAACTCAAATTATAACAAACAAAACTTTTGAAACTTGTATTATTTCTGGTTCAGTAAATACTCTAACCAATATTCCAAATAGTGCATTATTAAATCCTGGGATTACTATTAACGGATCTACAGTAAACCTGGGCGGAACTATTTCAACACCTGATACAAATACTACATATAGTATTTCTGCAGCAGATGGTGCTATTGCTTCCGAAAAAGTTATTCGTCTTTCTGCTGGTGGATCGGGAACTGGTTCTGATGATATAACTCTGATCGCTGGGTCAAATATGACCATTCAGAGGACAGGAGATGAACTTACGTTTATTTCTAGCTATGTAGACACAGATACTATTACTACACTTGCTGCAGCAACTGGTGGTACAGCACAGTCTGGAGCAATCACTATCGCTGCTAGTGGAGCAGCAAGTGTTTCTCAAAATAGTGGTACTAAGACTATTACAATTAATGCCACAGATACCGATACTATTACAAGACTGAGAGCTACTACTGGATCTGCGTATAATTCTGGGGACATTACATTTTTAGCATCTGGATCTTCCACTGTATCTCAGGGTGTTGATGCTGGAACTGGAAGTCCAACGATTACATATGATAGCACGGATACTATTACTAGGGTAAAGGGCGGTGCTGTTGGTTCTTTCCAATCAGGAGACATTACGATCTCTGGTGGATTGAATACAACGGTATCTCAGACAGGATCAAATATTACTATTGATAGTACAGATACTAATACTATTACCAGAGTTGCATCTGGAAGTAATAGCGTTCAGTCTGGAGATTTTGTCTTTACATCTTCTGGTGCTACAAGCATTTCCCAATCTACTGTTGGGGGAGTAACAACAATTAACATTAGTTCTGTAAACACAGATAGTGGTGCTGCTATTACTGCTTCTGGTGGTCTTATCTTTTCTGCGTCTGACATTTCTTTAAAGAATAATGCGAACTTAGTTACAAATACATTAACAAAATGGGATGGTGGAAACAATCAACTTGCCAACAGCATCATTACTGATGACGGTTCTACGGTAACTATTGGTGGAGATTTATTAGTTACTGGAACTCAAACAGTCTTGGAAGTTTCAACATTGGTTGTTGAAGATAACATCATTGAATTGAGAAAAGGAAATAGTATAGTAGGTGCAGATGGCGGTATTCAAATTAATAGAACAACAGATTCTGCTGGTAATGTAACATCTTATCAAAGACTTGAGTGGTTTGAATCTGGAGGTCGGTGGAGATTTAATGATGGATCTGTACAAAAAGAAATTATTACTGCGTCGGATACTCAAACTCTATCTAATAAGACTTTAACGTCTCCTATTATGTCATCTCCAACACTTGGAGCGGCGAGTGCTACAAGTATAAATGGATTGGAGATTACTCCTACTGCATCTGCTGTATTGACATTCACTGATGGTAAGGAATTAGAAGTTAAGAGAGACTTAGTATTTACTTCTGATAATAATGAAGCGGCAATTACCACTAACTTTAGAAGTGGTGGTAATGTAGCATACACCTCTGATACTCTTGCAGTCTTCAATTCAACTACCTCAACTCAGTTGAGAGCACTAATCAACGGAACTACTGGTACAGATAAACTAGTATTCAATACTAATCCTCAGATTGAAACTGGATTTATTACTGCGTCCAGTTCCTTGACACTATTCAATACTGCTGCTACAGATATTACTTTATTTGGTGCAGCAACTACTATCACTATGGGTGCTGCTGGTGGAACAACTGATTTAAATCAATCTCTCCATGTGTTTGAAGATATTGAAATTGGTGTTGACTCTGGTGGTGCAGTAACTGATGGAGATTTACTCGTTCATGGAATTGCTAATTTTGACAAGAAAGATATTTTAATCCGTGGAACATCTGGAGACCCACTAAGTATTGGTAGAGGTGGTGGATCGGTATCTACAAATACGAGAGTTGGTGTTTCTGCTTTAGACAATAACTCTTCTGGTTCTCAAAATACTGCACTCGGATATAGAGCACTTCTTGCTACAAATAGTGGAGCATCTAATACTGGCATTGGATATCGTGCTCTTAATCAAACAGGTAATGGACAAAAGAACGTTGCTGTCGGTGCCGATGCAATGTTGGACAACACCTCTGGACAAAAGAACGTTGCCGTTGGTAAGAGTTCACTAGAAAACAATCAAGCAGGTGTTGGAAACGTTTGTATTGGACATTATGCTGGATGGGGTGTCACTGGAACTGGTAATGTATTGATTGGTCCAGCAGACGATGAGAATTCTACCAATGCTACACATACACCAGATGATCCTAGTGGTGATAGACAATTAGTAATTGGATCTGGAACTGGTACTTGGATAAAAGGTGATAGTAATTTTGCTATTACAATTCCAAACAATTTTACAGTAGAAGGTGATACTGTAGTTCAGGGACAGTTGACCGTCAACGGAACCTTGACTAGCATCAACTCAAATATCATTCAGATTGACGATAAAAACTTAGAACTTGCTGCGGTTGTCAATACTACTTTTGAAGCAGTTACTTTGGATGGTAGTAATATTATCAGTGCTATCAATCCAACTGCAAATCTTATTCCTGGAATGGAAGTCACATCCACAACAGGTGGCATTAGTGTTCCAGTTGGAACTCTTATTACGACTATTACTGGAAACCAGGCAGAGTTATCTAACTCTGTAAGTGGAACTGGTACAGCGTCGTTTACTGCTACTGGACCAAGTGATACCTCAGCTAATGGGGGTGGAGTTATTGTTAAAGGGACAACAAACCATAGCATTCTTTATGACAATAGAACAGATAAGTTCTTTACTTCTACTGACAACTTTGAACTTGCATTTGGCAAATCCTATTACATCAATAACCAACTAGCACTTTCTACTACTACACTTGGTTCAACTGTAGTGAACTCTTCTCTAACTTCTGTTGGTGTTCTGGTTGGACCATCTGGTTCTCCTGCTCTTGAAGTTGATGGTGCTGCAGTTCTTGGTGGTAGAGTTATTGAAAAAGTATTCAGTAGTTTTTCTTCTAACTTTGTTCTTGCTGGTAATACACTGAATATTACTACTGCTGCTGCTAACACTATTTGTGGCACAACACCAACAACTGCTATTAATACTTGGGCATTCACAACTGCTGATCCAGATGGCAATACATTACAAAACGGTCAGTCAATTACTGTTACTGTAATTATTGATGCAAATACCGCTGCATCTTATGGAGATGCTTGCACGGTTGACGGAAACTCCATTGTTAGTGGTGTACAATGGGCTGGTGGATCACCACCACTTGCCACATCAAATACTGATATTTTATCATTCATTATTATCAAAGATAATTCTGGTGTTGTTAGAGTATACGGACAAGGCAACACAGACTTCAGCTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
f91e98ba04c16b010606bacee93642dcacb050912718eb0e2147fe4a6f648f1d
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5447
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50