Genbank accession
YP_009217792.1 [GenBank]
Protein name
putative tail protein
RBP type
TSP
Evidence RBPdetect
Probability 0,76
Protein sequence
MSILQRPEYPENYTLDSNWVKVLPEDGQPLVAQDLLEMQSIVQGQFQTGMDTLYRDGTILSGVELVVVGNDDTTMDILITEGRVYAAGVVVKTKPARFQVSREGETTFYLEVTTTVLEDESMRAGNQYGPRGASRLVVNSNIVLTGRGYPLYSIRNGIPINRARDLPGGIEETLAERVFERHGNFCVRGLNLALLDRPRTLADTSLVTLNDNYSTLEARATESRNLYLESKSRLDGLLLRLEDARDISSVSPTPANLTILADLETRVEEEEALVATLEATYRERQTAARGGLAELEEARRRSESSLGMSLAPGVAYVVGRRVVIDTPINLALQRTTDSQVVTAATFTYGGVTAIANRTISLQGASTWANVVTQDTKVSISFAPINNSTITVTANTSAATSVETFIDYIITRIATGTDSNSTITGTGITTDAARNLLRDAIAFRRNGPTLVMESIGIGTTSNLVNITIGITITGGAPSNRLGVDVPSGPIGGAASTNEFKLTRRPVKEVTRLVATLQQNTAAIVRGTTPGTSDYLGRDTVSSVKHVFQGSINYTEGRDFQVLDGGRLEWAPNGPGALEPAPGTTYFVMYTYSSQLTLGVDFNLLTATDTIVFTGTRSPAPNTTFQVDYSYFLSRIAIVTLDKEGQPAVIYGEVGVNPQPPAVSGSVLPLARVLISNNSAIIEPIDCRPVNYDSIRQLASAVSSLSDDIDRLRLTTKAEGLAFTNTGAVPNFTSIDALVSSSGINLTESTGMLSPLTNSLTSNRVYSDVRATAPSARPNNAGDPYIVVPTYTESIFLEQTKLTKERSIQQTTAPRLFCRRVIMANRDLGRINPCDELAVRGAALFGSTSNPLYRFINEGNRAEFTRLSRRVREAISAGEAIPSIGANLMGSEEIDKARAQNIRYTIRGEGLPQGSYQLLIADTIMTTAVSINNTPISGTLPFAFRPRSNGILEVELFLPALPPGVHAVVLQSDTLSVSNTLSIFNNNLTHVALGGAASWGLPSSSIDTQPLPLMPRVGFDPLMQTFQAPSDMYLSGLDIRIASAPASGALVISLRDGTATTPGQILLGEALVNGAVLPDIQGRLWTKYVFPTPIYLKEDQYYTLGFRSTEGDWSVFTSEIGEVDILDAGLLIGQQLGINGNLWTSDGTIISNHEREDISMRLYRAVFPTTPISIDLGTYSSSMTAFAFNVRDIVPTGCTIDYQYKVGVNPNWISIAPNTPVCLDRVESILYLRAVSTGTAALAPILEVGTVSIYRNLSPTQHISNWQPILQTSTRFTVAITALMPPSSTLQVRIQFSTGGWHVLSDPTTVILDAGLGLSRLTYEYVSPGPRSGELKWSIDAFGISTTDVPSIMEVVVYGTN
Physico‐chemical
properties
protein length:1359 AA
molecular weight: 146653,00010 Da
isoelectric point:5,04318
aromaticity:0,06843
hydropathy:-0,03208

Domains

Domains [InterPro]
Coil
Unmapped
260–280
YP_009217792.1
1 1359
Architecture
STR
RBD
STR 9-727 | RBD 728-1359
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_009217792.1
1 1359
Domain Start End Length (AA) Confidence
N-terminal 1 362 362 0,9934
Central domain 363 571 210 0,3967
C-terminal 572 1359 787 0,0109
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-362
Central
363-571
C-terminal
572-1359

Taxonomy

  Name Taxonomy ID Lineage
Phage Microcystis phage MaMV-DC
[NCBI]
1357715 Uroviricota > Caudoviricetes > Fukuivirus >
Host Microcystis aeruginosa
[NCBI]
1126 cellular organisms > Bacteria > Bacillati > Cyanobacteriota/Melainabacteria group > Cyanobacteriota > Cyanophyceae

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_009217792.1 [NCBI]
Genbank nucleotide accession
NC_029002 [NCBI]
CDS location
range 109396 -> 113475
strand +
CDS
ATGTCTATATTACAAAGACCAGAATACCCCGAGAATTATACCCTTGATAGTAATTGGGTGAAAGTATTACCAGAGGACGGCCAACCCTTAGTGGCACAGGACCTCCTAGAGATGCAATCAATAGTACAGGGCCAGTTCCAGACCGGTATGGATACGCTCTATAGAGATGGTACTATACTCTCGGGTGTAGAATTAGTCGTCGTAGGTAATGACGATACGACTATGGATATCCTTATAACTGAAGGCCGTGTATATGCTGCGGGCGTAGTAGTCAAGACTAAGCCCGCGCGCTTTCAGGTATCACGAGAAGGAGAGACTACATTTTATCTCGAGGTCACTACTACCGTACTCGAGGATGAGAGTATGCGGGCCGGCAATCAATACGGGCCCCGGGGGGCATCTAGATTAGTAGTTAATAGTAATATAGTCCTTACGGGGCGAGGGTATCCCCTCTACTCTATACGCAATGGAATACCTATTAATAGAGCGAGGGACCTACCTGGTGGTATCGAGGAGACACTAGCAGAGAGAGTATTTGAGAGACACGGTAACTTCTGCGTGCGGGGGCTGAACCTAGCGCTCCTGGACCGCCCCCGCACTCTAGCTGATACTAGTCTAGTGACGCTCAATGATAACTATTCTACACTAGAGGCGCGGGCTACTGAGTCGCGTAACCTATACCTAGAGAGTAAGAGTAGACTAGATGGATTACTACTGCGACTAGAGGACGCACGGGATATAAGTAGTGTCAGCCCCACACCCGCTAACCTGACTATACTCGCTGATCTTGAGACACGTGTAGAGGAAGAAGAGGCCCTGGTAGCTACACTAGAGGCTACCTACAGAGAGAGACAGACAGCAGCACGGGGCGGGCTAGCAGAATTAGAGGAGGCCCGACGTAGATCAGAGTCCTCACTTGGTATGTCACTGGCACCTGGAGTAGCCTACGTCGTGGGGCGTAGAGTAGTTATTGATACACCAATAAACCTAGCGCTACAGCGTACCACAGATAGTCAGGTAGTAACGGCGGCTACATTTACTTATGGAGGTGTAACTGCTATAGCCAACCGCACTATATCGCTACAGGGTGCCTCCACATGGGCTAATGTAGTAACACAGGATACCAAAGTAAGCATAAGCTTTGCCCCTATCAATAACTCGACTATAACTGTGACGGCTAATACTTCAGCAGCCACCTCAGTAGAAACCTTCATAGACTACATAATAACTCGCATAGCTACTGGTACTGATAGTAATAGTACTATTACCGGTACCGGCATTACTACGGATGCGGCTCGTAATCTACTCCGAGATGCCATAGCCTTCCGCCGTAATGGGCCAACACTCGTCATGGAGTCTATAGGCATAGGTACCACGTCTAACCTAGTGAACATTACCATAGGTATCACTATCACAGGAGGGGCCCCCAGTAATAGACTAGGCGTCGACGTGCCCAGCGGTCCCATTGGAGGTGCAGCCAGTACTAATGAGTTTAAGTTAACTCGCCGACCTGTCAAGGAGGTAACGCGACTAGTAGCTACGCTCCAGCAGAATACGGCTGCCATAGTGCGCGGGACTACACCTGGCACTAGTGACTACCTAGGGCGAGATACTGTATCTAGTGTGAAACATGTATTCCAGGGCTCTATTAATTACACAGAGGGCCGGGACTTCCAGGTTCTCGATGGTGGTAGACTGGAGTGGGCTCCTAATGGCCCGGGGGCTCTAGAGCCGGCACCTGGTACTACCTACTTTGTGATGTATACGTACTCTAGTCAATTAACACTAGGAGTAGATTTCAATCTCCTGACGGCTACTGACACTATAGTATTTACTGGTACACGGAGCCCCGCACCTAATACCACATTCCAGGTAGACTATAGTTATTTCCTCAGCCGCATAGCTATAGTGACGCTAGATAAGGAGGGACAGCCCGCTGTCATATATGGTGAGGTAGGAGTTAATCCGCAGCCTCCTGCCGTTAGTGGTTCAGTATTACCACTAGCACGTGTGCTTATAAGTAATAATAGCGCCATCATTGAGCCTATCGACTGTCGCCCTGTTAATTACGATAGTATACGGCAGCTAGCCAGCGCCGTATCATCGTTATCAGATGATATAGATAGACTACGACTCACAACGAAAGCAGAGGGACTGGCTTTCACTAATACAGGAGCCGTACCTAACTTTACATCTATCGATGCTCTAGTGAGTAGTAGCGGTATTAATCTAACGGAGAGCACAGGTATGCTCTCGCCTCTAACTAATAGTCTGACATCCAATAGAGTATATAGCGATGTCAGAGCAACGGCCCCCTCGGCTAGACCTAATAACGCAGGAGACCCTTACATTGTAGTACCTACATATACAGAGAGTATCTTCCTCGAGCAAACTAAGCTGACGAAAGAAAGGAGTATACAGCAGACTACAGCCCCGCGGTTATTCTGCCGTAGAGTCATCATGGCTAATCGCGATCTAGGGCGAATTAACCCCTGCGACGAGCTGGCCGTCCGAGGAGCTGCTCTATTCGGCTCCACTAGTAATCCCCTCTATCGATTTATCAATGAGGGGAATAGAGCAGAGTTCACGCGGCTATCTCGTCGTGTACGAGAGGCTATATCAGCAGGTGAGGCTATACCGTCTATAGGCGCTAATCTAATGGGGAGCGAGGAGATAGATAAGGCGCGGGCCCAGAACATACGATACACTATACGAGGAGAGGGGCTCCCCCAGGGCAGCTATCAACTACTGATAGCTGACACTATCATGACTACTGCAGTATCAATTAATAACACACCAATATCGGGCACCCTACCATTCGCGTTCCGGCCCCGCTCTAATGGCATACTCGAGGTCGAGCTATTCCTACCCGCACTACCCCCCGGTGTCCATGCCGTAGTGCTACAGTCTGATACACTGAGTGTAAGTAATACGCTATCGATATTCAATAATAACCTGACCCACGTAGCGCTAGGCGGGGCGGCCTCCTGGGGCCTACCATCATCCTCAATAGATACTCAGCCCCTCCCCCTGATGCCGAGGGTAGGCTTCGACCCACTGATGCAGACATTTCAGGCACCCTCTGATATGTACCTGAGCGGCCTTGATATAAGGATAGCATCGGCGCCGGCATCAGGGGCCCTAGTTATATCATTGCGGGATGGTACAGCCACTACACCAGGACAGATACTACTAGGAGAGGCTCTTGTCAATGGAGCCGTATTGCCTGACATACAGGGGCGGCTCTGGACTAAATACGTATTCCCTACTCCTATCTATCTCAAGGAGGATCAGTATTATACACTAGGCTTCCGCAGTACAGAGGGAGACTGGAGCGTATTCACTAGTGAGATAGGAGAGGTCGATATACTAGATGCGGGGCTACTAATAGGACAGCAGCTAGGCATAAATGGTAACCTCTGGACTAGTGATGGTACTATCATCTCTAATCACGAGAGAGAGGATATCAGTATGCGGCTCTACCGCGCTGTATTCCCGACGACTCCGATTAGTATAGATCTAGGTACCTATAGCTCTAGTATGACGGCCTTCGCCTTCAATGTACGAGACATAGTACCAACAGGCTGCACAATAGACTATCAGTACAAGGTGGGCGTGAATCCTAACTGGATATCCATAGCGCCTAATACGCCTGTATGTCTAGATAGAGTAGAGTCTATACTCTATCTACGTGCAGTATCTACAGGTACGGCAGCCCTAGCTCCCATCTTAGAAGTAGGGACAGTATCCATCTATCGTAACCTGTCACCCACGCAGCATATATCTAACTGGCAGCCTATCCTGCAGACGAGTACGAGATTTACAGTAGCCATAACAGCGCTAATGCCGCCATCGAGTACGCTACAAGTAAGGATACAGTTCAGCACAGGGGGCTGGCACGTTCTAAGCGACCCAACCACAGTCATACTAGATGCAGGACTAGGACTATCTCGCCTAACTTATGAATATGTATCTCCCGGCCCGCGTAGTGGAGAGCTGAAGTGGTCTATAGACGCATTTGGAATTTCGACAACAGACGTGCCATCTATAATGGAGGTAGTGGTATATGGAACGAACTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
3fa6a4b7466d085e419ce7ce0220558ef0dba9298f6c398949028fc2049148ea
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6156
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Sequencing and analysis of the complete genome of Microcystis aeruginosa phage MaMV-DC Ou,T., Li,S.H. and Zhang,Q.Y. 2013-08-26 — GenBank