Genbank accession
AGH07544.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MIHTSTNTLDRTNLATRPTDPDAKKAYSIKCYTKEDWVFIHEELEKDGSLEDNIPDPSIVCPDKKEHSDTRATYMLTDAEAEDLRKHEKVQWVCIDYDVYPGNYHPDPKDIVAGVQRFGRGVGSISNYRAFNTAPTGTRPPTTQAGIGATDKNRTGYQILRHTQKENPWDATFTGLTGSDHIIIEKENFQLGDGTGVDAIVSDDGFWIAHPEFVTTADDPVGWSTGNALTWSGISTTPGTCGVLDVLLDGPYYIDPDWFNADPGNRLTQRWDGTTVPVESVARAWWSDSSQRSAGFSTIGTTNGFSSFYSRQSCNGSNTQKPTNGSDHGTQCAGQVYGKNYGSAYNCNKWVLNGIGGSNAGINGSQFDIQKLFHLYKPNYDRHSAVTGRQNDTKNPTLSSNSWGYRANTIHNGGYYWYRPSAIDGSETGISYSSSSAPEFIDLLGAYGDGNRMKGEMVDSSVTAAGDELSEAGVIFVCAAGNSNQTQCSPGDLDFDNYWATSSQGDSRSLATATHSEFGLTCYNTINRRGWPQSLGKTTSGLSTAGTEYAAINIGALDDQYISSGLGGNTTDYKEKKVSYSDMGTGIDCYGAADDTLTADGRASSLTYVHPETYVGLGLTPYDVDFGGTSSGCPTCAGWITTKLQYNRGWTWRDVKSWLNNQCGTQDPDRFYYGDDITSFSATTAAWEDMYSHMAYGQGPVIIWDAPTGSPNEPKKPEIRITNSPNLKISGGVEIKFS
Physico‐chemical
properties
protein length:738 AA
molecular weight: 80343,76490 Da
isoelectric point:4,85117
aromaticity:0,10705
hydropathy:-0,61721

Domains

Domains [InterPro]
IPR036852
STR
193–672
IPR015500
Unmapped
194–213
IPR000209
ENZ
201–663
IPR015500
Unmapped
324–337
IPR015500
Unmapped
627–643
AGH07544.1
1 738
Architecture
ATT
STR
RBD
ATT 10-190 | STR 191-689 | RBD 690-738
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AGH07544.1
1 738
Domain Start End Length (AA) Confidence
N-terminal 1 86 86 0,0007
Central domain 87 306 221 0,6108
C-terminal 307 738 431 0,6157
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-86
Central
87-306
C-terminal
307-738

Taxonomy

  Name Taxonomy ID Lineage
Phage Cyanophage S-SSM6a
[NCBI]
682650 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AGH07544.1 [NCBI]
Genbank nucleotide accession
HQ317391 [NCBI]
CDS location
range 72273 -> 74489
strand -
CDS
ATGATTCATACTAGTACGAACACTCTTGATAGGACCAATCTAGCGACTAGGCCTACTGATCCTGATGCTAAAAAAGCATACTCTATCAAATGTTATACCAAAGAGGATTGGGTATTCATCCACGAAGAGCTAGAAAAGGATGGTTCACTAGAGGATAATATACCTGATCCATCTATAGTATGTCCTGACAAAAAGGAACACAGTGATACCAGAGCAACTTATATGTTGACTGATGCAGAGGCAGAAGATTTAAGAAAACATGAGAAGGTGCAGTGGGTTTGTATCGACTATGATGTATATCCAGGCAACTATCATCCTGATCCAAAAGATATTGTTGCTGGTGTGCAAAGATTTGGCAGAGGAGTGGGTTCAATATCTAACTACAGAGCATTTAATACTGCACCTACTGGTACAAGACCACCAACAACTCAGGCTGGTATTGGTGCAACAGATAAAAACAGAACTGGATATCAAATACTAAGACATACTCAGAAAGAGAATCCTTGGGATGCAACATTCACTGGACTCACTGGATCAGACCATATTATTATAGAGAAAGAAAATTTTCAATTAGGTGACGGAACTGGTGTAGATGCAATCGTATCTGATGATGGTTTCTGGATTGCACACCCAGAATTTGTAACAACTGCCGATGATCCTGTAGGTTGGTCAACAGGAAACGCATTGACATGGAGTGGTATATCTACAACACCAGGCACATGTGGTGTCCTAGATGTACTTCTTGATGGTCCATATTATATTGACCCAGACTGGTTCAATGCAGATCCAGGCAATAGATTAACTCAACGTTGGGATGGTACAACAGTTCCAGTGGAATCTGTTGCTAGAGCATGGTGGTCTGATTCGAGTCAAAGATCAGCGGGATTCTCTACCATTGGTACTACTAATGGTTTCAGTAGTTTCTATAGTAGACAAAGTTGTAATGGAAGTAACACACAGAAACCAACTAACGGTTCTGATCATGGAACTCAGTGTGCTGGTCAAGTATATGGTAAGAATTATGGATCGGCATATAACTGCAACAAATGGGTATTAAATGGCATCGGTGGTTCTAATGCTGGAATCAATGGTAGTCAATTTGATATACAGAAACTCTTCCACTTATATAAACCAAACTATGATAGACATTCTGCTGTTACTGGCAGACAAAATGATACTAAAAACCCCACATTATCAAGTAATAGTTGGGGATATAGAGCAAACACCATACACAACGGTGGATACTATTGGTATAGACCATCAGCGATAGACGGATCTGAAACAGGGATATCATATAGTAGTTCATCCGCACCAGAATTTATTGATCTACTAGGTGCGTATGGTGATGGCAATAGAATGAAAGGTGAGATGGTAGACAGTTCTGTCACCGCAGCTGGTGATGAGTTGTCTGAGGCAGGAGTTATCTTCGTCTGTGCTGCTGGTAATAGTAATCAGACTCAATGCAGTCCTGGCGATCTTGACTTTGATAATTATTGGGCTACATCTTCTCAAGGTGATAGTCGGTCTTTAGCAACTGCAACTCATAGTGAATTTGGATTGACATGTTATAACACTATCAACAGAAGAGGATGGCCACAGTCATTAGGTAAGACTACATCTGGTTTATCTACTGCTGGAACTGAGTATGCTGCTATCAATATTGGTGCGTTAGATGACCAATATATAAGTAGTGGACTGGGTGGTAATACCACAGACTATAAAGAAAAGAAAGTTTCCTATAGTGATATGGGAACAGGTATTGATTGTTATGGTGCGGCTGATGACACACTTACAGCAGATGGTAGAGCGTCATCTCTTACATATGTTCACCCAGAAACATATGTTGGTTTAGGACTTACTCCATATGATGTAGATTTTGGAGGCACAAGTTCTGGATGTCCTACATGTGCTGGGTGGATCACCACCAAACTACAATATAATAGAGGTTGGACTTGGAGAGATGTCAAAAGTTGGTTGAATAATCAATGTGGCACTCAAGATCCTGACAGATTTTACTACGGTGATGACATCACATCTTTCAGTGCAACAACAGCTGCATGGGAAGATATGTACTCTCACATGGCATATGGTCAAGGACCTGTTATCATCTGGGATGCTCCTACTGGTTCACCTAATGAACCAAAGAAACCTGAGATCCGAATCACAAACTCCCCTAACCTTAAAATTAGTGGTGGAGTTGAAATAAAATTTTCCTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
4f9fbbf269e02dfba8e4223cc8a82f6b98e796d63b757e81f2cecdeb4839bb8f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4411
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
The Genome Sequence of Cyanophage S-SSM6a Henn,M.R., Sullivan,M.S., Osburne,M.S., Levin,J., Malboeuf,C., Casali,M., Russ,C., Lennon,N., Chapman,S.B., Erlich,R., Young,S.K., Yandava,C., Zeng,Q., Alvarado,L., Anderson,S., Berlin,A., Chen,Z., Freedman,E., Gellesch,M., Goldberg,J., Green,L., Griggs,A., Gujja,S., Heilman,E.R., Heiman,D., Hollinger,A., Howarth,C., Larson,L., Mehta,T., Pearson,M., Roberts,A., Ryan,E., Saif,S., Shea,T., Shenoy,N., Sisk,P., Stolte,C., Sykes,S., White,J., Yu,Q., Coleman,M.L., Huang,K.H., Weigele,P.R., DeFrancesco,A.S., Kern,S.E., Thompson,L.R., Fu,R., Hombeck,B., Chisholm,S.W., Haas,B., Nusbaum,C. and Birren,B. 2011-09-23 GenBank