Genbank accession
AGN33584.1 [GenBank]
Protein name
structural protein
RBP type
TF
Evidence RBPdetect2
Probability 0,93
Protein sequence
MANRIQLRRGGAQEWANANPTLAQGELGIELDTGRFKIGDGVSAWNTLRYERPVESTSNTANTLVQRDTDGNFSAGTITATLIGNASTAARLASTRQIQLSQDITASGVFDGSANLNLNAELTLVSTLPHYDGTGTPTATYTSVTVDAKGRIINASNPSTLADYNLNGTVEGQSAQPYDLDLVAISGLTTTGIISRTSGGSMATRTITGTATRIAINDGAGLSGNPTIDLIVTAVTPGDYNTESLTSVSGVGGNSEPFGTETVNATKFTVDAYGRLTSATNVPIATATEGSKYPNYDAGTAYSRYAIIQNASKVYQAIADISAGAGAPTHSSGDSGSWRYLAAEATEQKGLASFAQEDFDVDANGHVTIAAAGVDNTQLQNNRIIFTDGNTVDEFELDNELTTSTAHTGFDYLNYIKINDTSGNLLFGANNTGDSGAGEIDVNVRSYFSDPDITLDGAVAQTLDKTGDGNLTFQLTQNSASARNLSILSTNAGSGTSTVTITAEDVVDIDASDANGKVHVENARFQANYIATTDATMNLDPGDDRAVTGLVRVWGDLQVDGVTTTVNSTTMTVDDVVLTLGGDTAPASDDNLDRGVEFRYYDTQARLGFYGWDTNYTDLGGHEGGYRFLHAATNTSETFAGTDSGIIAGNVKLTTNTNSTSNTTGDLVVAGGAGIGQDVNIGGLLDVDGTFRANSTSRFDDTMVLRGASKSLQFQNGAGTVKSEIHTTSGNAEFGGIVTVTGATDLNSTLNVASTVNFEDTDEPTVLLSGSTGLYEIQSSDYGSFKFDGGGYVEGDTVFNSDIYLNGQFNQKEDATANYGLRNYLAVRYKMRTGTTAAYTPSYSNHDTSNLRVFGGAGINTTLHVGGTGSGEGLFVGKENSGDTVKFSVLGASGNTDIEGTLNVEGQVTIQDSVIINAANEEFAIQNGSAVDKFTVDTDNGNTLIEGTLNVNGVTDIDADFAVRNGTTDKFTVASATGNTVIEGTLNGKGAADFDSTLNVDGNTTLGGTLTVTGASEFNNTVDVDNNFAVRTSGGVDKFTVASASGNTVTQGTLTVEGETNINETLNVSANGEFFRVRNGNNALQFTVDTDNGNTNVYGTLTVSDATQINDTLGVTGVTSITNSTGQTLTGSYGADGAVRITGGVGVGENLAVGGNMRVYGDFEITGSTTQSGNTGFSGRVSITNTQDVTSFGDNNVSLTTDGGLRVSKNAYVGGDFVVYDDANSRNAFIVDVSTGDATLHNTLTVGGNLVVNGTTTTVNSTVTTLDDPIITLGGDTAPASNDGKDRGVEFRYYDGSAKVGFFGYDRSSDQYTFLVDATNTAEVHSGTDAAVRAGSLRLTSAGTALDVDNNANIDGTLTVDGQIISNVATGSAPFTVASTTKVLNLNADLLDGMTTASAATGSTVVNRDSSGDFAANVITMATSTITGAATVGTTLGVTGAATLSSTLGVTGATTLSSTLGVTGVTTLTGLLNANGGIAVDTNNFTVDGTTGAVVTASTLSVGSTSSFTGAITATGGVVGNVTGNLVAAISTGKTFNPETDSTYNLGASTLRWATAYLDSLNAGTSITTAGTLSVTGTSTFTGEISANGGIALQDTDKATFGDDDDMEIYWSGTQNRIDTEGPFQIRNSNTSSGISFYDGDNTNFMFKALPLGAIELYHSGVKTFETTATGATLTGVLVATSLTGNVTGNVTGTVSSIANHDTDALSEGSSNLYYTDERVDDRVNALIVAGTGITKAYNDVAGTYTLTVTQADIDTDNVTEGSTNLFTTAARTRTHFTYGTGIEHDGSGTLSVTQADIDTDNVTEGSTNLFTTAARTRTHFTYGTGIELSGAGELSVTQADINTDNITEGGTNIFFTNARADARFDTKIAAADTDDLSEGSTNLYFTEARADARVDAGFTAKSTSDLSEGTNQYYTEARVQTKLDNAFAQLQAMLNNLATTTTLTLNLSGDPTPGAVVAVGVSDGGGGGFTAGTAVATSGGTGSSLTVDTTVVGGVITAASVNAGGSDYLISDTVTVTNPNAGKVLSLNLASLAGGSNYVTGTALATTGGSGSASLTVDITAVAGAITNVTINDGGTGYVAGETITIVQPTGADGSNPATGGTVDIATVATNATLTLTDITTMEVGATVTGATSGTTGVITALGTNQITVDTVSGFFKVGEVVSANDVTTLTISSFA
Physico‐chemical
properties
protein length:2177 AA
molecular weight: 222608,48090 Da
isoelectric point:4,14029
aromaticity:0,06431
hydropathy:-0,13018

Domains

Domains [InterPro]
AGN33584.1
1 2177
Architecture
ATT
STR
STR
STR
RBD
ATT 4-43 | STR 44-242 | STR 335-1071 | STR 1121-1493 | RBD 1827-2177
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Synechococcus phage S-IOM18
[NCBI]
754039 Uroviricota > Caudoviricetes > Pantevenvirales > Tefnutvirus > Tefnutvirus siom18
Host Synechococcus sp. WH 7803
[NCBI]
32051 Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AGN33584.1 [NCBI]
Genbank nucleotide accession
HQ317383 [NCBI]
CDS location
range 75174 -> 81707
strand +
CDS
ATGGCAAATAGAATTCAATTAAGAAGAGGTGGCGCTCAGGAATGGGCAAACGCTAACCCAACCTTGGCACAAGGTGAACTCGGAATCGAACTTGATACTGGTCGTTTCAAAATCGGTGACGGTGTTTCTGCTTGGAACACGCTGAGATATGAACGCCCTGTTGAGTCTACCTCTAATACGGCAAATACTCTTGTACAGAGAGATACTGATGGCAACTTTTCTGCAGGTACTATTACTGCAACTCTGATTGGTAATGCTTCTACCGCTGCACGTCTGGCATCTACCAGACAAATTCAGTTATCTCAAGACATCACTGCTTCTGGTGTTTTCGATGGTTCTGCAAACCTGAACCTCAATGCTGAACTCACCCTGGTTTCAACTCTTCCCCATTACGATGGTACAGGAACACCTACAGCAACATACACCTCTGTTACTGTAGATGCAAAAGGTAGAATTATCAATGCTTCAAATCCATCTACCCTTGCAGATTATAATCTTAATGGAACTGTAGAAGGTCAATCTGCACAACCATATGACCTTGATCTGGTTGCTATTTCTGGTCTGACAACTACTGGTATTATCTCCAGAACTTCTGGTGGTAGTATGGCAACCAGAACTATCACTGGTACTGCCACAAGAATTGCAATTAATGATGGTGCAGGTCTTTCTGGTAATCCAACAATCGATCTTATTGTTACTGCTGTAACTCCTGGTGATTATAATACAGAATCTCTGACATCTGTAAGTGGTGTTGGTGGTAACAGCGAACCATTTGGCACAGAAACTGTAAACGCTACGAAATTTACAGTTGATGCCTATGGTCGTTTAACAAGTGCAACAAATGTGCCCATTGCTACTGCCACTGAGGGTAGTAAGTATCCTAACTATGATGCAGGGACTGCTTATTCTAGATATGCAATCATTCAGAATGCATCCAAGGTTTACCAAGCGATTGCGGACATTAGTGCTGGTGCTGGTGCTCCTACTCATTCCAGTGGTGATTCTGGATCATGGCGTTACCTCGCGGCTGAAGCAACGGAACAGAAGGGACTGGCTAGTTTTGCACAGGAAGATTTTGACGTTGACGCAAACGGGCACGTTACCATCGCCGCCGCAGGCGTAGATAATACACAACTTCAAAATAATAGAATTATTTTCACCGATGGCAATACCGTCGATGAGTTTGAATTAGATAATGAACTTACAACATCTACAGCGCACACTGGTTTTGATTATCTCAACTATATCAAAATCAATGATACAAGTGGCAATCTTCTGTTTGGCGCTAATAATACAGGGGACAGTGGCGCTGGTGAGATTGATGTTAACGTCCGTTCCTATTTTTCTGATCCTGATATTACTCTTGATGGAGCAGTTGCTCAGACATTGGATAAAACTGGGGATGGCAACCTTACCTTCCAGTTAACACAAAACTCTGCATCTGCTAGAAACCTTAGCATCCTCTCTACAAATGCTGGGTCTGGTACAAGCACAGTTACAATCACTGCAGAAGATGTTGTTGACATTGATGCATCTGATGCAAATGGTAAAGTTCATGTAGAAAACGCAAGATTCCAAGCAAACTACATCGCCACAACCGATGCGACGATGAATCTTGACCCTGGCGATGACCGTGCTGTAACTGGTCTGGTTCGTGTTTGGGGTGACCTCCAAGTTGATGGTGTGACAACAACTGTCAACTCTACAACCATGACAGTTGATGATGTTGTACTCACTCTGGGTGGTGATACTGCTCCTGCTTCTGACGATAACCTCGATCGCGGTGTTGAGTTCCGTTATTATGATACTCAAGCACGTCTTGGTTTCTATGGTTGGGATACTAACTATACTGATTTGGGTGGTCATGAAGGCGGTTATCGTTTCCTTCATGCTGCTACAAATACTTCCGAAACTTTTGCTGGTACTGATTCTGGTATTATTGCTGGTAATGTAAAACTCACCACTAATACTAACTCTACTTCCAACACAACTGGTGACCTTGTAGTTGCTGGTGGTGCTGGTATCGGTCAAGATGTAAACATCGGTGGTCTGCTGGATGTTGATGGCACCTTCCGTGCTAACAGCACCTCCCGCTTTGATGACACCATGGTTCTTCGCGGTGCATCTAAGTCACTTCAGTTCCAGAATGGTGCTGGCACTGTTAAGTCTGAAATTCATACAACTTCTGGTAATGCTGAGTTTGGTGGTATCGTTACTGTAACTGGTGCTACCGATCTTAATAGCACCCTTAATGTTGCATCTACAGTTAACTTTGAAGATACTGATGAACCCACTGTTTTACTCAGTGGCAGTACTGGTCTTTATGAAATTCAGTCGAGTGATTATGGTTCGTTTAAATTTGATGGTGGTGGATATGTTGAAGGAGATACAGTCTTTAATAGTGATATCTACCTTAATGGTCAATTTAACCAGAAAGAAGACGCAACAGCGAACTATGGTTTAAGAAACTACCTGGCAGTTCGTTATAAAATGAGGACAGGTACTACTGCTGCCTATACTCCCTCATATTCTAATCACGACACCTCTAACCTAAGAGTCTTTGGTGGTGCTGGTATTAACACAACTCTGCACGTTGGTGGTACAGGTTCTGGTGAAGGTCTGTTTGTTGGTAAAGAGAATAGTGGTGATACCGTTAAGTTCTCCGTTCTTGGTGCATCTGGTAACACTGATATTGAAGGCACACTGAACGTTGAAGGTCAAGTAACTATTCAAGATAGTGTAATCATCAACGCTGCGAATGAAGAGTTTGCAATTCAAAACGGTTCTGCAGTAGATAAGTTTACTGTCGATACTGACAACGGTAACACTTTAATTGAGGGCACACTGAATGTTAACGGCGTAACTGATATTGACGCCGACTTTGCTGTTAGAAATGGCACAACTGATAAGTTTACAGTTGCATCTGCCACAGGTAACACTGTAATTGAAGGCACTCTGAATGGTAAGGGTGCAGCAGACTTTGATAGCACTCTGAATGTTGATGGCAATACTACTCTGGGTGGAACTTTAACAGTTACTGGTGCTTCTGAGTTCAACAACACTGTTGATGTTGATAATAACTTTGCAGTTAGAACTTCTGGTGGTGTAGATAAGTTTACTGTTGCTTCTGCTTCAGGTAACACCGTTACTCAGGGTACACTCACGGTTGAAGGCGAAACTAATATCAACGAAACTCTGAATGTTTCTGCAAATGGTGAGTTCTTCAGAGTTAGAAACGGCAATAATGCTCTGCAGTTTACTGTCGATACTGACAATGGTAATACCAATGTATACGGTACATTAACGGTTAGTGATGCGACTCAAATCAATGACACTTTGGGTGTTACTGGTGTTACTTCTATTACTAATTCCACTGGTCAGACTTTAACTGGAAGTTATGGTGCTGACGGCGCAGTTCGCATTACTGGTGGTGTCGGAGTTGGAGAGAATCTCGCTGTTGGTGGCAACATGCGTGTCTACGGTGACTTTGAAATCACTGGTAGCACAACTCAGTCTGGTAACACTGGATTCAGCGGTCGTGTTTCGATCACCAATACACAAGACGTTACATCTTTTGGTGATAACAATGTTTCTCTCACAACCGATGGCGGTCTTAGAGTAAGTAAGAATGCATATGTTGGCGGTGATTTCGTTGTATATGATGATGCAAACTCCAGAAATGCATTTATTGTTGATGTAAGCACTGGTGATGCAACTCTACACAATACACTGACAGTTGGAGGAAACTTAGTTGTAAATGGAACGACCACTACTGTTAATTCTACGGTCACAACTCTCGATGACCCTATTATTACTTTGGGTGGTGACACAGCACCAGCGTCTAACGACGGTAAGGACCGTGGTGTTGAGTTCCGTTATTATGACGGCTCTGCGAAAGTGGGCTTCTTCGGATATGACAGATCCTCCGACCAATACACATTCTTAGTTGATGCAACTAACACTGCCGAAGTTCATTCTGGTACAGACGCTGCAGTTCGTGCTGGTTCTCTGAGGCTCACTAGTGCTGGCACTGCACTTGACGTTGATAACAATGCTAACATCGATGGTACTTTGACTGTTGATGGTCAAATCATTTCTAATGTTGCTACGGGAAGTGCTCCTTTTACAGTTGCTTCTACAACTAAAGTTCTTAATCTGAATGCTGACCTTTTGGATGGCATGACCACAGCATCTGCAGCAACAGGATCTACAGTTGTTAATCGTGATTCTTCTGGTGATTTTGCTGCTAACGTCATCACGATGGCAACAAGCACAATCACTGGTGCAGCGACGGTTGGTACAACTCTCGGCGTCACTGGTGCAGCAACATTAAGTTCCACACTTGGTGTTACAGGTGCAACGACACTTAGCAGTACCTTAGGAGTTACTGGTGTTACCACACTTACTGGTCTTCTTAATGCCAATGGTGGCATTGCAGTTGATACAAATAACTTTACTGTCGATGGAACAACAGGTGCAGTTGTAACAGCAAGTACATTGAGTGTTGGTAGCACGTCTTCCTTTACAGGTGCTATTACAGCAACTGGTGGAGTTGTTGGTAATGTTACTGGTAATTTGGTTGCTGCCATTTCTACTGGTAAGACTTTTAACCCAGAAACTGATAGTACATATAACTTGGGTGCTAGCACACTGAGATGGGCAACTGCATATCTTGATTCTCTTAACGCTGGTACATCCATTACAACTGCTGGCACTCTGTCTGTAACAGGTACTTCTACCTTTACTGGTGAGATTAGTGCCAATGGTGGCATCGCTCTCCAAGATACCGATAAAGCGACATTCGGTGATGACGATGATATGGAGATTTACTGGAGTGGCACTCAGAATAGAATTGATACTGAAGGTCCTTTCCAGATTAGAAATAGCAATACCTCATCTGGTATCTCCTTCTATGATGGCGACAATACTAACTTTATGTTCAAAGCGTTACCTCTGGGTGCGATTGAACTCTATCATAGTGGTGTAAAAACCTTTGAAACAACTGCAACAGGTGCAACTCTTACAGGTGTTCTGGTTGCAACATCTCTGACTGGTAATGTCACTGGTAATGTAACTGGTACAGTTTCTAGTATTGCTAACCATGATACTGATGCTCTTTCTGAAGGTTCAAGCAACCTTTACTACACTGATGAGCGTGTTGATGATAGAGTCAATGCTCTTATTGTTGCTGGTACAGGTATTACCAAGGCATATAACGACGTAGCAGGCACCTATACGCTCACTGTAACGCAGGCAGACATCGATACCGATAATGTCACCGAAGGTTCTACAAACCTCTTTACAACCGCTGCTAGGACCCGCACACACTTCACTTATGGTACAGGTATCGAACATGATGGTAGTGGTACTCTGAGCGTCACACAGGCAGATATTGACACAGATAATGTAACTGAAGGTTCTACAAACCTCTTTACAACCGCTGCACGCACTCGCACACACTTTACATATGGTACTGGCATTGAGTTGTCTGGTGCTGGTGAACTGAGCGTCACTCAAGCAGATATCAATACCGACAATATTACCGAAGGTGGCACCAATATCTTCTTTACTAATGCTCGTGCTGACGCACGTTTTGATACTAAGATTGCTGCAGCAGATACGGATGATTTAAGTGAAGGTTCTACTAACCTTTACTTTACTGAGGCACGCGCTGATGCAAGAGTTGATGCTGGATTTACTGCCAAGTCTACCTCCGATTTGTCTGAAGGAACCAATCAGTATTACACTGAGGCAAGAGTTCAAACAAAACTGGACAATGCATTTGCTCAACTTCAGGCAATGCTCAATAACCTTGCAACTACTACAACATTGACACTGAATCTGAGTGGCGATCCCACCCCTGGTGCTGTTGTCGCTGTTGGTGTTAGTGATGGCGGTGGCGGTGGATTCACTGCTGGAACCGCTGTTGCTACCTCTGGTGGTACAGGTTCTTCTCTGACAGTTGATACCACTGTCGTTGGTGGTGTAATCACCGCTGCATCAGTTAATGCTGGTGGTTCTGATTATCTTATCTCGGATACTGTAACAGTTACTAACCCCAATGCTGGTAAGGTCTTGTCACTGAACTTAGCATCTCTTGCAGGTGGTTCTAATTATGTTACAGGAACTGCTCTTGCAACAACTGGCGGTTCTGGATCTGCATCTCTGACCGTTGATATCACAGCAGTTGCTGGTGCAATCACCAACGTTACTATTAATGATGGTGGCACTGGATATGTTGCTGGTGAGACAATTACTATCGTTCAACCAACTGGTGCTGATGGTAGCAATCCTGCAACAGGTGGCACCGTTGATATTGCGACTGTCGCTACTAATGCGACTCTGACCCTGACTGACATCACAACGATGGAGGTCGGAGCAACTGTAACTGGCGCTACCTCTGGCACTACAGGTGTTATTACTGCACTTGGAACCAACCAAATCACAGTTGATACCGTTAGCGGGTTCTTCAAAGTTGGAGAAGTCGTTAGTGCAAATGATGTTACTACACTCACAATCTCTTCATTCGCTTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
f073f330af08b8dc951a220f4a08bca6bbfe8d87bbee3f334001b6c5fb6526ee
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,4943
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
The Genome Sequence of Synechococcus phage S-IOM18 Henn,M.R., Clokie,M., Levin,J., Malboeuf,C., Casali,M., Russ,C., Lennon,N., Chapman,S.B., Erlich,R., Young,S.K., Yandava,C., Zeng,Q., Fitzgerald,M.F., Alvarado,L., Anderson,S., Berlin,A., Chen,Z., Freedman,E., Gellesch,M., Goldberg,J., Green,L., Griggs,A., Gujja,S., Heilman,E.R., Heiman,D., Hollinger,A., Howarth,C., Larson,L., Mehta,T., Neiman,D., Pearson,M., Roberts,A., Ryan,E., Saif,S., Shea,T., Shenoy,N., Sisk,P., Stolte,C., Sykes,S., White,J., Haas,B., Nusbaum,C. and Birren,B. 2011-09-23 GenBank