Genbank accession
ABA47077.1 [GenBank]
Protein name
structural protein
RBP type
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MANRIQLRRGGAQEWANANPTLAQGELGIELDTGRIKIGDGVTAWNSLRYERPIESTSNTANTLVQRDADGNFAAGTITATLIGNASTAARLSSTRQIQLSTDVTASGVFDGSANLNLNAELSLVQTLPHYDGTTAPSATYTKLTVDAKGRIINAANPTTIQDYGLDTSIEGTGAQPYDADLASLAGLTTTGIIARNAPNNIVTRTITGTPSRIAINDGGGINGNPTIDLIVTAVQAGDYNTESLTSVSAVGGNSEPFGTETVNATKFTVDAYGRLTNAVNVPIATATEGSKYPNYDAGTAYVRYDIIQNASKVYQALTSINAGAGAPTHSSGDTGSWRYLAAEATEQKGLASFAQEDFDVDSNGHVTIAALGVDNTQLQNNRIIYTDGNTIQEFELDNELTTSTAHTGFDYLNYIKINDTSGNLLFGANNTGDSGAGEIDVNVRSYFSDPDITLDGAVAQTLDKTGDGNLTFQLTQNSADARNLSILSTNAGSGTSTVTITAEDVVDIDASDANGKVHVENARFQANYIATTDATMNLDPGDDRAVTGTVRVWGDLQVDGTTTTVNSTTLQVDDPIITLGGDTAPTTDDNLDRGIEFRYYDTEARLGFYGWDTGYTDLGGHEGGYRFLHAATNTAEVFTGTDSGIIAGNVKLTTNTNSTSNTTGDLVVAGGAGIGQDVNIGGLLDVDGTLRVTSTSRFDDSIVLQGASKTLQLNNGSGTTRIELQSTTGNASFYGVVDITNDLNINTNKFNVASATGNTLIAGTLGITGDTTVTGATDLNSTLNVSGFTYLENTAEPQIALNSGNGEWEIQSSDYGAFRFDGGGYVEGETLFNSDIYVNGQVVQQENVSEVYNRQNYLQVRYKLRTGTSAAYNPSFATDNNSNLRVFGGAGIYQDLHIGDDLYIGKLNSGDTTEFSVLGESGNTTIGRSGAGTSSVGTLTVYGDTLLDRNLTVNGSAITLGNASSDVLTVNADATFNDDVTINGDNLMFTIEAQNGTDAFTVDSDNGNTVIAGTLNVDDATTITNTLNVTNGVDFDQTLNVDGAVDFNSTLVVDGQTTIYDSLILQSDNEVFNINTSSGATRFSVDFDNGNTNIVGTLTVGNATQLNNTLGVTGISSFTNAADQTLTGLYGADGAVRLTGGMGVAKNLAVGGNMRVYGDFEITGSTTQSGNTGFSGRVSITNTSDITSYTDNTVSLSTEGGFRAEKNAYIGGDFYIWDAANSRAAFSVDNSTGNAELHNNLIIGGNLTVNGTTTTVNSTVTTLDDPIITLGGDTAPVSNDGKDRGVEFRYYDGSAKTGFFGFDRGSQQYAFLTDTSNSSEVISGTDAALRAGSLNLTGTGTTLDVDANANIDGTLTVDGQIISQVSSGPALVIPTTNKINNLNADLLDSMTTASAATPTTVVNRDSNGDFAANQITVNNGIGALAGIQGNATTADALRTARTITIDGVVDGSVSFDGSANVTISTVYNDADITALAAMAGTGFVSRTAANTYAQRTLQVTASSGITLTNADGVSGNPTINVASASTNAANNLVIRDASGNFAANVITADLVGDVTGQVSSIANHSTTNLTEGTNLYYTTARANADFDTKLAAATTTDLTEGTNLYYTNARADARIVAAGLSAGTLTGNVTGNVTGNADTATAVSVSQSGSVGDFFVGIVANAAASGTSALRADSGMKFNTGTNILTVLGGVAANVTGNVTGNLTGNVTGDVTGNLTGNVTGDVTGNVDGNVSGEVTLEGTAPTTATDPGTAGDIRYDADYVYVCVATDTWKRSALATW
Physico‐chemical
properties
protein length:1779 AA
molecular weight: 183743,90310 Da
isoelectric point:4,10408
aromaticity:0,06464
hydropathy:-0,18072

Domains

Domains [InterPro]
IPR041352
ATT
5–43
ABA47077.1
1 1779
Architecture
ATT
STR
STR
STR
STR
RBD
ATT 4-43 | STR 44-242 | STR 329-948 | STR 963-1061 | STR 1106-1556 | RBD 1644-1779
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Synechococcus phage syn9
[NCBI]
382359 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Synechococcus
[NCBI]
1129 cellular organisms > Bacteria > Bacillati > Cyanobacteriota/Melainabacteria group > Cyanobacteriota > Cyanophyceae
Host Synechococcus sp. WH 8012
[NCBI]
166313 Bacteria > Cyanobacteria > Oscillatoriophycideae > Chroococcales > Synechococcus >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
ABA47077.1 [NCBI]
Genbank nucleotide accession
DQ149023 [NCBI]
CDS location
range 93673 -> 99012
strand +
CDS
ATGGCAAATAGAATTCAATTAAGGAGAGGTGGTGCTCAGGAATGGGCAAACGCAAACCCTACCCTCGCTCAAGGCGAATTAGGAATTGAGCTAGACACGGGTCGTATTAAGATCGGTGATGGTGTTACAGCATGGAACTCTCTTAGATATGAGAGACCTATCGAATCTACATCAAACACTGCAAATACTCTGGTCCAGAGAGACGCAGATGGTAATTTTGCAGCGGGCACAATTACTGCGACCCTGATCGGTAATGCTTCTACCGCTGCTAGATTGTCTTCGACTCGTCAAATTCAGTTATCTACTGACGTTACTGCTTCTGGTGTTTTTGACGGATCTGCAAACCTCAACCTGAATGCAGAGTTATCTTTGGTGCAAACTTTGCCTCACTACGATGGCACAACGGCACCTTCCGCAACCTACACAAAACTTACAGTTGATGCTAAAGGTAGGATTATTAATGCTGCTAATCCTACAACTATTCAAGATTATGGATTAGACACTAGCATTGAAGGCACTGGTGCTCAACCATATGATGCTGACTTGGCATCTCTTGCTGGTTTGACAACAACGGGCATCATTGCTAGAAATGCTCCTAATAATATTGTAACCCGCACGATTACTGGCACACCTAGCAGAATCGCTATTAACGATGGTGGTGGTATCAATGGCAACCCCACTATTGATCTTATTGTTACTGCAGTGCAAGCAGGTGACTACAATACAGAGTCTCTGACATCTGTATCTGCTGTTGGTGGTAATAGCGAACCTTTTGGCACAGAAACTGTAAACGCTACGAAATTTACGGTTGATGCTTATGGTAGGTTAACAAATGCTGTCAATGTGCCTATTGCTACTGCTACTGAAGGTAGTAAGTATCCTAACTATGATGCAGGGACTGCTTATGTCAGGTATGACATTATCCAAAACGCATCAAAAGTTTACCAAGCACTTACATCAATCAATGCTGGTGCTGGTGCTCCTACTCATTCCAGTGGTGATACTGGATCATGGCGTTACCTCGCGGCTGAAGCAACAGAGCAGAAGGGACTGGCTTCATTTGCACAGGAAGATTTCGATGTTGACAGCAACGGGCACGTTACCATCGCTGCACTAGGTGTAGATAATACACAACTTCAAAACAATAGAATCATTTATACGGATGGTAACACCATTCAAGAATTTGAATTAGATAATGAGCTTACAACATCTACAGCGCATACTGGTTTTGATTATCTCAACTATATCAAAATCAATGATACGAGTGGTAATCTTCTGTTTGGCGCTAATAATACAGGGGACAGTGGCGCTGGTGAGATTGATGTCAATGTCCGTTCCTATTTTTCTGATCCTGATATTACTCTTGATGGAGCAGTTGCTCAGACATTGGATAAAACTGGGGATGGTAACCTTACCTTCCAGTTAACACAAAACTCTGCAGATGCTAGAAACCTCAGCATCCTCTCTACAAATGCTGGGTCTGGCACAAGCACAGTTACAATCACTGCAGAAGATGTTGTTGATATTGATGCATCTGATGCAAATGGTAAAGTCCATGTAGAGAATGCAAGATTCCAAGCAAATTACATCGCCACAACTGATGCGACGATGAATCTTGACCCTGGCGATGACCGTGCTGTAACTGGCACTGTCCGTGTCTGGGGTGATCTCCAAGTTGATGGCACTACCACCACTGTAAACAGTACAACCCTGCAGGTCGATGACCCCATCATTACTCTTGGTGGTGACACTGCACCTACAACTGATGACAACCTTGATAGAGGTATTGAGTTTAGATATTATGACACTGAAGCACGTTTAGGTTTCTATGGTTGGGATACTGGGTATACTGATTTGGGTGGTCATGAAGGTGGTTATCGTTTCCTTCATGCTGCTACAAATACTGCCGAAGTCTTTACTGGTACTGATTCTGGTATTATTGCTGGTAATGTAAAACTTACTACTAATACCAACTCCACTTCTAATACAACTGGTGATTTGGTTGTTGCTGGCGGTGCTGGTATTGGTCAGGACGTTAACATCGGTGGTCTTCTCGATGTCGATGGCACACTGCGTGTCACTAGCACTTCTCGTTTCGATGATAGCATCGTCCTTCAGGGTGCATCTAAGACTTTGCAACTGAATAATGGTAGTGGCACCACTCGTATTGAATTGCAATCTACCACTGGTAATGCTTCTTTCTATGGCGTTGTAGATATTACAAATGATCTCAATATTAATACTAATAAGTTTAATGTTGCTTCTGCGACTGGTAACACCCTCATAGCAGGCACACTTGGTATTACTGGAGACACAACTGTAACTGGTGCTACTGATCTTAACAGCACTTTGAATGTTTCTGGATTTACTTACCTCGAAAATACGGCAGAACCTCAGATTGCACTGAATAGTGGCAATGGTGAATGGGAGATTCAGTCTAGTGATTATGGTGCATTTAGATTTGACGGTGGTGGATATGTTGAAGGTGAGACACTTTTCAATTCTGACATTTATGTAAACGGTCAGGTTGTCCAACAGGAAAACGTCAGTGAGGTCTATAACAGACAAAACTACTTGCAGGTCCGTTATAAACTGCGGACAGGTACTTCTGCTGCTTACAATCCTAGTTTTGCAACTGACAACAACTCCAACCTGAGAGTATTTGGTGGTGCTGGTATTTACCAGGATCTTCACATTGGTGATGATCTTTATATCGGTAAACTGAATAGTGGAGACACTACAGAATTTAGTGTCCTTGGTGAGAGTGGAAATACTACAATCGGTCGCTCTGGTGCAGGCACATCATCTGTTGGCACACTGACTGTTTATGGTGATACTCTGCTTGATAGAAATCTGACAGTCAATGGATCTGCAATCACTCTGGGTAATGCAAGCAGTGATGTTTTAACGGTCAATGCTGATGCCACATTCAACGATGATGTAACTATCAACGGTGACAACCTCATGTTTACCATTGAGGCACAGAATGGCACCGATGCATTTACCGTTGACTCTGACAATGGTAATACTGTTATTGCTGGCACACTTAATGTAGATGATGCGACAACAATCACAAACACGCTCAACGTCACTAACGGCGTTGACTTTGATCAAACTCTCAATGTTGATGGTGCCGTTGATTTCAATAGCACTCTGGTTGTTGACGGTCAAACGACTATCTACGATTCTCTAATTCTTCAGAGCGACAACGAAGTATTCAATATTAATACTTCTTCTGGTGCAACTAGATTTAGTGTTGACTTTGATAACGGCAACACTAACATTGTTGGCACTCTGACGGTTGGCAATGCCACTCAACTGAATAACACTCTAGGAGTTACTGGTATATCCAGTTTCACTAATGCTGCTGACCAAACTCTCACAGGTCTCTACGGTGCTGACGGTGCTGTAAGACTCACTGGTGGTATGGGTGTTGCTAAAAACCTCGCTGTTGGCGGCAACATGCGTGTCTATGGTGACTTTGAGATTACTGGTAGCACCACACAGTCTGGTAACACTGGTTTCAGTGGTCGTGTTTCGATTACTAATACTTCTGATATCACTTCTTATACTGATAATACAGTTTCTCTATCGACAGAAGGTGGTTTCAGAGCAGAGAAGAATGCTTACATCGGTGGTGATTTCTACATCTGGGATGCTGCAAATTCTCGTGCTGCATTCTCTGTTGACAACAGCACTGGTAATGCAGAATTACACAATAACCTGATTATCGGAGGAAACCTTACTGTTAATGGCACAACCACTACTGTCAATTCTACGGTCACAACTCTCGATGACCCTATTATTACTCTGGGTGGTGACACAGCACCAGTCTCTAATGACGGTAAGGATCGTGGTGTTGAATTCCGTTATTACGACGGCTCTGCGAAAACTGGCTTCTTCGGATTCGACAGAGGATCCCAACAATATGCATTCCTGACCGATACATCCAATAGCTCTGAAGTTATTTCAGGCACAGATGCTGCTCTTCGTGCTGGTAGTTTGAATCTGACTGGCACTGGCACTACTCTTGACGTTGATGCTAATGCCAACATCGATGGCACTCTGACCGTTGATGGTCAGATTATCTCTCAGGTTTCTTCTGGTCCTGCTCTGGTTATTCCTACAACTAATAAGATCAATAACTTGAATGCTGACCTTCTGGACAGCATGACAACTGCTTCTGCAGCAACACCTACAACCGTTGTTAATAGAGATTCCAATGGAGACTTCGCCGCTAATCAAATTACAGTTAATAATGGCATTGGTGCTCTTGCTGGTATTCAAGGCAATGCTACTACTGCTGATGCACTCAGAACCGCAAGGACAATCACAATCGACGGCGTTGTTGATGGTAGTGTCTCCTTCGATGGATCTGCAAACGTAACCATCAGCACTGTCTACAACGATGCAGACATCACTGCACTCGCTGCAATGGCAGGCACTGGTTTTGTTTCTAGGACTGCTGCTAATACCTATGCACAGCGCACTCTGCAGGTTACAGCATCCTCTGGTATCACTCTAACCAATGCTGATGGTGTTTCTGGTAACCCAACCATTAACGTTGCTTCTGCAAGCACCAACGCTGCAAACAACCTTGTCATTCGTGATGCTTCTGGTAACTTTGCTGCCAATGTCATCACTGCTGATTTGGTTGGCGATGTAACTGGTCAAGTTTCCAGTATTGCAAATCACAGCACAACCAATCTGACCGAAGGCACAAACCTTTACTATACAACTGCAAGAGCAAATGCAGACTTCGATACTAAACTTGCTGCTGCAACTACAACCGATCTTACTGAAGGCACTAACCTCTACTACACAAACGCTCGTGCTGATGCAAGAATTGTTGCTGCTGGACTTAGTGCTGGCACACTAACAGGCAATGTAACTGGTAACGTAACTGGTAATGCTGATACTGCTACTGCAGTTTCTGTAAGTCAGTCTGGTAGCGTTGGTGATTTCTTTGTTGGTATTGTTGCTAATGCTGCTGCTTCAGGCACTTCTGCTCTCAGAGCAGACTCTGGAATGAAGTTTAACACTGGCACTAATATCCTTACCGTGCTCGGTGGCGTTGCTGCTAATGTGACTGGCAACGTCACTGGTAATCTTACTGGTAATGTAACTGGTGACGTAACTGGTAATCTTACTGGTAATGTAACTGGTGACGTAACTGGTAATGTTGATGGTAATGTTTCTGGTGAAGTTACATTAGAAGGTACTGCACCTACCACTGCAACTGATCCTGGCACTGCTGGTGACATTCGTTATGATGCTGATTATGTCTATGTCTGTGTTGCAACAGACACTTGGAAAAGATCCGCCCTCGCTACTTGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
57d5fc6b6660c098373cd2951a6237da366f2c5ba8c4e514fe5aca0c7763ef91
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,5629
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Bacteriophage Syn9 Hendrix,R.W., Pedulla,M.L., Peebles,C.L., Pope,W., Houtz,J.M., Smith,A.L., Hatfull,G.F. and King,J.A. 2003-10 GenBank