Genbank accession
WCS68034.1 [GenBank]
Protein name
hypothetical protein
RBP type
TF
Evidence RBPdetect
Probability 0,60
Protein sequence
MPQIKLRYNGKWITIGGGLSGGDTGEIVDYIDQIKKELQNNLDKISTDLNNTDIYIDGAFRDGIITETEAKKIKAYLNILNTSKVQLDQRFEEIYKNLYLPTFNKEGLVSANNTYQAAYENLHKTILDAIVDGKATEEESSAVDAAFDSYARALSLLVSALEVSVDAINNAKNKETLDNSKKYTDDLYVPLDERVVKAESEIKTTKEQISLRVTKEEFTQGLNNNLDSAKQYSDTQKKALETDLSTLRGDLQETDEYINGAFRDGIVYDSEKIQIEGYLNTIKTSKSQYDNRYQSVHDNSYLPETPRLNLESAKTDYDAKYDALVLAITNAIDDQLADDDETAKVNSAFDAYNQALALLTLSLEVAIDAISKAKAEEARKLAEGYADELKQGLDKEIENVQQSIKETDDYITHAFRDGLVSETEAKRIEGYLLGLAQNHQAIIERYTEIYNNQMLAGIAKTDLYQKQVDYVSAYELLVETINNATADGQTTSAEANDVQLKFYDYNNRFKELTKAIETAIDFISTSKANQSEENSKDYTDGKIEPIETRLTTAESNITQNANEIALRVKEETYNQGMKLVDGIDTRLKTAESTIVQQADAISQRVTIENFDTKAKQLQLDADNARKAADTAQQTADEAKSGVDKAVNTISDLTSDNKLSQSEKTEAKREWEAIQAEKITLEKQATDYGITTPKTNYVAAYNSLEAFLTPLIADLSTISDVDGEMFRAKFKDYYDNRSTLLQAIATASKKQSDDLDNRLTNLKYVNANILAGSMFNEGDVLPIDSGTVVNIQQNDGDVNSVQVKQYSASSAIYGFKTTRQTTEFKTGTVYTLSMQVAIGDATKLDAIYIKSAEGGSQKLPSIPITWTDTAYRTVTLTFTSNISTSRGYIQVATADLSPTRIEYFYVKKLKIEEGSIATPYIPSGADTGTLGSQVAKAESEIKQNAEQIQLRVSKTDFNGKNVVSMINQTADEVLIEASKIKLNGDVNVGGFSNYVQDPDCEKALSLNWTITATGSGGFSYAVLPTNDVPPAGEPNFPPPTKYGIKLQVNEKKLYEMKQPKFDVEPGTPLAISCYTYKKLNETAMYSGWFAVNFYNASGSLLQDEFYVPLRGNDDEPLWSLVRAEMKVPAKAAKAEVYIRFKPLADEEYPLTYYIGSPKVSKPGTMDVDSIYSYLVYSQRVTVNKTLDFGYRGNIKQQGYLAPYGDIKMQDGVLTSTKNDYKLHVGNGHISAVKYYDIDSDSLNPRMILDAVGLHAYSSGNNKNAMFSTEGNLEMYRDAAIVFKSSPSSMTFNKYGNLTPTTPSNASATASWNVGHVNGGNVIKAYFGSSGGSNNAYGIQIIPGGSGNGFEFVNLDSSNIGMKGPNQIIKFLGGSSTTQFRNRADSDYASITVGGLTNHSYRDSKTGIEESSINAMSIVKDLIVREYYKGSDLVVKDENGNDLYCELPGSTVLLSPKKQIGLIWDEAADCIRNPDGIDLYKFCTLLLKALQETEERLTAGGL
Physico‐chemical
properties
protein length:1500 AA
molecular weight: 165673,57980 Da
isoelectric point:4,80138
aromaticity:0,08533
hydropathy:-0,48260

Domains

Domains [InterPro]
DC_1272
STR
6–225
DC_1272
STR
222–388
Coil
Unmapped
386–406
WCS68034.1
1 1500
Architecture
STR
STR 6-1099 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage vB_BsuM-Goe26
[NCBI]
3026977 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Bacillus subtilis
[NCBI]
1423 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WCS68034.1 [NCBI]
Genbank nucleotide accession
OM728296 [NCBI]
CDS location
range 71903 -> 76405
strand +
CDS
ATGCCTCAAATAAAACTAAGATATAACGGTAAATGGATTACCATTGGAGGCGGTCTCTCAGGCGGGGATACAGGAGAGATTGTGGACTACATCGATCAAATCAAAAAAGAACTCCAAAATAATCTTGATAAGATTTCAACAGACCTCAATAATACAGATATTTACATTGACGGGGCTTTTCGAGACGGTATCATAACGGAGACTGAAGCAAAGAAAATAAAGGCATACTTAAATATCCTTAACACTTCTAAAGTACAGCTTGATCAGCGTTTCGAGGAGATTTATAAAAACTTGTACTTACCAACTTTTAACAAAGAGGGGCTTGTAAGTGCTAACAACACTTATCAAGCAGCTTATGAGAACCTTCATAAGACTATTCTTGATGCTATCGTCGACGGGAAGGCAACGGAAGAAGAGTCTAGCGCTGTTGATGCCGCATTCGATTCCTACGCGAGAGCGTTATCCCTTCTTGTGTCCGCGTTGGAGGTTTCAGTTGATGCTATAAACAACGCTAAGAATAAAGAGACGTTAGACAACTCGAAAAAGTACACTGATGATCTTTACGTCCCATTAGATGAAAGAGTCGTAAAAGCTGAATCTGAAATCAAAACAACTAAGGAGCAGATTTCTCTTAGGGTAACAAAAGAGGAGTTCACTCAAGGGTTGAACAACAACTTAGACTCAGCGAAGCAATACTCTGATACGCAGAAGAAAGCTCTCGAGACAGATTTGTCAACCCTTCGCGGAGACCTACAGGAGACTGATGAGTACATCAATGGAGCTTTCCGGGATGGAATTGTATATGACTCTGAGAAAATACAGATTGAAGGTTATTTGAACACGATTAAAACTTCAAAGAGTCAGTATGACAACCGTTACCAAAGTGTTCATGATAACTCGTATTTACCTGAGACTCCTCGACTCAATCTTGAAAGCGCTAAAACTGACTATGATGCAAAGTACGACGCGCTTGTTTTAGCTATTACAAACGCTATTGATGATCAGCTAGCCGATGATGATGAAACAGCAAAAGTTAACTCAGCCTTTGATGCCTATAACCAAGCGTTAGCGCTGCTTACCTTATCTTTAGAGGTCGCTATAGACGCGATTAGCAAAGCGAAGGCAGAAGAGGCTAGAAAGCTCGCAGAGGGTTACGCCGACGAGCTGAAACAAGGTCTAGACAAAGAGATTGAGAATGTACAACAATCTATCAAAGAGACTGACGACTATATCACTCATGCGTTCCGGGATGGACTAGTAAGTGAAACCGAAGCCAAACGAATTGAAGGGTACTTATTAGGGTTAGCCCAAAACCATCAGGCGATAATCGAGAGGTACACTGAGATTTATAACAACCAAATGCTAGCAGGAATAGCGAAGACTGACTTGTACCAAAAGCAGGTTGACTATGTGTCCGCGTATGAGCTCCTTGTTGAGACGATAAACAACGCGACTGCCGACGGACAAACAACTTCAGCTGAGGCTAATGATGTTCAGCTAAAGTTCTACGACTACAATAACCGTTTCAAGGAGCTTACAAAGGCTATCGAGACAGCCATTGATTTTATTTCAACCTCGAAGGCTAACCAGTCAGAAGAGAACTCAAAGGATTACACTGATGGTAAGATTGAGCCTATTGAGACAAGATTAACAACAGCAGAGTCTAATATCACTCAAAACGCAAATGAGATAGCCTTGCGTGTAAAAGAAGAAACATACAATCAGGGTATGAAGTTAGTTGACGGTATTGATACCCGGTTAAAGACTGCTGAATCAACTATTGTCCAGCAAGCAGATGCTATCAGTCAGCGTGTAACAATAGAGAACTTCGACACGAAAGCGAAACAGCTACAACTTGATGCAGACAACGCGAGAAAAGCAGCGGATACTGCACAACAGACCGCAGATGAAGCTAAGTCCGGGGTTGATAAAGCAGTCAATACTATTTCTGATTTAACGTCGGATAACAAATTATCTCAATCTGAAAAGACTGAAGCCAAACGTGAGTGGGAAGCTATTCAAGCAGAAAAGATAACGTTAGAGAAGCAAGCTACCGACTATGGTATAACAACGCCAAAGACAAATTATGTAGCTGCTTACAACAGTCTTGAAGCGTTCTTAACACCTTTGATCGCAGATTTGTCTACCATATCTGATGTTGACGGAGAGATGTTCCGAGCGAAGTTCAAAGATTACTATGATAACCGATCAACTCTCCTCCAGGCAATAGCGACAGCATCCAAGAAGCAGTCTGACGACTTAGACAACAGGTTGACAAACTTGAAGTACGTTAATGCGAATATACTGGCTGGATCTATGTTTAACGAGGGGGATGTCTTACCTATTGACTCAGGAACAGTAGTCAATATACAACAAAATGACGGAGATGTTAACAGCGTTCAAGTTAAGCAATATTCTGCCTCCTCGGCAATTTACGGTTTCAAGACAACTAGGCAAACAACAGAGTTCAAGACAGGAACTGTATATACTTTATCAATGCAAGTAGCGATAGGCGACGCGACAAAGTTAGACGCGATCTATATTAAATCCGCGGAGGGCGGGTCTCAGAAGCTACCCTCAATTCCAATAACTTGGACTGACACTGCCTATCGGACTGTGACGCTGACGTTTACGAGTAACATATCAACGTCTAGGGGTTACATTCAAGTTGCGACAGCAGACTTAAGCCCAACAAGAATTGAGTACTTCTATGTTAAAAAGCTTAAAATTGAGGAGGGAAGTATCGCAACGCCATACATCCCTTCTGGAGCAGATACAGGTACTCTTGGAAGTCAGGTAGCTAAAGCTGAGTCAGAAATTAAGCAGAACGCAGAACAGATACAACTTAGAGTTTCAAAGACTGACTTTAACGGTAAGAACGTTGTATCTATGATTAACCAAACAGCCGATGAAGTTCTCATTGAGGCTAGCAAGATAAAACTTAACGGGGATGTTAACGTTGGGGGTTTCTCGAACTATGTACAAGACCCTGACTGTGAAAAAGCTTTGTCTTTAAACTGGACAATAACAGCTACAGGTTCGGGAGGATTCTCATACGCGGTCTTACCGACAAACGATGTACCACCAGCTGGTGAACCAAACTTCCCTCCTCCGACTAAGTATGGGATAAAGCTGCAAGTAAATGAGAAGAAGCTGTACGAGATGAAACAGCCAAAGTTTGATGTTGAACCGGGAACTCCATTGGCTATTAGCTGTTACACCTATAAAAAGCTAAATGAGACAGCCATGTATTCCGGTTGGTTTGCGGTTAATTTTTACAACGCAAGCGGATCATTACTCCAAGATGAGTTTTATGTACCATTGAGAGGGAATGATGATGAGCCTTTATGGTCGCTAGTACGGGCTGAGATGAAAGTTCCGGCGAAGGCTGCTAAAGCAGAGGTGTATATCAGATTCAAACCGTTGGCTGACGAGGAGTACCCATTAACCTATTACATTGGGAGTCCGAAGGTTTCCAAACCCGGTACGATGGATGTTGACTCTATCTATTCTTACCTAGTATATTCTCAACGAGTTACAGTCAACAAGACACTCGACTTTGGGTATAGAGGTAATATAAAACAACAGGGGTATCTAGCTCCTTATGGAGACATAAAAATGCAGGATGGTGTGTTAACATCTACAAAGAACGATTATAAGCTACACGTGGGTAATGGACACATATCTGCTGTAAAATATTATGACATTGATAGTGACTCCTTGAACCCGAGGATGATACTTGACGCTGTTGGATTACATGCGTACTCTTCCGGGAATAACAAAAACGCTATGTTTTCAACTGAAGGTAATTTAGAGATGTATCGCGATGCGGCGATAGTTTTCAAGTCGTCTCCATCTAGTATGACTTTTAACAAATATGGAAACTTAACGCCGACAACACCTAGTAACGCGTCTGCGACAGCGAGTTGGAATGTTGGGCACGTAAACGGAGGTAACGTAATAAAAGCTTACTTTGGTTCAAGCGGAGGAAGCAACAACGCTTACGGTATTCAAATTATCCCGGGAGGATCAGGTAATGGATTTGAGTTTGTAAACCTTGATAGTTCAAACATCGGTATGAAAGGGCCAAATCAGATAATAAAGTTTCTGGGCGGGAGTAGCACAACACAGTTCAGGAATAGAGCTGACTCTGACTACGCTTCTATCACTGTCGGAGGACTAACTAACCACTCGTACAGGGATTCAAAAACGGGAATTGAAGAGTCGAGTATAAATGCTATGTCCATAGTAAAAGACCTCATTGTAAGGGAATACTACAAAGGATCAGACTTAGTTGTAAAAGACGAGAATGGAAACGACTTATATTGTGAGTTGCCTGGCTCCACTGTTTTGTTGTCACCAAAGAAACAAATTGGGCTGATTTGGGATGAAGCTGCGGATTGTATAAGAAACCCTGATGGAATTGACCTATACAAGTTCTGTACTTTGTTACTAAAAGCGTTACAGGAGACTGAAGAAAGACTAACTGCGGGAGGACTGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
9d568e6f307b7d7478cf5c34ac314f0725a3363be656ca220b0198b28c8b9ee5
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6260
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50