Genbank accession
WNL50659.1 [GenBank]
Protein name
hypothetical protein
RBP type
TF
Evidence RBPdetect2
Probability 0,84
Protein sequence
MPLGKSPLLQNDLMAEGDNNKHLLFNDALVALEDSVNRLYEVDLAGDNVTLTQTQMTRYGVFRCTGHTVARSLQLPIALGTDLVATQRVFAVRNEGTGAVTVTTNNGGADVIIGAGSTGLLYTDATDVISLGGVANAATIPLNKDGVEVVARLLSLNFAGEGFTITDDGNGAATVTYTPPSLALLGLSDTPTSYAGEAGKLLAINLTENGIEFVDPSEAAMSAEQVKTAYESNADTNAFTDAEQAKLAGIEAGATGDMTAAEIKTSYESNSNTNAFTDAEKSKLASLEESLFKGTFTSLTALDTAYPLADAGSYAYVDPGIGEAAAIYIWDDDDSTWRQGGGSGTSETPATVKSKYESNADTNAFTDAEKTKLAGIEDGATGDLTAEEIEAALDTYYGNTDWRTGGGGSMSAADIEAALDSYYGNTDWRTGGSGGGETTYLSFPEVYGNETAETSTSSSNYATKGNILSPQNDRTLIQVESYAAAGQTLQLVIAELASSNPGQITEVLYTSDPLVVSTTGEISFSLAEPLALTAGTSYAFMLTRTDGTATSGAGVPFPGGSGFADPNGNWTWQAAIRYASISPQVGDNTYYATSTSVRMVLKDTDGAAALLLAGGGSMSAEDIEAALDAYYGNTDWRTGGTGGGAEMSDPIALNVVNGDFETGDGTGWTTTTGTLVCGLSYSAEFAGAGASTQDNGEYVARGGAQSRNIFHQDVDISGVVAEGVAFTLTADAYITEADDDTLTLTLELLDAGNAVLATTSYVNADPVITHDEVSLSLDAVTGAVTARITVDFDRNTGTDAGLGIDNIALSYTTPLPPMSAEDIEAALDAYYGNTDWRTPGTGGGGTVTPTKKTLLSTSTNQTIPASTLTQMTFDAVEEDSGDFYSAGSPNQFTIPAGVTAVLVTASWRVDANVNDLAVETVFRKNGATETYDRRDVSGWGGATISQILSVEEGDVITFHLFGTAGFTNRAAGTRFSILDLTSVSGAGGGGDTIAYDAKVGRAYWPDTSPPSSGVWNSIPFGTVAVDDLSFFDVLANPARMTIPAGVSRIRINVSLWETSTASSGSSQFRLFKNGSIMGVSDGGFNIEPDRSGGYNNSGMFGESAVLDVVEGDYFEIKQFASNTSQNSEGWAEIEVVTGAVLGGGSGDGDITLNKNFLVPYNFYQSTTLTTGTAASYSSKGVLLAVTQTQVVISLGTYFPDAGQTIVAQVFEVDTVESPSIVQSLVYQSDPFVTEATTMAIATPGLTLEAGKSYYLAWTYASGGGTQAISVSYTAENPEAASWISGRNGGRIALDASGNFIGQDVYYDPSDHYRFDITSYPESARAIIAGGVAGPQGAQGPQGPAGPAGADGAGTLVLSEDTAADHAVTNADLLGNQFLKLNYPTAQTVTVTAGLTGTEPLTVVQTGSGQVTFVPDAGVTINSAGGLLSLRAQYSSATLVPDGADNFYLIGDLA
Physico‐chemical
properties
protein length:1453 AA
molecular weight: 150331,67420 Da
isoelectric point:4,05003
aromaticity:0,08328
hydropathy:-0,09002

Domains

Domains [InterPro]
WNL50659.1
1 1453
Architecture
ATT
STR
STR
RBD
STR
ATT 2-305 | STR 306-567 | STR 654-810 | RBD 811-1137 | STR 1306-1453
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Ruegeria phage RpAliso
[NCBI]
3073043 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WNL50659.1 [NCBI]
Genbank nucleotide accession
OR257569 [NCBI]
CDS location
range 44759 -> 49120
strand +
CDS
ATGCCCTTGGGTAAGTCCCCCCTTCTTCAAAACGACCTCATGGCTGAGGGCGACAACAACAAGCACCTGCTGTTCAACGATGCGCTCGTCGCCCTCGAAGACAGCGTCAACCGCCTGTATGAAGTCGACCTCGCCGGAGACAACGTTACCCTCACCCAGACGCAGATGACGCGTTATGGGGTCTTCCGCTGCACCGGGCACACGGTTGCCCGCAGCCTGCAGCTCCCGATTGCTCTGGGCACGGACCTCGTCGCCACGCAGCGCGTGTTCGCGGTGCGTAACGAGGGGACCGGCGCGGTCACGGTGACCACCAACAACGGCGGCGCAGACGTGATCATCGGCGCTGGGTCGACGGGGCTTCTCTACACAGACGCAACGGACGTCATCTCTCTCGGCGGCGTGGCGAACGCGGCAACCATCCCGCTGAACAAGGACGGTGTGGAAGTCGTTGCCCGCCTGCTCTCGCTCAACTTCGCTGGCGAAGGCTTCACCATCACCGACGATGGTAACGGGGCTGCGACCGTAACCTACACCCCACCCTCCCTCGCCCTCCTCGGCCTGTCGGACACGCCCACGAGCTACGCCGGGGAAGCGGGCAAGCTGCTGGCGATTAACCTGACCGAAAACGGTATCGAGTTCGTTGACCCGTCCGAGGCAGCGATGTCGGCGGAGCAGGTGAAGACGGCCTACGAGTCGAACGCCGACACCAACGCTTTCACCGACGCGGAGCAGGCCAAGCTCGCCGGGATCGAAGCGGGGGCGACCGGGGACATGACCGCAGCAGAGATCAAGACCTCCTACGAGTCGAACTCCAACACCAACGCTTTCACCGACGCGGAGAAGTCCAAGCTGGCGTCCCTCGAAGAGTCCCTCTTCAAGGGCACCTTCACCAGCCTGACGGCGCTCGACACCGCCTACCCGCTCGCGGACGCTGGCTCCTACGCCTACGTCGATCCGGGCATCGGGGAAGCCGCTGCGATCTACATCTGGGACGACGACGACAGCACGTGGCGTCAGGGCGGAGGCTCCGGCACGTCCGAGACCCCGGCGACCGTGAAGTCGAAGTACGAGTCCAACGCGGACACGAACGCCTTCACGGATGCCGAGAAGACCAAGCTCGCAGGCATCGAAGACGGGGCAACCGGCGATCTCACGGCGGAGGAAATCGAAGCCGCACTCGACACCTACTACGGCAACACCGACTGGCGCACCGGGGGCGGCGGAAGCATGTCCGCCGCAGACATCGAAGCGGCGCTCGACTCCTACTACGGCAACACCGACTGGCGCACGGGCGGATCGGGCGGAGGCGAGACCACCTATCTCTCGTTCCCGGAGGTCTACGGAAACGAGACGGCAGAGACCAGCACCTCTAGCTCCAATTACGCCACCAAGGGTAACATCCTGTCTCCTCAGAATGACCGGACGCTGATTCAGGTGGAATCCTACGCCGCCGCCGGGCAGACTCTGCAGCTTGTCATCGCGGAGCTGGCAAGTTCGAATCCCGGACAGATCACGGAAGTCTTGTATACCAGCGACCCCTTGGTGGTCTCCACCACGGGGGAGATTTCCTTCTCTCTGGCGGAGCCGTTGGCGCTGACTGCGGGAACTTCCTACGCCTTCATGCTGACCCGGACGGACGGAACCGCAACCTCGGGTGCGGGCGTACCCTTCCCCGGTGGCTCCGGGTTCGCCGACCCGAACGGCAACTGGACGTGGCAGGCCGCAATCCGGTACGCCTCGATTTCCCCGCAGGTGGGGGACAACACCTACTACGCCACCTCCACGTCTGTACGCATGGTTCTCAAGGACACGGACGGGGCTGCGGCCTTGCTGCTGGCAGGTGGCGGAAGCATGTCCGCAGAGGACATCGAAGCCGCCCTCGACGCCTACTACGGGAACACCGACTGGCGCACGGGAGGCACGGGGGGCGGGGCAGAAATGTCTGACCCCATCGCCCTGAACGTGGTGAACGGCGACTTCGAGACCGGCGATGGCACCGGCTGGACCACCACGACTGGCACCCTTGTCTGCGGTCTGTCCTACTCGGCAGAGTTCGCTGGGGCCGGGGCCTCCACGCAGGACAACGGGGAGTATGTCGCCCGTGGTGGTGCTCAGAGCCGCAACATCTTCCATCAGGACGTGGACATCTCCGGGGTGGTTGCAGAGGGTGTGGCCTTCACCCTGACGGCAGACGCCTATATCACCGAGGCCGACGACGACACGCTGACCCTGACCCTCGAACTGCTGGACGCAGGCAATGCGGTTCTTGCAACGACCTCCTACGTCAATGCCGATCCCGTCATCACTCATGACGAGGTGTCCCTGTCGCTTGACGCGGTGACTGGTGCGGTGACGGCCCGGATCACCGTGGACTTCGACCGCAACACCGGCACGGACGCAGGGCTGGGCATCGACAACATCGCGCTGAGCTACACCACCCCGCTGCCTCCCATGTCCGCAGAGGATATCGAAGCGGCTCTCGATGCCTATTATGGCAACACCGACTGGCGCACGCCGGGAACCGGGGGTGGTGGGACCGTAACCCCGACCAAGAAGACCTTGCTGAGCACGTCGACGAACCAGACCATCCCTGCCTCGACCCTCACCCAGATGACCTTCGACGCTGTGGAGGAGGATTCCGGAGACTTCTACTCTGCAGGTTCCCCGAACCAGTTCACCATCCCTGCGGGGGTCACCGCTGTCTTGGTTACGGCTTCTTGGCGTGTTGATGCCAACGTCAATGACCTTGCAGTTGAGACTGTTTTCCGGAAGAACGGAGCCACTGAAACCTACGACCGTCGCGATGTTTCGGGATGGGGCGGGGCGACCATCTCCCAGATTTTGAGCGTCGAGGAAGGTGATGTCATCACTTTCCACCTGTTTGGCACTGCAGGGTTCACCAACCGGGCGGCGGGAACCCGCTTCTCGATCCTTGACTTGACCTCCGTTTCCGGAGCGGGCGGGGGTGGAGACACCATCGCCTATGACGCCAAGGTCGGGCGGGCCTACTGGCCTGATACCTCGCCGCCGTCCAGCGGTGTCTGGAATTCGATCCCGTTTGGCACCGTGGCCGTGGACGATCTGAGTTTCTTCGATGTCCTCGCCAATCCTGCGCGAATGACCATTCCGGCAGGGGTGAGTCGTATTCGTATCAATGTCTCCCTCTGGGAGACCTCGACTGCGAGCAGCGGCAGTTCCCAGTTTAGGCTCTTCAAGAACGGTTCGATCATGGGGGTCTCCGATGGGGGATTCAACATCGAGCCAGACAGGTCCGGGGGCTACAACAACTCCGGCATGTTCGGGGAGTCCGCTGTTCTCGATGTGGTGGAAGGGGATTACTTCGAGATCAAGCAGTTCGCCTCCAACACCTCCCAGAACAGCGAAGGCTGGGCCGAGATCGAAGTGGTAACCGGCGCTGTTCTCGGAGGGGGCAGCGGCGACGGGGACATTACGCTCAACAAGAACTTCCTCGTCCCCTACAACTTCTATCAGTCCACCACCCTGACCACCGGGACTGCTGCATCGTATTCGTCCAAGGGCGTTCTACTGGCAGTCACCCAGACGCAGGTGGTGATCTCTCTCGGCACCTACTTCCCGGATGCGGGACAGACCATCGTGGCACAGGTGTTCGAGGTGGACACGGTTGAAAGCCCCTCCATCGTTCAGTCCTTGGTTTACCAGAGCGATCCGTTCGTCACGGAAGCCACGACCATGGCGATTGCAACCCCCGGACTGACCCTCGAAGCGGGCAAGTCCTACTACTTGGCTTGGACGTACGCCTCCGGCGGCGGGACGCAGGCAATTAGCGTTTCCTATACCGCCGAGAACCCCGAAGCAGCCTCTTGGATTTCGGGTCGAAACGGTGGGCGTATCGCCTTGGATGCGTCTGGGAACTTCATCGGACAGGATGTCTACTACGACCCTTCCGACCATTACCGGTTCGACATCACCAGCTACCCGGAAAGCGCGCGGGCGATCATCGCAGGCGGCGTGGCTGGCCCGCAGGGGGCACAGGGTCCGCAGGGTCCGGCAGGGCCTGCCGGGGCGGATGGGGCCGGAACGCTTGTCCTGAGCGAGGACACCGCAGCCGACCACGCGGTGACGAACGCCGACCTTTTGGGCAACCAGTTCCTCAAGCTGAACTACCCTACCGCACAGACCGTGACGGTAACGGCAGGGCTGACCGGAACGGAACCGCTGACGGTGGTCCAGACGGGGAGTGGACAGGTCACTTTCGTTCCTGACGCAGGCGTCACGATCAACTCGGCGGGAGGGTTGCTCAGCCTGCGGGCGCAGTATTCCTCTGCTACCTTGGTGCCGGACGGGGCCGACAACTTCTACCTCATCGGGGATTTGGCCTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
5044fbf4a8de58fc26ac876d77ae5710aefde69daac4c4f41ced917a5ca2e56f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6374
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50