UniProt accession
A0A8S5MYY7 [UniProt]
Protein name
Neck appendage protein
RBP type
TF
Evidence RBPdetect2
Probability 0,78
Protein sequence
MIYLFDINERLLKVIRKPAIKSALQKYSLTTENYVSERLTAEVKALNDDELELVEYMAIQSIEDPHLFNYFYVAQKSTKDQITTFTGVQSGIEELRKTPVYDKRPKSTQAKPVINELLQGTNWQARYIAETALHSTNFYYTSVFEALKKLCKVWGLEMQFFVEMNGNGIGARYIDFKKKIGEAVGKRVVYGHNALEILQEVERTNIFTAIVGRGKGEQVSSAEESGKGGDGYGRKITFEDVVWSKAKGDPLDKPKGQKYLEIPEMTQRYGIKNSDGSMRPKIGFVDFGEEEDPNELIKLTYQSLITASRPQLTLKTSSVYLKGVKIGDTIRVVRHDRRLDYDTRIFEITINRLNDQSTDTKLGDRTGESSTSKAQSVADKAIDEFINNEFNSFIQDLPDYIRTADGFNTNWYSEEDPTKKYPKKVMINDIWYKPDPEHEGHKIMLRWTGEVWEEILRTYNEVSLREKIDQKFTELKQAMDEQNAVNEQRITDILKKSDLGRLAEDAKKIAESAKNEIENIKQKSDSVGSELTNFKEKVQTELDGKPNLAKVTELINGVKEQFSSVGLRNYVLGTGTPKTAGNTEKIYTFSKDSFGWTPETKLRLSFDYTADESVKKFRIRRSVTFKNGAVQMDDAINQYTTGSLSIDTTAQKSGRYSQPLGWYRYYSGTGEDVERIDYYVQIDEGSGNVTIKNMMVSTGTNDPDWVPAIEDQEKMLTQAQAEFERTANGLETRLNAISTNFNPDGSASEKFNRYIEHKTAEGLEKERVEISKGYVAKSAYTEKINEIEQHFNLTDSKVAQFATYKNGLDGQYATITKQLSDNQTAYSEFKRTSDTLVQTFGTTGDQIANNVSRMVLNSQIFQTEVGKYSTSGGPNMLRNSRADDGLKYWTEANNRLGFTAHSFYLNGQKRMFDLRPGAVVKSPRFIVKRSTDYTLNIIGFDNNSKYFRIYFCKRKKGSTADFEEKQLVFDGRPQWTDGPVFSNVKAVKKSFKFNIGEFDDGYLQFEYDRNNSNKWGGLFMTELDFYEGDNDRKWQPAPEDSAEPIEAVRTQVTQLNNSYSIRSLTSAGDVLGQLNLNPDGSIRINEGLLSIGKKTYIEDGVIKGAMIAKAQIDTAHIKEIDASQANIFNLNVNNISGLNAEFIKAKIEFALVEWLKGKRISAINDKTVFDLNEGTLNLYTNTGTIRRIDDTSSSQFLQFGQAGFIGEYMRDSKAARIVIGTNHDKTENTQNESFAGSRLWSGSKDGVRESLYEFVGDRIIFYSNGRYRSPWIIHNNTQDGSSYLIPANEKGVRHNLGRGDKHFSGAWIDNIFVGKSAYNVGTYLWDLLTCLGQISKYGWDLKNQNIRSHITSVLNKYSFK
Physico‐chemical
properties
protein length:1360 AA
molecular weight: 154425,09880 Da
isoelectric point:6,43488
aromaticity:0,10515
hydropathy:-0,64331

Domains

Domains [InterPro]
DC_0904
STR
36–427
IPR007119
Unmapped
77–363
IPR010572
ENZ
97–363
A0A8S5MYY7
1 1360
Architecture
STR
STR
RBD
STR 36-427 | STR 441-741 | RBD 745-1351 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Siphoviridae sp. cthrK8
[NCBI]
2826429 Uroviricota > Caudoviricetes >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
DAD87412.1 [NCBI]
Genbank nucleotide accession
BK015021 [NCBI]
CDS location
range 26422 -> 30504
strand +
CDS
TTGATTTATTTATTTGATATTAATGAACGGCTTTTGAAAGTCATCAGAAAGCCAGCGATTAAGTCCGCACTCCAAAAGTACAGCTTGACAACTGAAAATTACGTGTCCGAGCGCTTGACGGCAGAAGTTAAGGCGTTAAATGATGATGAGCTTGAACTGGTTGAGTACATGGCTATTCAATCAATCGAAGATCCGCATCTATTTAATTACTTTTATGTGGCCCAGAAGTCCACGAAAGACCAGATTACGACATTTACGGGCGTCCAATCCGGCATTGAGGAGCTGAGAAAGACCCCTGTCTACGATAAACGTCCGAAAAGCACGCAGGCTAAGCCAGTTATTAACGAGCTATTGCAAGGGACCAACTGGCAGGCTCGCTATATCGCTGAAACGGCACTACATAGCACCAATTTTTATTACACTTCAGTTTTTGAGGCCTTGAAAAAATTGTGTAAAGTCTGGGGCCTTGAAATGCAGTTTTTCGTTGAAATGAACGGAAACGGAATTGGCGCCCGCTACATTGATTTTAAAAAGAAAATCGGTGAAGCTGTAGGAAAGCGGGTAGTATACGGGCATAATGCCTTAGAAATCCTGCAAGAAGTAGAACGGACTAACATTTTCACGGCTATTGTCGGCCGTGGTAAAGGTGAGCAGGTATCATCTGCCGAGGAATCGGGCAAGGGAGGCGACGGCTACGGCCGTAAAATCACTTTTGAAGATGTTGTCTGGTCCAAAGCCAAGGGAGACCCACTAGATAAGCCAAAAGGGCAGAAATATCTTGAAATCCCTGAAATGACCCAGAGATATGGGATCAAAAATTCAGACGGTTCTATGCGCCCTAAGATTGGTTTTGTCGATTTTGGGGAGGAAGAAGACCCTAACGAGCTTATCAAGCTGACCTATCAGTCTCTGATTACAGCCTCACGTCCTCAGTTGACCTTGAAGACGTCAAGCGTCTACTTAAAGGGCGTTAAAATCGGCGATACTATCCGAGTAGTTCGACATGACAGGAGGCTAGACTATGATACACGGATTTTTGAAATCACAATCAACCGTCTAAATGACCAGTCTACAGATACGAAGCTAGGAGACAGGACAGGCGAAAGCTCAACGTCCAAGGCGCAGAGTGTGGCAGATAAGGCTATAGACGAATTTATCAATAATGAATTCAATAGCTTTATCCAAGATCTACCTGATTATATCCGTACAGCAGATGGATTTAACACTAACTGGTACAGCGAAGAGGACCCGACCAAGAAATATCCTAAGAAGGTCATGATAAATGACATCTGGTACAAACCAGATCCGGAGCATGAAGGACATAAAATCATGTTGCGTTGGACAGGGGAAGTCTGGGAAGAAATCCTTAGAACGTACAATGAAGTAAGTCTCAGAGAGAAAATAGATCAGAAATTTACTGAGCTAAAACAGGCAATGGACGAGCAGAACGCTGTGAACGAACAGCGGATAACTGACATTTTGAAGAAGTCGGATCTTGGACGGTTGGCGGAAGACGCAAAAAAAATAGCGGAATCGGCTAAAAACGAGATTGAGAACATCAAGCAAAAGAGCGATTCTGTAGGCTCTGAACTTACTAATTTTAAGGAAAAAGTACAAACTGAGCTGGACGGTAAGCCCAATCTAGCGAAAGTAACCGAGCTGATAAACGGGGTCAAAGAACAATTCTCTAGTGTCGGCCTCAGAAACTATGTTTTAGGCACGGGAACGCCGAAAACAGCCGGAAATACTGAAAAAATCTATACATTTTCAAAAGATTCATTCGGTTGGACTCCTGAAACAAAGCTAAGGCTATCATTTGACTACACAGCAGACGAATCCGTCAAGAAATTCCGAATCCGCCGTTCTGTTACATTTAAAAATGGCGCTGTTCAGATGGACGACGCTATCAACCAGTACACAACAGGCAGTCTATCGATTGATACCACGGCCCAAAAATCCGGCAGATACTCACAGCCGTTAGGTTGGTATAGGTACTACTCAGGCACGGGCGAAGATGTGGAACGCATAGACTACTACGTCCAGATTGACGAAGGGTCCGGAAATGTGACCATTAAAAATATGATGGTTTCGACCGGCACCAATGATCCGGATTGGGTACCAGCTATTGAGGACCAAGAAAAGATGCTCACTCAAGCACAGGCTGAGTTTGAGCGGACGGCAAACGGCCTTGAAACAAGGCTCAATGCTATTTCTACCAACTTTAACCCTGACGGCTCGGCCTCAGAGAAGTTTAACAGGTACATTGAGCATAAGACGGCCGAAGGCTTAGAAAAAGAACGGGTTGAGATTAGCAAAGGATATGTTGCTAAAAGTGCATATACTGAGAAAATCAATGAGATTGAGCAACATTTCAACCTGACAGATAGCAAAGTGGCCCAGTTTGCGACATACAAAAACGGCCTAGATGGCCAGTATGCAACGATTACTAAGCAACTATCCGATAATCAGACGGCCTATAGCGAGTTTAAGCGTACATCTGATACCTTGGTTCAGACATTCGGAACCACAGGCGACCAGATCGCTAACAACGTTTCCCGAATGGTCTTAAATAGCCAGATTTTCCAAACAGAAGTTGGTAAATATTCAACCTCTGGCGGTCCTAACATGCTCCGAAATTCACGGGCAGACGACGGGTTGAAATACTGGACAGAGGCTAACAACAGGTTAGGCTTCACAGCCCACTCATTCTACCTGAACGGCCAAAAACGAATGTTTGATTTAAGACCGGGTGCTGTCGTTAAAAGTCCACGCTTCATTGTCAAGAGAAGTACAGATTACACGCTGAATATTATTGGTTTTGATAATAACTCTAAATATTTCCGGATCTATTTCTGCAAGCGCAAAAAGGGCTCAACAGCAGACTTTGAAGAAAAGCAACTTGTCTTTGACGGAAGGCCTCAATGGACAGACGGGCCAGTGTTTAGCAATGTAAAGGCCGTCAAGAAGTCCTTTAAGTTTAATATCGGTGAATTTGATGACGGTTATCTTCAATTCGAGTATGACCGTAACAATTCTAATAAGTGGGGCGGTCTGTTTATGACCGAGCTTGACTTCTACGAGGGCGATAATGACCGCAAATGGCAACCAGCGCCAGAAGACAGCGCAGAGCCTATCGAAGCCGTCAGAACGCAAGTAACACAGCTTAATAATAGCTATTCAATCCGTAGCTTGACCAGCGCAGGAGACGTCTTAGGACAACTCAATCTAAATCCTGATGGGTCAATAAGAATCAATGAAGGTCTGCTGTCTATTGGCAAAAAAACCTATATTGAGGACGGCGTTATCAAAGGCGCTATGATTGCCAAAGCCCAGATTGACACGGCGCACATCAAGGAGATTGACGCTTCACAGGCTAATATCTTTAATTTGAATGTTAACAACATCAGCGGTTTAAATGCTGAGTTTATCAAGGCAAAAATTGAGTTCGCTCTGGTCGAATGGCTAAAGGGCAAGCGGATTTCAGCCATCAATGATAAGACAGTTTTCGACCTCAACGAAGGTACGCTTAATCTGTATACTAATACAGGAACCATCAGGCGCATTGATGATACTAGCTCTTCCCAATTCCTGCAATTCGGCCAGGCTGGTTTTATCGGTGAATATATGAGGGATTCTAAGGCGGCCCGTATCGTAATAGGGACCAACCACGACAAGACAGAGAACACTCAGAACGAGAGTTTCGCAGGTTCCCGCTTGTGGTCAGGATCTAAAGACGGCGTGCGAGAGTCACTTTATGAGTTCGTCGGAGACCGTATCATTTTCTATTCTAACGGTCGCTATCGTAGCCCGTGGATTATCCACAATAATACGCAAGATGGAAGCTCTTATCTAATTCCTGCGAATGAAAAGGGAGTCCGTCATAATTTAGGCCGTGGAGATAAGCACTTTTCGGGCGCTTGGATTGATAATATATTTGTTGGGAAAAGCGCCTATAACGTAGGTACTTATCTATGGGATCTACTGACCTGTCTTGGTCAGATCTCAAAATATGGCTGGGATCTAAAAAACCAGAATATCAGAAGCCATATAACGAGCGTGCTGAACAAGTACAGTTTTAAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
15c15061d73b4055d66dd26222068711118fd0eddde8a1c33efe6162ed92ceee
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,7397
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50