Genbank accession
XCD04980.1 [GenBank]
Protein name
pyocin knob
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,79
TF
Evidence RBPdetect2
Probability 0,89
Protein sequence
MDKILQQIGTFLGRKFSKIYTIFNDKYNELDNKKVDKEEGKELMPSPEGASDTVFLSETGWREVNTDKIRTHVISISIPFDSAWDFNGTQEITLEEGDYDRDEADSFIYDYFRYNNPNVVIRNTNTTAQSAQKGYHTVWKVALDTIAEGRALRLYLDIPKNLSFTMAPEADSAKFTRYCILLYLSQDEGNQTYILNNIGILPNGTDSFIPRKYLDGKLSDITSSYLPLSGGLMTGNIAFPDGKGLGSAVGQSDLLVRSGNTVKLGSAGFSARLYAENPVVREGLEGMFTMYDTSNLDIDKPFVTNLWAVYDAEGKNTQSIAVDLYNPVAKSATKVYRELLPVTDTNMGLITPYYKSVLDGLISTSGNAVTIYGTPSATWTVGTVGPKLKNSGGIFELRNNIDNAYTDLILNNLTIKGNVTQEGSSFITEAETVEVSDNILLLNRGEVGSGVTKGISGIQVDRGDLTDYQFIFDESDDRFKVGVEGDLWPVMLRNNESDLSDKFFLSWDASLKRAVTTNIVPETGLLFSGGVSNHPEYDITVAATGSGSIGFGALQANTPWSCTIGYNLNTREVPSADILDFATSLNAYRYDKPSVLNMIYFDTYLSPNSIEPYGTSSISLTTGSGDNLIHTKGGQNYIIYDSGNLNIEELATKDDISGLGTVYYPYSGRGYMTIGADGRPILANSNGILFNKTGGERVEGIYMGSNNHLVLGGSSNTNVPIDMFNDLGITRILDRSTNYSLLVFTNGGTGDSQYTHIGAELGTTRIRSGLFNLVHDRGGTLYTIFDSYNFSRDLGSTNINSSFNHLPMMAAQPSNSDATTDRGYPIQNAGSLIVIPGVYGGSSQIYGTYNSNRWFVRSGSPTPNNENDHTAWKELATTSHLSNYLPLSGGTMSGNIRIPYNSWIEQTHTSGSNATSPIKWLSNDASTIMAQIGHATMGGPDSSGSIYIIPRAITSTPWDGTNGLFIYKGGVKIDGEELAKVSQISSTSNFLPLSGGTLTRTTAGPVLSLKNTSGNKEVYMDFYKGDVRCGYIGAAASNTENIYLYAYDSRDIRIGTTQGSISFETGVNNLIHKKNGTSYTILDTANIASLTIQFNGSTNTTYAPNAAKTVNITPAAIGAAASSHTHTKSQITDFPSSMPASDVYAWAKASSKPSYSWSEITSKPSTFTPSSHTHPLSDISDLQASWDALLKAVPSAYVTRWPSWSEVTSKPSFATVATSGSYNDLSNRPSIPSAETAATIMSKINSQSEITFSKHVVCSAGAGTSSTSDIRFKNNITPLAPVLSHVLGSPGFFYTWKDEDEVLVGTSAQYWEGRITGLVREINDKSKTKTFSYERYTVILQEALKEEHMLREAEKEEYRKEICSLREELEDLKKLIQKLL
Physico‐chemical
properties
protein length:1380 AA
molecular weight: 150464,76340 Da
isoelectric point:5,13162
aromaticity:0,09638
hydropathy:-0,31623

Domains

Domains [InterPro]
DC_1617
STR
1–771
IPR030392
CHP
1268–1358
Coil
Unmapped
1341–1375
XCD04980.1
1 1380
Architecture
STR
STR
RBD
STR 1-771 | STR 812-876 | RBD 982-1379 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
XCD04980.1
1 1380
Domain Start End Length (AA) Confidence
N-terminal 1 66 66 0,9750
Central domain 67 383 318 0,6172
C-terminal 384 1380 996 0,5010
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-66
Central
67-383
C-terminal
384-1380

Taxonomy

  Name Taxonomy ID Lineage
Phage Dulem virus 41
[NCBI]
3145759 Uroviricota > Caudoviricetes >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XCD04980.1 [NCBI]
Genbank nucleotide accession
PP511520 [NCBI]
CDS location
range 8522 -> 12664
strand +
CDS
ATGGATAAAATCTTACAGCAAATAGGAACGTTTCTAGGAAGAAAATTCAGTAAAATATATACTATTTTCAACGACAAGTATAATGAACTGGACAATAAAAAGGTAGACAAGGAGGAAGGTAAGGAGCTGATGCCTTCACCGGAAGGAGCTTCTGATACTGTATTTCTGTCTGAAACAGGATGGAGAGAAGTGAATACAGATAAGATCAGGACTCATGTCATAAGCATTTCTATTCCTTTTGATTCTGCATGGGATTTTAATGGCACACAGGAGATTACCCTGGAAGAAGGTGATTATGACAGGGATGAGGCCGATTCATTTATATATGACTATTTCAGGTATAATAATCCCAATGTAGTAATAAGGAATACTAATACTACTGCACAGTCTGCTCAAAAAGGTTACCATACTGTATGGAAGGTAGCCCTGGATACCATTGCAGAAGGAAGAGCTTTAAGACTTTATCTGGATATTCCTAAGAATCTGAGTTTTACCATGGCTCCTGAAGCAGATAGTGCCAAATTTACAAGATATTGTATTCTCCTCTATCTGTCTCAGGATGAAGGGAATCAGACCTATATACTCAACAATATAGGAATACTTCCGAATGGTACTGACAGTTTCATCCCAAGGAAATACCTGGATGGTAAGTTAAGTGACATTACAAGTTCTTATCTGCCATTATCCGGAGGATTGATGACAGGTAATATAGCCTTTCCTGATGGAAAGGGGCTTGGATCTGCTGTCGGTCAGTCTGATTTACTGGTAAGGAGCGGGAATACTGTAAAGCTTGGATCTGCCGGATTTTCTGCCAGATTATATGCTGAAAATCCTGTTGTCCGTGAGGGCCTGGAGGGGATGTTTACAATGTATGACACTTCAAATCTGGATATAGATAAGCCATTTGTGACTAATCTGTGGGCTGTATATGATGCTGAAGGTAAAAATACCCAGAGTATAGCTGTGGACTTGTATAATCCAGTTGCTAAGTCGGCTACTAAGGTATACAGGGAATTACTCCCTGTTACTGATACAAATATGGGTCTTATAACTCCTTATTATAAGTCAGTTCTGGATGGCCTTATTAGTACATCAGGGAATGCAGTAACTATTTATGGTACTCCTTCTGCTACGTGGACAGTAGGCACTGTAGGACCAAAATTGAAGAATTCAGGAGGTATATTTGAGCTGCGTAATAATATAGATAATGCCTATACTGATCTTATCCTTAACAATCTGACAATTAAGGGTAATGTTACCCAGGAAGGGTCATCATTCATAACAGAAGCTGAGACTGTAGAAGTATCCGATAATATTCTTCTTTTAAACAGAGGGGAGGTAGGATCCGGGGTTACAAAGGGAATTTCAGGTATACAGGTAGATCGGGGAGACCTTACTGATTATCAGTTTATATTCGACGAATCTGATGACAGATTCAAGGTAGGGGTAGAAGGGGATTTATGGCCTGTGATGTTAAGGAACAATGAATCTGATCTTAGTGATAAGTTCTTCCTGTCATGGGATGCTTCCCTTAAAAGAGCAGTAACTACGAATATTGTTCCTGAAACAGGGCTTCTCTTTTCAGGTGGAGTAAGTAATCACCCTGAATATGATATTACTGTAGCAGCAACTGGTAGTGGTAGTATTGGATTCGGTGCTTTACAAGCGAACACCCCATGGTCATGTACAATAGGATATAATTTAAATACCAGAGAGGTGCCAAGTGCTGATATTCTGGACTTTGCCACATCATTGAATGCTTACAGGTATGATAAGCCTTCCGTATTAAACATGATATATTTTGATACCTATCTTAGCCCTAACAGTATAGAGCCATACGGAACCAGTAGTATATCACTGACTACAGGATCCGGTGATAATCTTATACATACTAAAGGAGGTCAGAATTATATCATCTATGATTCTGGTAATCTGAATATAGAAGAACTAGCTACTAAGGACGACATATCAGGCTTAGGTACTGTATACTATCCTTATAGTGGCAGAGGTTATATGACTATAGGAGCAGATGGGAGACCTATATTAGCTAATTCTAATGGGATTCTTTTTAATAAGACCGGAGGAGAAAGAGTAGAAGGGATATACATGGGATCTAATAATCATCTTGTATTAGGAGGATCGTCAAATACCAATGTTCCTATAGATATGTTTAATGATCTTGGTATAACCAGAATCCTTGACAGATCTACTAATTACTCTCTTCTTGTATTCACCAATGGCGGTACTGGGGATTCACAGTATACTCATATAGGAGCCGAACTCGGAACTACAAGAATAAGATCAGGATTATTTAATCTAGTACATGATAGAGGAGGTACGTTATATACCATATTCGATTCTTATAATTTCTCAAGGGATCTCGGATCTACAAACATAAACAGTTCGTTTAATCATCTTCCGATGATGGCTGCTCAACCATCTAACAGTGATGCTACTACAGACAGAGGATACCCAATACAGAATGCAGGATCCCTTATTGTCATTCCCGGAGTATATGGGGGTTCAAGTCAAATCTATGGAACCTATAATTCTAACAGATGGTTTGTAAGAAGTGGATCACCAACACCAAATAATGAGAATGACCACACAGCTTGGAAAGAATTAGCTACTACTAGTCATTTGAGTAATTATTTACCTTTGAGTGGTGGTACTATGAGTGGGAATATAAGAATTCCTTATAATTCCTGGATAGAACAGACTCATACTTCTGGAAGTAATGCTACTTCTCCTATAAAATGGTTATCTAATGATGCTTCTACAATTATGGCCCAAATAGGTCATGCTACTATGGGAGGTCCTGATAGTAGTGGAAGTATATATATAATTCCGAGAGCTATAACTTCAACTCCGTGGGATGGAACTAACGGATTATTTATATATAAAGGTGGAGTAAAGATTGACGGAGAAGAATTAGCTAAAGTATCTCAAATTTCTTCTACATCTAATTTCTTACCATTATCTGGAGGGACTCTTACCAGAACAACAGCTGGTCCTGTATTATCCTTGAAGAATACCTCGGGTAATAAAGAAGTTTACATGGACTTTTATAAAGGAGATGTAAGATGTGGATATATAGGAGCTGCTGCTAGTAATACAGAAAATATATACTTGTATGCTTATGATTCCAGAGATATACGTATTGGAACTACTCAAGGATCAATTAGCTTTGAGACAGGAGTTAATAATCTGATTCATAAAAAGAATGGTACAAGTTATACTATTTTAGACACAGCTAATATAGCATCATTAACCATCCAATTCAACGGATCTACTAATACTACTTATGCTCCTAATGCAGCTAAAACTGTGAATATCACTCCTGCTGCTATTGGGGCAGCTGCTTCCAGTCATACCCACACTAAATCTCAGATAACAGATTTTCCGTCTTCAATGCCTGCTTCTGATGTTTATGCATGGGCAAAAGCATCAAGTAAGCCTTCTTATTCTTGGTCTGAGATAACAAGTAAACCAAGTACCTTTACTCCGTCAAGTCACACACATCCTTTATCTGATATTAGTGATCTACAAGCTTCTTGGGATGCTTTGTTAAAGGCTGTACCCTCAGCTTATGTGACTCGTTGGCCATCTTGGAGTGAAGTTACAAGTAAACCATCATTTGCTACCGTAGCTACATCCGGAAGTTATAATGATTTAAGTAACAGGCCTTCTATTCCAAGTGCTGAGACAGCTGCTACTATCATGTCGAAAATTAACTCCCAGTCTGAAATTACTTTCAGTAAACATGTAGTATGTTCAGCCGGAGCAGGTACTTCTTCCACATCTGATATCAGATTTAAGAACAATATCACCCCCCTGGCCCCTGTATTGTCACATGTTCTTGGATCACCCGGATTCTTCTATACATGGAAGGATGAGGATGAAGTACTGGTAGGGACATCGGCTCAGTATTGGGAAGGCAGGATTACAGGGCTTGTAAGGGAGATAAATGATAAGAGTAAAACCAAAACATTCTCCTATGAGAGATATACTGTTATATTACAGGAAGCTCTTAAAGAGGAACATATGCTAAGAGAAGCAGAGAAGGAAGAGTATAGGAAAGAGATTTGTTCTCTGAGAGAGGAATTAGAAGATTTGAAAAAGCTAATACAGAAACTGTTATGA

Genome Context

Genome Context

Tertiary structure

PDB ID
d47d0d05e105bcbdf28a18d8e20cce52e29d570f9abc532336d7f8f6f476d3b8
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4420
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Diverse circular DNA viruses in blood, oral, and fecal samples of captive lemurs Paietta,E.N., Kraberger,S., Lund,M.C., Custer,J.M., Vargas,K.M., Ehmke,E.E., Yoder,A.D. and Varsani,A. 2024-07-08 — GenBank