Genbank accession
XAG95850.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,90
Protein sequence
MSFFAGRIGTKTVLSLNSASGGDINVHLNPNTNTIFHSDMPYVIIQEQYSANLGAVGSDYYVCDMPAAVANYVSNTSRILIPMLTVNYGGVEYNTILGGGSMSLGNCTAGGTELNLGTTMATAECGAQLRNIWGFSNDVVWDTGYYTKSSSLSDVLSIGQGTGRSIDIMSASLYYAATYSTGGGGIGIPPIPDLDQSYLYLASGAIYSGRIPSVDQDGRLRWADEDRQYNTKIGSVTRTIAINSHFQTPTGRSLGHSKFYVRRGIAALVKAWRVRYNQGAGTGETLVQRYTNSFYAQSGDRIDEVWQRTSFHSNTSTVIAPDTTGTYLNVDYKASLYNMVTPVRMTWFVTNVTYNESAGTYSASNPFTVNNDIRLSPSDFIIKGVNLGTTAWSFLMQLSAGALYNANGRVVMGANGSRSTAKNGSSAAAIPIPYMSGTTERFIGGDTTDGWQLHKLALYQFNRNRQWKVDTRSNSISNAEGDVWSPGVNPLKIFAGNSSVVNVGGNTLNSNTGEVLLTTVNLGMNTNVRAGSVICSVQLRDATVFTSGGYGSFVICSPRPGNPESLGLSASTSRMRTSGGIGAVHHHLFCTLPVGRFVPVYAIRTAGYNFVLTPSFQPLWFTPSNVQMSNRTLECSFIIYLKNEGNGNVGIYCGTGRNADAAAMGNFSFILPNLRISVQRLT
Physico‐chemical
properties
protein length:682 AA
molecular weight: 73380,43950 Da
isoelectric point:8,91206
aromaticity:0,10117
hydropathy:-0,11481

Domains

Domains [InterPro]
IPR059609
RBD
1–682
XAG95850.1
1 682
Architecture
RBD
RBD 1-682
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
XAG95850.1
1 682
Domain Start End Length (AA) Confidence
N-terminal 1 45 45 0,0023
Central domain 46 244 200 0,1558
C-terminal 245 682 437 0,9387
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-45
Central
46-244
C-terminal
245-682

Taxonomy

  Name Taxonomy ID Lineage
Phage Kononvirus KKP3711
[NCBI]
3430219 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Enterobacter sp.
[NCBI]
42895 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XAG95850.1 [NCBI]
Genbank nucleotide accession
PP579741 [NCBI]
CDS location
range 39021 -> 41069
strand +
CDS
ATGAGCTTTTTTGCAGGAAGAATTGGTACAAAAACAGTTCTATCCCTCAACAGTGCCAGTGGAGGCGATATAAATGTCCATCTTAACCCTAATACCAATACTATTTTCCATAGTGATATGCCATATGTCATAATCCAAGAACAATATTCCGCTAATCTTGGCGCCGTAGGTTCTGACTATTATGTGTGTGATATGCCAGCTGCGGTAGCAAACTATGTAAGTAACACTAGCAGAATATTGATTCCTATGTTAACTGTTAATTATGGTGGCGTGGAATATAATACTATTCTAGGTGGCGGCTCTATGTCTCTAGGTAACTGTACTGCGGGAGGTACCGAACTAAACCTAGGTACGACAATGGCAACTGCTGAGTGCGGCGCTCAGCTACGTAATATTTGGGGTTTTTCAAACGACGTTGTTTGGGATACAGGTTACTATACTAAAAGTAGTAGTTTATCTGATGTATTAAGTATTGGTCAAGGTACTGGTAGAAGTATTGATATAATGAGTGCTAGTCTTTATTACGCTGCTACTTACAGTACAGGCGGAGGTGGTATAGGTATTCCTCCAATTCCAGATTTAGATCAGTCATACCTATATTTAGCTAGTGGTGCTATCTACAGTGGTAGAATTCCTTCCGTGGACCAAGATGGTAGACTTAGATGGGCTGATGAAGATAGACAATATAATACAAAGATAGGTTCTGTTACTCGTACTATTGCTATTAATAGCCACTTCCAAACTCCAACAGGTAGAAGCTTAGGTCATTCTAAATTCTATGTTCGCAGAGGTATTGCTGCTCTAGTAAAAGCTTGGCGTGTTAGGTATAACCAAGGAGCAGGTACAGGAGAAACTTTAGTACAAAGATACACTAATAGTTTTTATGCTCAGTCTGGTGATCGTATAGATGAAGTATGGCAGCGTACTAGTTTCCATTCTAATACCAGTACTGTTATCGCTCCAGATACTACAGGTACTTATCTAAACGTAGATTATAAAGCTAGCCTGTATAATATGGTAACGCCTGTCAGAATGACTTGGTTTGTAACTAATGTTACATATAATGAGTCAGCAGGTACTTATTCTGCTAGTAATCCCTTTACTGTAAATAATGACATTAGATTGTCTCCTTCTGATTTTATTATTAAAGGTGTTAATTTAGGAACTACTGCATGGAGTTTCTTAATGCAACTTTCTGCTGGTGCCCTTTATAACGCTAATGGCCGTGTTGTGATGGGAGCTAATGGTAGTAGAAGTACTGCCAAGAATGGTAGTTCAGCAGCAGCTATTCCTATTCCTTACATGTCTGGGACTACCGAAAGATTTATAGGCGGAGATACTACGGATGGTTGGCAGTTACATAAATTAGCATTGTATCAATTCAATAGAAATAGACAATGGAAAGTAGATACTAGATCTAATTCAATTAGTAATGCAGAAGGTGATGTATGGAGTCCCGGAGTTAATCCATTAAAAATATTTGCTGGTAATAGTTCGGTGGTTAACGTAGGAGGTAATACATTAAACTCCAATACAGGGGAAGTATTATTGACTACCGTTAACTTAGGTATGAATACTAATGTACGAGCAGGTTCGGTAATTTGTTCCGTTCAGCTAAGGGATGCCACAGTATTTACATCTGGGGGCTATGGGTCTTTTGTAATATGTTCTCCTAGACCAGGAAATCCAGAATCTTTGGGACTATCTGCTAGTACTTCTAGAATGAGGACTTCGGGAGGTATTGGTGCAGTACACCATCATTTGTTCTGTACACTTCCTGTTGGTAGATTTGTGCCTGTTTATGCTATAAGAACCGCTGGATATAACTTTGTGTTAACTCCGTCTTTCCAGCCGCTATGGTTTACCCCTAGTAATGTTCAAATGAGTAATAGAACTCTAGAATGTTCTTTCATAATTTATTTGAAAAATGAAGGTAATGGTAACGTAGGTATTTATTGTGGTACTGGTCGTAACGCAGATGCCGCGGCTATGGGTAACTTCTCTTTCATTTTACCAAACTTACGTATTTCTGTACAGCGTCTCACTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
2dd0a7a08c4ea1887af17c5e2d837518d1d13b037acd8f9d4b79c7e7154b93ab
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,2737
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50