Genbank accession
XFC50027.1 [GenBank]
Protein name
colanic acid degradation protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,89
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MSDTSLKITQLPRNNKPNENTLIPLTDQSSIITGASTLNTLRQSINFENAFDSIEEGIANTISNEPFFVFEDINKNSVLGYMNQGGTTFSAILDTEGNQIKYPSARGVSAVVKKVTDGVNYLTPEMYINNPSYSDIEDALNQLFVDAKLKQLKVIGSKTYVLSNPSKGLTMDGIVFVGGSIKGAGTNNIYISKSNVEGVSFEGVCVRHYGGGVDLSFCDFINSAATTAISLRNNPLPGSITIRNCHFENNNYCILADGTTGKPFSNITIQNNTFKNNAGDPIELNLIQSYQPGFVLIDGNFIDGVRGVNSAWGIGIGVAGAGNYALESDDADLAANVIVTNNLVINCRQCIHFEKSRAFEITNNFVYPDASFSPNAGLSAAGVVLYGCRDFSINGLVSKPVQGTEDGLALRWGVVSGAYSSPCRNYNLRNIITTGNCTIYNGANDSVDSNVLVENVSSKNFTFKGYFTTAKLSNINARGTDHAIQVSHTTGEGVGILRRLRSITLILDNVKLLSLSNTPIGTVNNLYVDNLSVTNCNFDAIKMAENSYSRGNLTQSINEVKYIDNVTSIPVGQEFSAGTLIILTATGAQYLITRSGSIAPSSTDSIRATIAGQKYIESNSLNWSSALGAKTAGLRLTIPGAGTDGAALNTTVLRSGYAGGGYYRVEITDPIVTPTTTGTVISPTVVATYVLVTDKVISSGFNSVSAINAYIAGGGKTLNFDRDITATSSLTVGSNTKITFGNGVTINADNTAREGISIKGSAPTSFVNLAVNALAKDVSITLNDSSFNVGDWLEIRSEKLLPGPNNYQVKQSVLRKITAKTASGSNTVYRLHTGLLFDFNTSDTAKAGKATVLENIVIDGANLNKDGFTNTFALGINCAYVYNLTLKNITIRGTKDKSSLDDVAGRSAVKLFNCSNVTVDNLTVDSIGWYGVEIIGCSENVDVNKLYSTDSRHAVSFNWLATGDLYGGPLFSQIRNSVSHNARLSGFDTHDLGLGITFDSCQSFSSGDDGFQIRAINATLINCYAFGATLDGFGGALGATNTRLIDCKAEGNTRYGVNFGYEGGYLENCHIINNGFIGVAINSGKISGGSITGNNPVAIDLAAGFNAVYNDLKIENVHMPSSGSQNKIIRFKGDANIANKPELVTIENCNVIGYGRDWAALTGFTVQPLSCITRGNRLSANSTDGSKISGVATLTAGTVTVNTTEVFSQLSTSANIMRYNSQIILRPLTFATNVNSLYISAIANGTSFTVKSNNASDGSAFSWEILL
Physico‐chemical
properties
protein length:1267 AA
molecular weight: 134649,15080 Da
isoelectric point:5,74429
aromaticity:0,08129
hydropathy:-0,03757

Domains

Domains [InterPro]
IPR011050
STR
156–396
IPR011050
STR
335–548
XFC50027.1
1 1267
Architecture
ATT
STR
RBD
STR
ATT
STR
ATT 2-162 | STR 163-548 | RBD 549-681 | STR 682-696 | ATT 697-765 | STR 766-1267
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
XFC50027.1
1 1267
Domain Start End Length (AA) Confidence
N-terminal 1 134 134 0,9828
Central domain 135 671 538 0,9738
C-terminal 672 1267 595 0,1565
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-134
Central
135-671
C-terminal
672-1267

Taxonomy

  Name Taxonomy ID Lineage
Phage Klebsiella phage vB_kp_MJ359
[NCBI]
3279183 Viruses >
Host Klebsiella pneumoniae
[NCBI]
573 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XFC50027.1 [NCBI]
Genbank nucleotide accession
PQ182779.1 [NCBI]
CDS location
range 203205 -> 207008
strand -
CDS
ATGAGTGATACATCTTTAAAAATAACTCAACTTCCAAGAAACAATAAACCGAACGAGAATACACTTATCCCTCTAACTGATCAAAGTTCAATCATCACCGGTGCGAGTACCTTAAACACTTTGAGGCAAAGTATTAATTTTGAAAATGCTTTCGATAGCATAGAGGAAGGTATAGCTAACACGATTTCTAATGAGCCATTCTTTGTTTTCGAAGATATAAACAAGAATTCTGTTCTTGGTTACATGAATCAAGGAGGAACAACTTTTAGCGCGATACTTGATACCGAAGGAAATCAAATAAAATATCCTTCCGCCAGGGGAGTTTCAGCTGTAGTAAAAAAAGTAACGGATGGGGTTAACTATCTTACACCGGAAATGTATATAAACAACCCCTCATACTCTGACATTGAAGATGCCCTTAATCAATTGTTTGTTGATGCAAAGTTAAAACAATTAAAAGTAATTGGTTCGAAGACATACGTTTTAAGTAACCCGTCCAAAGGACTAACAATGGACGGTATTGTTTTTGTTGGCGGCTCAATTAAAGGTGCGGGAACTAACAACATATACATTTCCAAATCTAACGTAGAAGGCGTTTCATTCGAAGGGGTCTGTGTTCGCCATTATGGCGGTGGTGTTGATTTATCTTTCTGCGATTTTATAAATAGCGCAGCTACAACTGCAATATCCTTACGTAATAACCCCTTACCTGGATCCATTACGATAAGAAACTGTCATTTTGAAAATAACAATTATTGTATTTTGGCTGACGGGACAACAGGGAAACCTTTTAGTAACATCACTATTCAAAATAACACATTCAAAAATAATGCAGGCGATCCTATTGAACTTAACCTTATTCAAAGCTATCAGCCCGGATTTGTTCTAATTGACGGTAACTTTATTGATGGGGTAAGAGGGGTAAATTCGGCGTGGGGAATAGGGATAGGTGTGGCAGGCGCTGGAAACTACGCATTAGAATCGGATGATGCAGATTTGGCGGCGAATGTCATTGTTACGAATAACCTTGTAATAAATTGTCGGCAATGTATTCATTTTGAAAAATCACGGGCGTTTGAAATAACAAATAACTTTGTCTACCCGGATGCATCATTTTCACCCAATGCAGGTTTATCCGCTGCGGGAGTAGTTCTATACGGTTGTCGAGATTTTAGCATCAACGGCCTGGTCTCTAAACCAGTTCAAGGTACCGAAGATGGCTTGGCCTTGCGCTGGGGCGTTGTCTCCGGGGCATATAGTTCACCATGTCGGAATTATAATCTTCGTAATATCATCACGACTGGTAACTGTACCATTTATAACGGTGCCAACGATAGTGTTGACAGTAATGTTCTAGTAGAAAATGTCTCGTCTAAAAACTTTACTTTCAAAGGGTACTTTACTACAGCCAAATTAAGTAACATTAATGCTCGGGGTACGGATCACGCTATTCAAGTATCGCACACCACTGGAGAGGGTGTAGGGATTCTTAGGCGTTTAAGATCGATTACCCTGATTCTAGATAATGTTAAACTTCTTTCGTTATCAAACACGCCCATCGGGACAGTAAATAATCTGTACGTTGATAATCTTAGTGTAACTAACTGCAATTTTGACGCCATCAAAATGGCCGAGAATAGCTACAGTAGGGGGAATTTAACCCAATCGATTAATGAAGTTAAATACATTGACAACGTTACTTCGATACCCGTTGGGCAGGAATTTTCTGCCGGTACCCTGATAATCTTAACTGCAACTGGTGCACAATATCTCATTACTAGAAGCGGATCCATTGCACCTAGTAGTACGGATAGTATCAGAGCTACTATTGCTGGTCAGAAATACATTGAAAGTAACAGTTTAAATTGGTCCAGTGCCCTCGGCGCTAAAACGGCCGGACTTCGTTTAACGATCCCTGGCGCCGGTACCGATGGGGCCGCATTAAATACCACTGTACTTCGTAGTGGTTATGCAGGTGGCGGCTATTACCGTGTTGAGATAACCGATCCAATAGTCACGCCGACGACGACAGGTACAGTTATTTCTCCGACCGTTGTGGCAACTTATGTCTTGGTAACTGATAAGGTTATCTCGAGCGGATTCAACTCGGTTAGTGCTATCAACGCGTATATCGCCGGTGGTGGTAAAACTTTAAATTTTGATAGGGATATTACGGCAACTTCGTCACTTACAGTGGGGAGTAATACAAAAATAACATTTGGTAATGGAGTAACAATCAATGCCGATAACACAGCAAGAGAAGGGATTTCAATCAAAGGTTCGGCCCCGACTTCTTTTGTTAACCTCGCTGTCAATGCATTAGCCAAAGATGTTTCCATTACCTTAAACGACTCATCTTTCAACGTTGGAGATTGGTTAGAGATACGGTCTGAAAAACTTCTTCCTGGTCCAAATAACTACCAGGTTAAGCAATCAGTCTTACGTAAGATAACCGCAAAAACAGCCTCTGGTTCAAATACGGTCTACCGTCTCCACACTGGTCTGTTATTCGACTTTAATACCTCAGATACAGCGAAAGCGGGGAAAGCAACAGTTCTTGAAAACATTGTCATCGATGGCGCGAACCTTAACAAGGACGGGTTTACGAATACCTTTGCGCTCGGTATTAACTGCGCGTATGTTTATAATTTGACACTCAAGAATATCACTATCCGCGGTACTAAGGATAAATCTTCACTCGATGATGTAGCGGGAAGATCCGCAGTTAAGCTATTTAATTGCAGTAATGTTACTGTGGATAATTTAACGGTGGACTCTATAGGCTGGTACGGCGTTGAAATTATTGGTTGTTCGGAAAACGTAGACGTCAATAAACTTTATTCGACAGATTCACGTCATGCCGTTTCGTTTAACTGGTTAGCTACAGGTGACCTTTATGGCGGACCGCTGTTCTCCCAAATAAGAAACTCTGTTTCACACAACGCACGTCTCTCTGGGTTCGATACCCATGATCTTGGTTTAGGTATTACGTTTGATAGCTGCCAGTCTTTCTCTTCCGGTGACGATGGATTCCAGATAAGAGCGATTAATGCAACACTGATTAACTGCTATGCTTTTGGTGCAACATTGGATGGATTTGGCGGTGCTTTAGGGGCTACTAACACCAGATTGATAGATTGTAAGGCGGAGGGAAACACTCGTTACGGGGTTAACTTCGGGTATGAAGGAGGATACCTTGAGAACTGCCATATCATCAACAATGGTTTTATCGGGGTTGCAATTAATTCGGGTAAAATTTCTGGGGGGTCCATTACCGGCAATAACCCTGTCGCCATTGATTTGGCCGCTGGGTTTAATGCTGTCTATAATGACCTGAAAATAGAGAACGTACATATGCCTTCCTCTGGTTCCCAGAATAAAATTATTCGTTTCAAAGGCGACGCGAATATAGCCAATAAACCAGAGTTGGTGACCATTGAAAATTGTAACGTCATTGGTTACGGTAGAGACTGGGCTGCGCTGACAGGGTTTACGGTTCAGCCGTTATCGTGTATCACGCGTGGTAATAGGTTGAGTGCGAATAGCACTGATGGGTCTAAAATATCAGGGGTTGCTACGCTGACCGCAGGTACCGTGACGGTTAACACCACTGAAGTTTTTAGTCAGTTGAGTACTTCCGCAAATATAATGCGATACAATTCACAAATCATTTTACGTCCATTAACTTTCGCCACTAACGTTAATAGTTTATATATCAGTGCGATCGCTAACGGTACATCATTCACTGTAAAAAGTAATAATGCTTCCGATGGTAGCGCATTCTCTTGGGAAATTTTGCTGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
a1b237b76da33f67455aef535a76f1b3b8c87e52e95671e866600e2e32a145ea
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7231
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50