Genbank accession
CAH9016513.1 [GenBank]
Protein name
tail spike protein with colonic acid degradation activity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MTTKVNNRMIDGASLSVLDFGAVGDGLTDDSQAFQDCALECLLREKSMYIPEATYLIGQRVILPFANAQGDLSCKIIGNKARLISGVAQENVSASTHGCFVTGRYDGSALIPVTSGDEEYLTGNLAIEDLVIENFGEALRMHNAIYGSSLKNLYFNKCFNPIYLSRCFYLEQSNILMRGFVPALPSSVGYRSLSFSNSMPVSGVKVIGYERGFVLGGFDGGTIRDSTAESCDVGVDLAQESNMVTLDTMYLENNTTNIRFAAVIRRLTISGSWLFGDGTNHFSSLLGNSDYTNLTLINNRIWGGIVNTPSIRNVFGEAIQCGDAGEPTNDMSMSGLPNVVRSFKSYGFTTTTSGYNSTVRCLDNAQESNLIPASWSGGRFRNGRDSDDRSPFQSVIDNGGSLEFTTSYDFDGNSMFHYSVNVAHSVGTFKVNALIMYDNETDSYRAMQPTVGGLIESTDLVVDNNDGKVRIKLPVFTTPSLDYSIVRIV
Physico‐chemical
properties
protein length:489 AA
molecular weight: 53253,08450 Da
isoelectric point:4,78729
aromaticity:0,09611
hydropathy:-0,10123

Domains

Domains [InterPro]
IPR011050
STR
14–317
IPR011050
STR
14–305
IPR012334
STR
15–335
CAH9016513.1
1 489
Architecture
STR
RBD
STR 14-335 | RBD 336-489
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
CAH9016513.1
1 489
Domain Start End Length (AA) Confidence
N-terminal 1 31 31 0,9518
Central domain 32 352 322 0,9748
C-terminal 353 489 136 0,9297
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-31
Central
32-352
C-terminal
353-489

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage 177E37-1
[NCBI]
2963173 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAH9016513.1 [NCBI]
Genbank nucleotide accession
OX241560.1 [NCBI]
CDS location
range 46997 -> 48466
strand +
CDS
ATGACTACTAAAGTTAACAATCGAATGATTGATGGGGCTTCCCTCAGTGTTCTAGATTTTGGTGCTGTAGGTGACGGTCTTACAGATGACTCTCAGGCATTCCAAGATTGTGCTCTAGAATGCTTGCTTCGAGAAAAATCTATGTATATCCCTGAAGCTACTTATTTAATTGGTCAAAGGGTTATCCTCCCCTTTGCTAATGCACAGGGAGATCTCTCTTGTAAAATCATAGGTAACAAGGCCAGACTAATTAGCGGAGTTGCCCAAGAAAATGTGTCAGCCTCAACGCATGGATGTTTTGTTACAGGGCGTTATGACGGTTCTGCTTTAATCCCTGTCACATCTGGGGATGAAGAGTATTTGACTGGCAACTTAGCTATAGAAGATTTAGTTATAGAAAACTTCGGTGAAGCGTTAAGAATGCATAATGCTATATACGGATCTTCTTTAAAAAACCTATATTTTAACAAATGTTTCAATCCTATTTATCTAAGCCGATGCTTTTACTTAGAACAGTCTAATATCCTAATGAGAGGTTTCGTCCCAGCACTCCCTTCCTCAGTAGGGTACCGTTCTCTAAGTTTCTCAAATTCAATGCCTGTTTCAGGGGTGAAAGTGATAGGGTATGAGCGAGGGTTCGTGCTTGGAGGTTTCGATGGAGGGACAATCAGAGACTCTACTGCGGAGAGTTGTGATGTAGGCGTAGATCTTGCACAAGAATCTAACATGGTAACTTTAGATACTATGTATTTAGAGAATAATACTACTAACATACGATTTGCAGCTGTAATTAGACGTCTTACAATATCAGGGTCTTGGTTATTTGGTGACGGAACTAACCACTTCTCCTCTCTCTTGGGTAACAGTGATTACACGAATCTTACATTAATTAATAACCGTATATGGGGCGGGATCGTAAACACCCCTTCAATACGTAATGTATTTGGAGAAGCTATACAATGTGGCGATGCAGGCGAACCTACAAATGATATGTCAATGTCTGGCCTTCCAAATGTAGTGAGAAGTTTTAAGAGTTACGGGTTTACTACTACTACGTCCGGGTATAATAGCACGGTACGTTGCCTAGATAACGCTCAAGAATCAAACCTAATTCCAGCCTCATGGTCTGGTGGTAGATTTAGAAACGGAAGAGATTCCGATGACAGAAGCCCTTTCCAGTCTGTTATAGATAATGGGGGTAGCCTTGAGTTTACAACTTCATACGATTTCGATGGTAACTCTATGTTCCATTATAGTGTCAATGTAGCTCATTCAGTTGGAACATTTAAAGTCAATGCTTTAATCATGTATGACAATGAGACAGATTCGTATAGAGCAATGCAACCAACTGTAGGAGGTCTTATTGAAAGTACAGACTTGGTTGTAGACAATAACGATGGGAAAGTTCGGATTAAACTCCCTGTATTTACAACTCCAAGCTTAGACTATTCAATAGTTAGAATAGTTTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
f0cff9e492bb34a9714044b96508c043ac93917c6b4601a17753518f4e7aa3a9
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7086
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50