Genbank accession
CAM0044458.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,59
Protein sequence
MAAAIGAAVVAVGGWGTVATVALTVASMAYSYSVAKKAKNASSGDPAERKQILRSSSAPKNYIYGQVRSSGVLVFAQEEEGDQTDNEWVHLALTHAGHQIEWAGDVYLNDETSANFPDHCEIANYPAGRTTADPYMVSKCKDWSDTMIGKDFAWMRISLKFSQEKFPSGLPNINSLKKGFKVPNLETGAVEWSDNPALCILHFLRLKGWEDEYLILDTFKEAARICAEEVANDDGTSSKRYAIGCEFDDSDTPASVLDKMLSTCGGEWVRVGGRLGLRVAAYYGPAFIDINEDDIIDGIEIQPEVERSDSFNIVRGTFVSPEQNYTEIDYPEVRIAEWVADDQEEIIMDMDLNYVQNPWQAQRLADIALKRARLGMTLKLPCNMRAFQATPGTMINLSLSTIGFNKEEFMVVDWDFSIDGGVNLIVRRDLPEFYDDAVGRPIATPPIIDLPVGGVPAPTNPLYTAKPVGDIVQGVVSWTNTAFQLSHTNVIVKDSNGFIIQSAQIPFPGNDMELNGKLAGSYEIELQSFGVNGRASTITQMDIVISAPTTPDTVASKASNWSIHLIPSYVLGTTPFGTLFEFYVSTTNDPTPPDRKPDEVASSWNQGGLTPDTYYYYWIRAVNSYGKSGWVQKTARTTRETGLVETLVEKLVGIEIYASYIASDQTSDPAFLLDGRPDHGNGLIKGGKLVGSSMTSDNYVAGSAGFKFDRTSAEINSNVNIKAANIQGELTAATVRANKIIGNLTSSKSITSSVRITASTGQGSWQTLASYSVSSSVVGLPRTLYFLGAYCSSNPGGISPSSGEFRVLVNGSVVASGQITLGSPFNIGSHGKYIGTSAASLVVQVRRMGNADGDFVIDFPSQTCVCISSVTGGEFN
Physico‐chemical
properties
protein length:876 AA
molecular weight: 94761,24860 Da
isoelectric point:4,80968
aromaticity:0,09247
hydropathy:-0,14669

Domains

Domains [InterPro]
DC_0187
STR
1–852
IPR003961
STR
547–641
IPR057587
ATT
550–641
IPR013783
STR
574–637
IPR036116
STR
601–640
IPR003961
STR
608–638
CAM0044458.1
1 876
Architecture
STR
ATT
STR
STR 1-549 | ATT 550-641 | STR 642-852 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
CAM0044458.1
1 876
Domain Start End Length (AA) Confidence
N-terminal 1 105 105 0,8272
Central domain 106 304 200 0,2001
C-terminal 305 876 571 0,2615
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-105
Central
106-304
C-terminal
305-876

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage K396
[NCBI]
3105676 Viruses >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAM0044458.1 [NCBI]
Genbank nucleotide accession
OZ196344.1 [NCBI]
CDS location
range 22248 -> 24878
strand +
CDS
ATGGCTGCTGCTATTGGTGCCGCTGTTGTTGCGGTTGGTGGTTGGGGTACGGTTGCTACGGTTGCATTAACTGTTGCGTCGATGGCTTATTCGTATTCTGTTGCTAAGAAGGCAAAGAATGCATCAAGCGGCGACCCTGCCGAAAGAAAACAAATCCTGCGTTCAAGCTCTGCGCCTAAAAACTACATCTACGGTCAAGTTCGCTCGTCCGGTGTTCTTGTGTTCGCGCAAGAGGAAGAAGGCGATCAAACAGATAACGAATGGGTACACTTGGCGCTTACTCACGCTGGACACCAAATTGAATGGGCTGGCGATGTTTATCTAAATGACGAGACAAGCGCTAACTTTCCAGATCACTGCGAAATCGCTAACTACCCTGCAGGTCGTACAACTGCAGATCCGTACATGGTTAGCAAGTGCAAGGACTGGTCCGATACGATGATTGGTAAAGACTTTGCATGGATGCGTATTTCTCTGAAATTTAGTCAGGAGAAATTCCCGTCAGGTTTGCCGAACATCAACTCACTAAAGAAAGGGTTTAAGGTTCCAAACCTTGAGACTGGTGCGGTTGAATGGTCAGATAATCCAGCGCTTTGCATTCTCCACTTCTTGAGACTAAAGGGTTGGGAGGATGAATACCTGATTCTTGATACATTCAAGGAAGCAGCTCGCATCTGTGCAGAGGAAGTTGCCAATGATGACGGCACATCAAGTAAACGTTATGCGATCGGTTGTGAGTTTGACGACTCAGACACTCCAGCATCAGTACTAGATAAGATGCTGTCCACTTGTGGTGGTGAGTGGGTTCGCGTTGGTGGCCGACTTGGTTTGCGCGTTGCGGCGTACTATGGACCAGCGTTTATCGATATCAATGAAGACGACATCATTGACGGCATAGAGATTCAGCCAGAAGTTGAGCGCTCTGATTCATTCAATATTGTTCGCGGTACGTTCGTATCTCCAGAGCAGAACTATACAGAAATTGATTACCCTGAAGTGAGAATCGCAGAGTGGGTTGCTGATGACCAAGAAGAAATCATCATGGATATGGATCTTAACTATGTTCAGAACCCATGGCAGGCTCAGCGACTTGCGGATATAGCTCTAAAGCGTGCGCGATTAGGTATGACATTAAAGTTACCATGTAACATGCGAGCATTTCAAGCAACTCCAGGAACAATGATAAACCTTTCTCTATCAACCATCGGTTTCAATAAAGAAGAGTTCATGGTTGTAGATTGGGACTTCTCAATCGATGGTGGCGTTAACCTTATTGTTCGTCGCGATCTGCCGGAGTTCTATGATGATGCGGTAGGGCGACCAATTGCAACACCACCAATTATCGACTTGCCAGTTGGTGGAGTGCCAGCTCCAACCAATCCGCTATACACCGCAAAACCTGTAGGTGATATTGTTCAGGGTGTTGTTAGCTGGACTAATACGGCGTTTCAACTTTCACACACCAATGTGATAGTGAAAGATTCAAATGGGTTTATAATTCAGTCGGCGCAGATACCATTCCCAGGTAATGACATGGAACTTAACGGCAAGCTTGCTGGTTCGTATGAAATTGAGTTGCAGTCATTTGGCGTAAACGGTCGAGCATCAACCATTACGCAAATGGACATCGTAATTAGCGCACCAACAACGCCGGACACGGTAGCGAGCAAGGCGTCTAACTGGTCAATTCACTTGATACCATCATATGTGCTTGGCACAACACCTTTTGGTACTTTGTTTGAGTTTTACGTTAGCACAACTAACGATCCAACTCCGCCAGATAGAAAACCCGATGAAGTGGCGAGTTCATGGAACCAGGGTGGATTAACACCGGATACGTACTACTACTACTGGATTCGAGCCGTCAACTCTTACGGAAAGTCTGGATGGGTGCAGAAAACAGCAAGGACAACTCGCGAGACTGGACTTGTTGAGACTTTGGTTGAAAAACTTGTTGGTATCGAGATTTACGCGTCATATATTGCAAGCGATCAAACTAGCGACCCTGCGTTCCTGTTGGACGGCAGACCTGACCACGGAAACGGATTGATTAAAGGTGGTAAATTGGTTGGCTCATCAATGACCAGTGATAACTACGTTGCTGGCTCGGCTGGTTTTAAGTTTGATAGAACCAGCGCCGAGATAAATTCCAACGTAAACATTAAGGCTGCGAACATACAAGGTGAACTTACTGCAGCTACGGTTAGGGCGAACAAGATAATCGGCAACCTTACCTCATCTAAATCAATAACATCATCAGTTAGAATAACAGCGTCAACAGGTCAGGGCTCATGGCAAACCCTTGCAAGTTACAGTGTTTCATCATCCGTAGTTGGCTTACCAAGGACTTTATACTTCTTGGGTGCGTATTGCTCGTCAAATCCTGGTGGAATATCTCCATCCAGTGGCGAGTTTAGGGTGCTAGTTAACGGCTCTGTTGTTGCGTCAGGTCAAATAACTCTTGGTAGTCCGTTTAATATTGGCTCCCATGGTAAATACATAGGGACATCCGCAGCCTCTCTAGTCGTGCAAGTTCGACGGATGGGGAACGCTGACGGTGATTTTGTTATAGATTTTCCAAGCCAAACTTGCGTCTGCATATCAAGCGTAACCGGTGGTGAGTTCAACTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
ac58bcb77e0a504fafd5b865e742d43921337ee242cbbcd2e34aa8b4a28dfcac
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7508
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50