Genbank accession
QIG70379.1 [GenBank]
Protein name
tail spike protein with colonic acid degradation activity
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,88
TSP
Evidence RBPdetect2
Probability 0,92
Protein sequence
MTYVSVKQLGGVISVATLETGDVVSTPAEIDNTRAIVFNQLEDNNAVCTLAAPQTSATPKLIHLTNNGDFPVTVQGVTLQPGPTYGIWWNGSAYSQIAVEGVGIVSNTQDSPSVHIGGDGSIIDPLTADVKLSAVLNNGLEIRSDGLYFQNVQIAPDRFVVVDTAAGSDTYAGTLTAPFKTIGKAIQTVLNQGLILVVGGTYTEALQLPAGKRFLVEGIGGANDSNIVSINGIIRNDAGAAGIRFKNLTLNSPAGQGPAVEFVDAAGGMMFDNVSITSDLTNDQASVVHFSGGNSSWYVFNEGSIKGGLKVEGDNNAPVISLLHGNEKTALYVDDVDATVQVSYQSYLGDITHLNGNLFLKSIATIGNIASSANSPNLLGIHDSSLFDLDTGGWKTLTKTGTAPYTLDLKRAATNNSFSGTPLFGSNASDIHGNYSPVAYTATNDSVAGHLEGIDDALASVGGGLSAVTSTDSATVDFSGAGTGAQPLTAAVKVSSNAGNVLQAESDGLFVAAADVGLTAVSHSNTDTTDITGDGTPSDPLQVEVSVSATAHNLLIKETDGLFVIEPSPLFETVINIPYMWGAGEMIYSYKASREYTLAQGLTGWQRDVVWLDDPDSPDPENPDPLVYPYTITIKKKNSLNVVTTIGTIDWNTGVTFPAAVQFTIGDVLYLEVNNEARFKSFALTILAQRPYTN
Physico‐chemical
properties
protein length:694 AA
molecular weight: 72577,83170 Da
isoelectric point:4,35508
aromaticity:0,07493
hydropathy:0,02522

Domains

Domains [InterPro]
DC_0915
ATT
2–340
IPR012334
STR
161–396
IPR011459
Unmapped
166–206
IPR011050
STR
176–278
QIG70379.1
1 694
Architecture
ATT
ATT 2-694
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QIG70379.1
1 694
Domain Start End Length (AA) Confidence
N-terminal 1 211 211 0,9575
Central domain 212 419 209 0,8886
C-terminal 420 694 274 0,5578
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-211
Central
212-419
C-terminal
420-694

Taxonomy

  Name Taxonomy ID Lineage
Phage Rhizobium phage RHph_N28_1
[NCBI]
2509583 No lineage information
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QIG70379.1 [NCBI]
Genbank nucleotide accession
MN988515.1 [NCBI]
CDS location
range 184568 -> 186652
strand +
CDS
ATGACTTACGTCTCTGTAAAACAGCTTGGCGGTGTGATCAGTGTCGCAACTCTCGAAACCGGAGACGTGGTTTCCACGCCCGCCGAGATCGACAACACCCGCGCAATTGTCTTTAACCAACTTGAAGACAACAATGCAGTCTGCACATTGGCCGCTCCGCAGACGAGTGCTACGCCGAAGCTCATCCATCTTACCAACAATGGCGACTTCCCGGTAACTGTGCAGGGCGTCACGCTCCAACCGGGACCGACGTACGGCATTTGGTGGAATGGCTCTGCGTATTCGCAGATTGCGGTCGAAGGCGTTGGTATTGTTTCCAACACTCAAGACAGTCCGTCCGTTCACATCGGCGGCGATGGTTCGATCATCGATCCTCTTACCGCCGATGTGAAGCTTTCGGCAGTGCTGAATAACGGTCTGGAAATCCGTTCCGATGGTTTGTATTTCCAGAACGTCCAGATCGCGCCTGATCGTTTCGTTGTGGTTGACACCGCTGCCGGTTCTGACACGTATGCCGGTACTCTTACCGCGCCGTTCAAGACCATCGGCAAGGCCATTCAAACGGTTCTCAACCAAGGCTTGATCTTGGTAGTAGGCGGCACGTACACCGAAGCGCTTCAACTTCCGGCTGGTAAGCGCTTCCTCGTGGAAGGCATTGGCGGCGCGAACGATAGCAACATCGTTTCGATCAACGGCATCATCCGCAACGATGCGGGCGCTGCTGGTATCCGCTTCAAGAACCTGACTCTCAATTCTCCTGCCGGTCAAGGTCCAGCGGTCGAGTTTGTCGATGCTGCCGGTGGCATGATGTTCGACAACGTATCGATCACTTCCGATCTTACCAACGATCAGGCAAGTGTTGTGCACTTTTCCGGCGGCAACTCGTCGTGGTATGTGTTCAACGAAGGCTCGATCAAGGGCGGGCTCAAGGTAGAAGGCGACAACAACGCGCCGGTAATCAGCCTGTTGCACGGCAACGAAAAGACGGCGCTGTACGTCGATGACGTTGACGCCACGGTGCAGGTTTCCTACCAGTCGTATCTCGGTGATATCACGCACTTGAACGGCAATCTCTTCCTCAAGAGCATTGCTACGATTGGTAATATCGCATCGAGCGCCAACTCGCCGAACCTGCTCGGCATTCACGACTCGTCGCTGTTCGATCTCGATACGGGCGGTTGGAAGACGCTGACGAAAACCGGCACGGCTCCCTACACGCTCGATCTGAAACGCGCAGCTACCAACAACTCGTTTAGCGGTACGCCGCTGTTCGGCTCGAATGCGTCCGATATCCACGGCAATTATTCGCCGGTTGCTTACACAGCTACCAACGATTCAGTCGCCGGTCATTTGGAAGGCATTGACGATGCTCTGGCGAGCGTTGGTGGCGGTCTATCGGCTGTTACCTCGACAGATAGCGCCACGGTTGACTTCTCCGGTGCCGGTACGGGCGCACAGCCTCTTACCGCCGCCGTCAAGGTGTCGTCCAATGCAGGCAACGTTCTGCAAGCGGAAAGTGATGGTCTGTTCGTTGCGGCTGCTGACGTAGGTCTTACCGCCGTCTCGCATTCAAACACCGACACGACTGACATTACCGGCGACGGTACGCCGTCTGATCCGCTGCAAGTTGAAGTGTCGGTTTCCGCGACGGCGCATAACCTTCTTATCAAAGAAACGGATGGTCTGTTCGTTATCGAACCGTCGCCGTTGTTTGAGACGGTCATCAACATCCCCTACATGTGGGGCGCTGGCGAGATGATCTACTCCTACAAGGCTTCGCGAGAATATACCCTTGCGCAAGGTTTGACAGGTTGGCAAAGAGACGTTGTTTGGTTGGATGATCCGGATTCTCCGGACCCTGAAAACCCTGATCCGTTGGTTTACCCGTACACCATCACGATCAAGAAAAAGAACTCGCTCAACGTTGTTACCACCATCGGAACAATCGACTGGAACACTGGCGTTACTTTCCCTGCCGCTGTCCAGTTCACCATTGGCGACGTGCTGTATCTGGAAGTCAACAATGAAGCGCGGTTCAAGTCCTTCGCTCTTACCATTCTGGCGCAGCGACCGTACACCAACTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
cc174c7b0a0a1a0438b0ec130b92ac95aa1f85cbe9a9f8a0aa3b185dbb7a5c84
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6802
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Patterns of diversity and host range of bacteriophage communities associated with bean-nodulatin bacteria Vann Cauwenberghe,J., Santamaria,R.I., Bustos,P., Juarez,S. and Gonzalez,V. 1998-01 — GenBank