UniProt accession
A0A2S1PGM7 [UniProt]
Protein name
Long tail fiber protein Gp37
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,84
TF
Evidence RBPdetect2
Probability 0,79
Protein sequence
MADLKVGTTVGGSPVWHQGNLALVPSGNAILYKGARIYSENDKPSANELQVVSRAGDTMSGALNIETSTDYPLALKSSVSGPAYIRFSKGNTLQSYVGTDAAGDFKVAMTDVNGSWAFDGLKIAKSNGDVSLKGALVSANTGNFDIKYGSVQFIRANSSKNVYIGAPGGTDLVLGYAQDGMTTTKIRFDSAVYNKTGGLLISDTGLIQRSAMDNPYYNQTEADARFIRLNTNTATTGYLLSRSSDMGTPHNLSMGYAGFFRHNGLSGFRDLTINVSTPSSSNGAHARGITFDYGSIGYGMYTYAYDSAGTKLANQKIYTEADKPTPAEIGALAAGANAVSASKLQTARTISLTGGATGSVSFDGSANVSLAVTVTNDSHTHSDYVKKIGDIMSGNLAVPKVLLSAAQGAEANSVARRDFVESTVTASGKGVKDLTIALPAGAPTSGYIPVLFKTYGTSNSFVFIDTLTGHESHPMNNCSFTGNVRASGWGDGGSYAVGQFTIYSTSERAIHSIHGPSEAVDGFVVYVETRAFPIRVRVDIETAVTAYATDVTYGTSIFAVNGQVSGNTKTIVLANFDKGSGTYNGSNRVYDNGYNPTPEAVGALPVNGNAVTASRLQTARLIAGVPFDGTSNISISATNVGAVAKAGDAMTGGLTFVDAACELGWVFNSDYAKIGFKNASGDDTDSYMWFKTGDNGNEYFKWQSVNGANTTDWMSLKPTGLVVAAGVTAPTFTGALAGNAATATKLATARQINGTNFDGSGNITTANWGTARTLTIGNAAKSVNGAGDVSWSLSEIGALPVAGGTVSGMLGVTGILDLVGSSADDMADIVWRAPDGTERGRLWIGGTIGADNSLTWRSGASGATYKIYHEGNKPTASDVGALSIAGGEMGGVVAFRGSANLLNVTDGAKIRYFNGNSAWFHTSVNAAGEFEVSTGGVGETSIATIDYSGKIRTSNQGVLYGDRSKPTASDVGAAPAGFGLGEYGRVIGSVLGDTPLRRQSGFFQGSNIAGIPNTGWTYLFNQAHGDAAGYFGYLAINFAGTQAWIGGQEGGTQRGPYELVKQNDRFVAQNAVGNDYNQCAIEVNGNTAIDSRPGIGFHMPGRFASTLHLWEGGDFRFHTQGFGSYAGIMTGNVNANDVYIRSDRRLKKNLVEVRDALRKVSSLTAYSYDKKQTLEATEYDKKEVGLIAQDVEQVLPEAVTRVVDSSNKDGTEILTLSNSALIALLVGAVKELSEKVKELEYGRT
Physico‐chemical
properties
protein length:1244 AA
molecular weight: 130154,88900 Da
isoelectric point:5,89769
aromaticity:0,09003
hydropathy:-0,16125

Domains

Domains [InterPro]
DC_0238
RBD
1–144
IPR051577
Unmapped
1064–1240
IPR030392
CHP
1142–1200
IPR030392
CHP
1142–1243
A0A2S1PGM7
1 1244
Architecture
RBD
STR
STR
RBD 1-144 | STR 151-734 | STR 766-1243 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
A0A2S1PGM7
1 1244
Domain Start End Length (AA) Confidence
N-terminal 1 392 392 0,0717
Central domain 393 591 200 0,5878
C-terminal 592 1244 652 0,7880
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-392
Central
393-591
C-terminal
592-1244

Taxonomy

  Name Taxonomy ID Lineage
Phage Aeromonas phage 60AhydR15PP
[NCBI]
2163979 Uroviricota > Caudoviricetes > Pantevenvirales > Tulanevirus > Tulanevirus 60ahydrpp
Host Aeromonas hydrophila
[NCBI]
644 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Aeromonadales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AWH15718.1 [NCBI]
Genbank nucleotide accession
MH179477 [NCBI]
CDS location
range 123160 -> 126894
strand -
CDS
ATGGCAGATTTAAAAGTTGGAACCACTGTCGGTGGTTCACCTGTTTGGCACCAAGGCAATCTTGCACTGGTACCAAGCGGTAATGCTATCCTGTACAAGGGAGCAAGAATTTATTCGGAAAACGATAAACCGAGCGCAAATGAACTTCAGGTAGTATCTCGTGCTGGCGATACTATGTCAGGTGCTCTGAACATCGAAACTTCCACTGATTACCCATTAGCGCTTAAGTCAAGCGTTAGTGGTCCTGCTTATATTCGTTTTTCAAAGGGAAATACGCTTCAGTCATATGTTGGAACTGATGCGGCTGGTGACTTTAAAGTCGCAATGACTGACGTCAACGGTTCATGGGCATTTGATGGGCTTAAAATCGCTAAATCTAACGGCGATGTTTCTCTGAAAGGAGCGTTGGTATCCGCTAATACTGGAAACTTTGATATAAAGTATGGAAGTGTCCAGTTTATTCGAGCAAACTCGTCTAAAAACGTGTACATTGGCGCACCTGGCGGAACTGATTTGGTGCTCGGTTATGCCCAAGATGGAATGACTACCACTAAAATTCGCTTTGATTCCGCCGTATACAATAAGACTGGTGGACTTTTGATTAGCGACACCGGTCTTATCCAACGCTCTGCTATGGATAATCCATACTATAACCAGACCGAGGCTGACGCAAGATTCATCAGACTGAACACCAATACTGCTACAACTGGTTATTTGCTGAGCAGATCGTCTGATATGGGAACACCTCATAACCTGTCAATGGGTTATGCTGGATTCTTCAGACACAATGGTTTGAGCGGATTCCGTGACTTGACTATTAACGTTTCTACTCCATCTTCCAGTAACGGTGCACATGCCCGCGGTATTACTTTCGATTACGGAAGTATCGGTTATGGTATGTACACATACGCATACGACTCTGCAGGCACTAAATTAGCAAACCAAAAGATTTATACCGAAGCTGATAAACCTACTCCTGCAGAAATTGGCGCATTAGCTGCCGGCGCAAATGCCGTATCTGCATCCAAGTTGCAAACCGCAAGAACTATCAGTTTGACTGGAGGCGCAACTGGCTCGGTATCGTTCGATGGTAGTGCAAACGTTTCTTTGGCGGTGACCGTAACGAATGACAGTCATACACACTCCGATTACGTCAAAAAAATCGGCGACATTATGTCTGGCAATTTGGCTGTTCCAAAAGTTCTTTTGTCTGCTGCACAAGGAGCAGAAGCTAATTCTGTTGCTCGCAGAGATTTTGTTGAATCGACCGTTACTGCTTCGGGTAAAGGTGTGAAAGATTTGACAATCGCACTTCCTGCTGGAGCACCGACTTCCGGGTATATTCCAGTTCTTTTTAAAACATATGGAACATCCAATTCGTTTGTCTTCATCGATACTTTGACTGGTCATGAGTCGCATCCAATGAACAATTGCTCATTTACCGGTAATGTTCGCGCCAGTGGATGGGGTGACGGTGGAAGTTATGCCGTAGGCCAGTTTACGATTTATTCTACATCAGAAAGAGCAATTCACTCAATCCACGGACCATCTGAGGCCGTAGATGGGTTTGTTGTTTACGTTGAAACACGTGCTTTCCCGATAAGAGTTAGAGTCGATATCGAAACAGCCGTCACCGCCTATGCAACTGATGTTACATATGGAACATCTATCTTTGCGGTTAATGGCCAAGTAAGTGGAAATACAAAAACCATTGTTCTTGCGAATTTTGATAAAGGCTCTGGTACTTATAACGGAAGCAATCGTGTTTACGATAACGGATATAACCCAACTCCAGAAGCAGTAGGAGCTCTTCCAGTCAATGGAAATGCCGTTACGGCTTCTAGATTACAGACAGCTAGACTTATTGCAGGTGTTCCATTTGATGGCACATCGAATATTTCGATTTCTGCAACTAACGTTGGTGCGGTTGCTAAAGCTGGCGATGCAATGACCGGTGGGCTTACGTTCGTCGATGCTGCCTGCGAGCTGGGCTGGGTCTTCAATTCTGATTACGCGAAGATTGGTTTCAAGAATGCCTCTGGCGACGACACCGACAGCTACATGTGGTTCAAAACCGGGGATAACGGTAACGAATACTTCAAGTGGCAGAGTGTAAACGGAGCGAACACTACCGATTGGATGTCACTAAAGCCTACAGGGCTGGTCGTGGCTGCTGGGGTGACCGCTCCGACATTCACGGGCGCTCTTGCTGGCAATGCGGCCACGGCAACCAAGCTGGCTACGGCTCGCCAGATTAACGGCACCAACTTTGACGGTTCCGGCAACATCACCACGGCGAACTGGGGTACAGCCCGCACCCTGACTATCGGCAACGCTGCTAAGTCCGTTAACGGTGCGGGTGACGTGTCTTGGTCGCTGTCTGAAATCGGGGCTCTGCCTGTTGCTGGTGGGACTGTATCCGGGATGCTAGGAGTCACAGGGATACTTGACCTTGTAGGGTCCTCTGCTGACGACATGGCAGACATTGTGTGGAGAGCACCTGATGGCACTGAGCGAGGGCGCCTGTGGATTGGGGGCACGATAGGGGCTGATAACTCTCTCACATGGCGTAGTGGCGCAAGTGGGGCTACCTACAAGATTTACCATGAAGGGAACAAGCCGACTGCCTCGGATGTTGGCGCATTGTCTATTGCTGGCGGTGAAATGGGTGGAGTCGTCGCATTCCGTGGCAGCGCTAATTTATTGAATGTTACTGACGGCGCTAAAATTCGGTACTTCAATGGTAATAGCGCTTGGTTTCATACTTCGGTTAACGCCGCGGGCGAGTTTGAGGTCTCTACTGGTGGTGTCGGAGAAACTTCTATAGCTACCATAGATTATTCTGGCAAGATTCGTACTTCTAACCAAGGCGTTTTATACGGTGACAGGAGTAAGCCCACTGCCTCGGATGTTGGTGCGGCTCCGGCAGGGTTCGGTCTTGGAGAGTACGGCAGGGTTATCGGCTCTGTTCTAGGGGACACCCCTCTGCGCCGCCAGTCGGGCTTCTTCCAAGGATCCAACATTGCGGGCATTCCGAATACTGGATGGACATATCTCTTCAACCAAGCTCACGGAGACGCAGCAGGATACTTCGGATACTTGGCTATCAACTTTGCTGGAACGCAAGCGTGGATTGGCGGACAGGAGGGCGGTACCCAGAGAGGTCCTTACGAGCTGGTGAAACAGAACGACAGGTTCGTGGCACAAAATGCTGTGGGAAACGACTACAACCAGTGCGCTATCGAGGTGAACGGTAATACCGCTATCGACAGCCGTCCCGGGATCGGGTTCCACATGCCAGGGCGCTTTGCCAGTACGCTGCATCTTTGGGAAGGAGGAGACTTCCGTTTCCACACACAAGGATTCGGTTCGTATGCAGGGATTATGACAGGAAATGTGAACGCAAATGACGTCTACATCCGGTCAGACCGGCGATTGAAGAAGAACCTTGTGGAAGTGCGGGATGCTCTGCGGAAGGTGTCATCGCTGACCGCCTACTCCTACGACAAGAAGCAGACGCTTGAAGCCACCGAGTACGACAAAAAAGAGGTCGGATTGATTGCACAAGATGTCGAGCAGGTGCTACCCGAAGCTGTTACTCGTGTAGTGGATTCAAGTAACAAAGACGGGACCGAAATCCTGACGCTATCAAACTCCGCATTGATTGCGCTACTGGTGGGGGCAGTCAAGGAACTCTCCGAGAAGGTGAAGGAGTTGGAATATGGCCGTACCTAA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0098024 virus tail, fiber Cellular Component IEA:UniProtKB-KW (UniProt)
GO:0003700 DNA-binding transcription factor activity Molecular Function IEA:TreeGrafter (UniProt)
GO:0043565 sequence-specific DNA binding Molecular Function IEA:TreeGrafter (UniProt)
GO:0045893 positive regulation of DNA-templated transcription Biological Process IEA:TreeGrafter (UniProt)
GO:0016540 protein autoprocessing Biological Process IEA:TreeGrafter (UniProt)
GO:0019062 virion attachment to host cell Biological Process IEA:UniProtKB-KW (UniProt)

Tertiary structure

PDB ID
dcc0ed7b6804d5e568daec40a43797e33236b9569cbef0f9fc3f83ee3b7b0514
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5006
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50