UniProt accession
A0A2H4YFZ0 [UniProt]
Protein name
Long tail fiber protein Gp37
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,70
TF
Evidence RBPdetect2
Probability 0,96
TF
Evidence UniProt/TrEMBL
Probability 1,00
Protein sequence
MADLKLGSQIGGNLIWHQGILELNPVDDKLFYRDQEIMTTKGYQTMLGSIKFGTPNNAYDIESLGTEAGAGTKRYLRKMKSGASATIWHETILDNVYTISTGITDAAPQFTITNGNSATFQFPVLTNSPQSGAANSFARKDYVDAVDARNVAKAGDTMTGTLTVPKIVDNNTNIGKDILTYIKLSNVNQWAGPVGQSRFVTPDSVGSPAGNKGGYWNVLSRRDSAGGYAGIFIPYGNSENKNYIGTQELGTNAPIWAEIYTNLNKPTPGDLNAYTKSEVDEKSWIRVRDEREAMIQPSALDARTISAYFTNKSDVSTNWVSGFTVKGWDTTYASWSIFSSSRSDTDDKRLWFKHGRTDWAPSSRIYHENDKPTNVELNLVSRDGDEMTGLLNMKVPDSMGYGKYSIQLNNGSIGGINQLVFNDPSDATSEGIAWPKTGKNSSSETQADYDMLWAFDGKLLFNNKETYGEWNKPTNNDLNLVSRAGDIIKGELEIQNAPLTLTNGMMYVNNGNTKRVIKRLGVQNDAKAMLILIAPKYVGKALPKRGFVGRVTFERGSTGSTLQANYVDISAVTAYTETDAQIHYESGGTPVKLVYHTHTDGIEYLALYRGVVSAATIYIDGYVYGEEPVVISDATGLTFTDLKTRARIYSSDNKPTNVDLNLVSRAGDTITGDLIATNIYSSVTQSTRGDSFARKDYVDTKVGTAVQSVTATGAVKSTGGINPVISLINATNSADGAMSAADKAKLDGLPSAAVNKTGDTMTGNLTFTNNSELVWSRNTDWAKIGFKNDSDADTDSYMWFETGDNKNEYFKFRMHNTTGPKHEVLDIKLEGSTFAHDVILKARESNAVKLTNAQTEYTGNTGVERIIGGITSQWYEDNLVFGHVRSPGQPSAGFGVRLNDAYLMRVTPDRRLATGALVGDSYVAVAKNDRILAMEVDTTTKVPYISVDVKYQAIRFENDRAITMPAGALNVASNVSSGGDVFAKSNVNVTGQYIQFNDKAAGKTAGETGITTARFVEMLTALGAFKTVYWCGKVSWDYAGNNVLTDTGYGNIHLAGCVVEVIGTAQYMIRITTPTITGTSLTGAQNNASKEFIYVNHGSTYAPGWRRGINSLDVRDLNSATSVGDPRNTIPYIKGDGVMEISTFIDMHRKDSTADFDTRLECGSAKQLLVTNSNGTLELGAQNASYAHIYTDRPVFYMNKELQINGARVMYEGSTHGTLTLSNWIRTTGNTGWFNATYGGGIHMEDATWLRAYNGKKFYVANTDGDALNTSGGVYAAGNGNFNDVQVRSDERLKSNFEPILNALDKVDSLSGWIYDKVGKTTREAGIIAQRLKAVLPEATGIAKDSMNPNAIEYLTVSNSGVNALLVEAIKELRAELNELKSKLN
Physico‐chemical
properties
protein length:1385 AA
molecular weight: 150777,46210 Da
isoelectric point:5,81175
aromaticity:0,09025
hydropathy:-0,37704

Domains

Domains [InterPro]
DC_0933
STR
546–1372
IPR030392
CHP
1289–1339
A0A2H4YFZ0
1 1385
Architecture
ATT
STR
CHP
ATT 1-582 | STR 583-1372 | CHP 1373-1384 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
A0A2H4YFZ0
1 1385
Domain Start End Length (AA) Confidence
N-terminal 1 312 312 0,0617
Central domain 313 511 200 0,3196
C-terminal 512 1385 873 0,7106
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-312
Central
313-511
C-terminal
512-1385

Taxonomy

  Name Taxonomy ID Lineage
Phage Aeromonas phage Ah1
[NCBI]
2053701 Uroviricota > Caudoviricetes > Pantevenvirales > Cinqassovirus > Cinqassovirus ah1
Host Aeromonas hydrophila
[NCBI]
644 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Aeromonadales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AUE22856.1 [NCBI]
Genbank nucleotide accession
MG250483 [NCBI]
CDS location
range 204725 -> 208882
strand +
CDS
ATGGCAGATCTTAAATTAGGGTCTCAGATTGGTGGAAATCTAATCTGGCACCAAGGAATCCTGGAATTAAATCCCGTTGACGATAAACTATTTTATCGTGATCAGGAAATAATGACTACAAAAGGGTACCAAACAATGCTTGGCTCAATCAAGTTTGGTACACCGAATAACGCTTATGATATCGAGAGTCTTGGCACAGAAGCAGGTGCGGGAACAAAGCGTTATTTGCGTAAAATGAAATCGGGCGCAAGTGCTACTATTTGGCATGAAACTATTCTGGATAACGTATACACGATTTCGACTGGTATAACTGATGCGGCTCCGCAGTTTACGATCACTAATGGAAATAGCGCGACATTTCAGTTCCCTGTATTAACTAACAGTCCACAATCTGGCGCAGCAAATAGTTTCGCTAGAAAAGACTACGTGGACGCTGTTGATGCTAGAAACGTTGCTAAAGCGGGCGATACAATGACCGGTACTCTTACTGTGCCAAAAATTGTTGATAACAACACAAATATTGGTAAGGATATTCTTACTTATATTAAACTGAGTAATGTAAATCAGTGGGCTGGTCCCGTTGGACAATCTCGATTTGTTACGCCAGATTCTGTTGGTAGTCCAGCTGGTAATAAGGGCGGATATTGGAACGTATTATCTCGCCGCGATTCTGCTGGAGGGTATGCCGGTATCTTTATTCCGTATGGCAACAGTGAAAACAAAAACTATATCGGCACACAAGAACTTGGAACTAATGCTCCAATTTGGGCAGAGATCTATACCAATCTGAATAAACCAACACCGGGCGATCTGAATGCTTACACCAAATCGGAAGTTGATGAAAAGAGTTGGATCAGAGTTAGAGATGAAAGAGAGGCAATGATTCAGCCAAGTGCGCTGGATGCTCGCACAATTTCGGCTTATTTCACAAACAAGAGCGACGTTTCAACAAACTGGGTTTCTGGTTTCACTGTTAAAGGCTGGGATACAACTTACGCATCTTGGTCTATTTTTTCTAGTTCAAGATCTGACACCGATGATAAACGTCTTTGGTTTAAGCATGGTAGAACCGATTGGGCTCCTAGTTCAAGAATTTATCATGAGAATGATAAGCCAACAAACGTTGAGTTGAATCTGGTATCACGCGACGGCGATGAAATGACCGGTCTATTGAATATGAAAGTTCCGGATTCAATGGGTTACGGAAAATACAGCATTCAATTGAATAACGGGTCTATCGGCGGAATCAATCAGTTAGTATTCAACGATCCGTCTGATGCAACTAGCGAAGGTATTGCTTGGCCAAAAACCGGTAAGAATTCATCATCCGAAACACAAGCAGATTATGATATGTTATGGGCTTTTGACGGTAAGCTTCTATTCAATAACAAAGAAACTTACGGAGAATGGAATAAGCCAACAAATAACGATTTAAATCTGGTATCTCGTGCTGGTGATATTATCAAAGGCGAACTTGAGATTCAGAATGCACCGCTTACATTGACTAACGGTATGATGTACGTTAATAACGGCAACACAAAAAGAGTTATTAAACGTCTAGGTGTGCAAAATGACGCAAAAGCAATGCTGATTCTAATTGCACCAAAATACGTTGGCAAAGCATTACCAAAACGCGGATTTGTTGGTCGAGTTACATTTGAGCGTGGTTCAACAGGTTCAACCCTACAAGCTAACTACGTTGATATTTCTGCCGTAACTGCATACACAGAAACAGATGCTCAGATTCATTATGAGTCAGGTGGAACTCCTGTAAAACTCGTTTATCATACGCATACCGATGGCATAGAATATCTTGCACTGTATCGCGGAGTAGTTAGTGCGGCTACAATTTACATCGATGGATATGTTTATGGAGAAGAGCCAGTTGTTATTTCTGACGCTACTGGATTGACATTCACCGATCTGAAAACAAGAGCTAGAATTTACAGCTCAGATAATAAGCCAACTAATGTTGATTTAAATCTGGTATCACGCGCTGGTGATACAATTACCGGTGATTTGATTGCAACTAACATTTATTCGTCTGTTACTCAAAGCACACGTGGCGATTCTTTTGCTCGTAAAGACTACGTTGATACCAAGGTAGGCACAGCGGTACAGAGCGTTACCGCTACTGGAGCAGTTAAGAGCACAGGTGGTATTAACCCAGTTATCAGTTTGATTAACGCAACAAACTCTGCCGACGGTGCAATGTCTGCTGCCGATAAAGCCAAACTAGACGGTTTGCCTTCCGCCGCGGTTAATAAGACTGGCGACACTATGACTGGCAACTTGACATTCACTAATAATAGTGAATTGGTGTGGAGTCGAAATACAGACTGGGCAAAGATTGGATTCAAGAACGACTCGGACGCAGATACCGATAGCTATATGTGGTTTGAGACTGGTGATAATAAGAACGAGTATTTTAAGTTTAGGATGCACAACACAACTGGACCAAAACACGAAGTTCTGGATATCAAACTGGAAGGATCAACATTCGCACACGATGTTATTCTAAAGGCGAGAGAATCTAACGCTGTCAAGTTGACTAACGCGCAAACAGAATATACAGGCAATACCGGCGTTGAGCGTATTATTGGTGGAATCACTTCGCAGTGGTACGAAGACAATCTAGTATTTGGACACGTTCGTTCTCCAGGTCAGCCGTCTGCTGGGTTTGGTGTTAGATTGAATGACGCTTATTTGATGCGAGTCACACCGGACAGAAGACTTGCAACTGGTGCTCTTGTTGGTGATAGTTATGTCGCAGTTGCTAAAAATGATCGCATTTTGGCAATGGAAGTTGATACAACAACTAAAGTTCCTTACATTTCAGTAGATGTGAAATATCAAGCAATTAGATTTGAAAACGATAGAGCAATCACTATGCCAGCCGGCGCTCTTAACGTGGCGAGTAATGTTTCTTCTGGCGGAGATGTATTTGCAAAATCAAACGTGAATGTAACTGGACAATATATTCAGTTCAACGACAAAGCGGCGGGTAAGACCGCTGGTGAAACTGGCATTACAACAGCAAGATTTGTTGAAATGTTAACAGCACTCGGTGCATTCAAGACTGTTTATTGGTGTGGTAAAGTTTCGTGGGATTATGCTGGTAATAACGTATTGACCGATACGGGATATGGTAATATTCATTTGGCTGGATGCGTTGTTGAAGTTATTGGTACGGCTCAATATATGATCCGTATTACTACTCCGACAATAACAGGAACTTCTCTGACAGGAGCACAGAATAACGCTAGTAAAGAGTTCATCTATGTTAATCACGGTTCTACATATGCGCCTGGTTGGAGACGCGGTATTAATAGCCTAGACGTTAGAGATTTGAATTCAGCTACGTCTGTTGGAGATCCACGCAATACTATTCCTTATATCAAGGGTGATGGTGTTATGGAAATCTCTACCTTCATTGATATGCATCGTAAAGATTCAACTGCTGATTTTGATACTAGATTAGAATGTGGTAGCGCAAAACAACTATTGGTGACGAACTCAAATGGAACACTAGAGTTGGGAGCACAGAATGCTAGTTATGCTCACATTTATACAGATCGTCCTGTATTCTACATGAACAAAGAATTGCAGATTAATGGCGCTCGCGTAATGTATGAGGGTTCCACTCACGGAACATTAACTCTAAGTAACTGGATTAGAACAACAGGTAATACCGGCTGGTTTAACGCAACGTACGGTGGTGGAATCCACATGGAAGACGCAACTTGGTTACGCGCATATAACGGTAAAAAGTTTTATGTTGCGAATACAGATGGCGACGCATTGAATACATCCGGTGGTGTTTATGCTGCTGGTAATGGTAATTTCAACGACGTTCAAGTTCGTTCGGATGAAAGATTGAAATCTAATTTCGAGCCAATTTTGAATGCTTTGGACAAAGTTGATTCTCTTTCTGGTTGGATATATGACAAAGTTGGCAAAACAACTCGCGAAGCGGGTATTATCGCACAACGTTTGAAAGCAGTATTGCCAGAAGCTACTGGAATAGCGAAAGATTCTATGAATCCAAATGCAATCGAGTATCTGACTGTTTCTAACTCTGGCGTTAACGCGCTGTTGGTAGAAGCAATCAAAGAACTTAGAGCCGAGTTGAACGAACTTAAATCAAAACTTAACTAA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0098024 virus tail, fiber Cellular Component IEA:UniProtKB-KW (UniProt)
GO:0019062 virion attachment to host cell Biological Process IEA:UniProtKB-KW (UniProt)

Tertiary structure

PDB ID
a8170b4497ebc160648c1f0be338921993cb01bc870aa5395c871927e1cfb8e1
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5086
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50