Genbank accession
UYD60088.1 [GenBank]
Protein name
tail fiber protein S'
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,77
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MADLKLGSQIGGNLIWHQGILELNPVDDKLFYRDQEIMTTKGYQTMLGSIKFGTPNDVYDIESMSDGPGGVKRYLRKMRSGAASTIWHETINDRLYTISTGVTDSAPQFILNNGDSATFQYPVLTNSPQSGAANSFTRRDYVVAEDAKKVNKTGDGMTGNLDFHNDNQGIRVKFPGGSVANNTGVFGGTGDAAAKDKTNIQIKSWYGVGFSPTVTTATSKVVADGENSIWFDLRNGKMTTVGRLFVDTDKEVYSPVNKPTPGDLNAYTKAEVDAKHWIRVKDERAAMIQPSALDARTISAYFTNKSDVSTNWVSGFTVKGWDTTYASWSIFSSSRSDTDDKRLWFKHGRTDWAPSSRIYHENDKPTNVELNLVSRDGDEMTGLLNMKVPDSMGYGKYSIQLNNGSIGGINQLVFNDPSDTTSEGIAWPKTGKNSSSATQADYDMLWAFDGKLLFNNKETYGEWNKPTADDTQSMPDIRTKLSVDLDTVTGIGFYYQDTNANATAALHYPVGVAGSLVVSRSAYGIQQEYTTFTGLKYIRGRGTSTWSEWKEIYGEASSVQFVNKKGDTISGTLKSTANIVIESTYDSMLTLNSTDDGPNYITFARNGDNRFFIRQSTTGDIATDRLELLSGVKNAGGAYLTPFWVSSTGVYTNLPQSDSANALTRKDYVDTKVGTAVQSVTATGAVKSTGGINPVISLTNATNSADGAMSAADKAKLDGLPAAAVNKTGDSMTGNLTFSNDSILQWSRNTDYARIGFKNDSNGDVDSYMHFTVGDDDNEYFKFRTQASGKAAVDLINIKKANTTFMHDVVLAARESNELTLTNDAAEYTGNTGVTRIIGGVFSQWYKDNMIFGHVRGSSTGSAGFGVKLNDKYLMQLSPDRSLVTGAVIGDSYLAVQKNDRILAMEVDATNKIPYISVDGTYQAIRFENDRAITMPAGDLSVAKTINAGGNVVAYNNVSVTGQEIVFADKATGKTSGETGITTARMIEMLTTMGAFKTVYWCGKATWDYAGNNVLTDTGYGNIHLAGCIVEVIGKAQYMIRITTPTTTGSSLTPNSQNNASGQFIYVNHGSAYSPGWRRQMNAHEVNYGQAGTKDGILNKIPFVGPNGVMEIGQYIDFHHTQIADEDFHVRLQVGGSKQLQIVSTNGSIDIGAQNTSYAHIYTDRPSFYLNKGLTALGALNITGNMNINNGAPTIVLQDTDHMGAFLHCNSNLFYVLRSPSANNGTFDSGPNGIHPMTLNLENGDVQFSRNGSFNDVQIRSDIRLKSNFQPILNAVDKVCTLSGQTFDKFGCDKREAGIIAQHLQKVLPEAVGSFKNTAGEEFLTVSNSGVNALLVEAIKELKAEIEELKSKLK
Physico‐chemical
properties
protein length:1354 AA
molecular weight: 147086,07140 Da
isoelectric point:5,71007
aromaticity:0,09158
hydropathy:-0,37976

Domains

Domains [InterPro]
DC_0505
ATT
1–355
IPR030392
CHP
1261–1353
UYD60088.1
1 1354
Architecture
ATT
STR
CHP
ATT 1-355 | STR 476-1341 | CHP 1342-1353 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
UYD60088.1
1 1354
Domain Start End Length (AA) Confidence
N-terminal 1 181 181 0,1529
Central domain 182 380 200 0,3929
C-terminal 381 1354 973 0,7083
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-181
Central
182-380
C-terminal
381-1354

Taxonomy

  Name Taxonomy ID Lineage
Phage Aeromonas phage avDM12-TAAL
[NCBI]
3101605 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Aeromonas hydrophila
[NCBI]
644 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Aeromonadales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UYD60088.1 [NCBI]
Genbank nucleotide accession
OP380604.1 [NCBI]
CDS location
range 57794 -> 61858
strand -
CDS
ATGGCAGATCTTAAATTGGGGTCTCAGATTGGTGGAAATCTAATCTGGCACCAAGGAATCCTGGAATTAAATCCCGTTGACGATAAACTATTTTATCGCGATCAGGAAATAATGACTACAAAAGGGTATCAAACGATGCTTGGCTCAATCAAGTTTGGTACACCGAATGATGTATACGATATCGAGAGTATGAGTGACGGTCCCGGTGGCGTTAAGCGTTATTTGCGTAAAATGCGCTCCGGTGCGGCGTCTACAATTTGGCACGAAACTATTAATGATCGTCTATATACAATTTCAACTGGTGTAACTGACAGTGCTCCACAGTTTATTCTGAATAACGGTGATAGCGCAACGTTTCAATATCCGGTATTGACGAACAGCCCACAATCTGGTGCAGCTAATAGCTTTACCCGTAGGGATTATGTTGTGGCAGAAGATGCGAAGAAAGTCAATAAAACCGGTGACGGTATGACTGGTAACCTTGATTTTCATAATGACAATCAAGGTATCCGAGTTAAATTTCCTGGTGGTTCAGTTGCGAATAATACTGGCGTTTTCGGCGGAACAGGCGACGCGGCAGCAAAAGATAAAACAAATATTCAAATCAAATCTTGGTATGGTGTTGGTTTTAGTCCTACCGTAACAACAGCGACAAGTAAAGTTGTTGCCGACGGAGAGAACAGTATTTGGTTCGATCTCAGAAACGGCAAAATGACAACTGTAGGGCGTTTGTTTGTTGATACAGACAAAGAAGTATATAGTCCTGTCAACAAGCCAACTCCTGGCGATCTAAACGCTTATACGAAAGCAGAGGTTGACGCCAAACACTGGATCAGAGTTAAAGACGAAAGAGCGGCAATGATTCAGCCAAGTGCGCTGGATGCTCGCACAATTTCGGCTTATTTCACAAACAAGAGCGACGTTTCAACAAACTGGGTTTCTGGTTTCACTGTTAAAGGCTGGGATACAACTTACGCATCTTGGTCTATTTTTTCTAGTTCAAGATCTGACACCGATGATAAACGTCTTTGGTTTAAGCATGGTAGAACCGATTGGGCTCCTAGCTCAAGAATTTATCATGAGAATGATAAGCCAACAAACGTTGAGTTGAATCTGGTATCACGCGACGGCGATGAAATGACCGGTCTATTGAATATGAAAGTTCCGGATTCAATGGGTTACGGAAAATACAGCATTCAATTGAATAACGGGTCTATCGGCGGAATCAATCAGTTAGTATTCAACGATCCGTCGGATACAACTAGCGAAGGTATTGCTTGGCCAAAAACCGGTAAGAATTCATCATCCGCAACACAAGCAGATTATGATATGTTATGGGCTTTTGACGGTAAGCTTCTATTCAATAACAAAGAAACTTACGGAGAATGGAATAAGCCAACTGCCGACGATACACAATCTATGCCGGACATTAGAACTAAATTGTCGGTTGACTTGGATACAGTCACTGGGATCGGCTTTTATTACCAAGATACCAATGCAAATGCAACGGCGGCATTACATTATCCCGTTGGCGTTGCTGGCTCATTGGTCGTTTCTCGTTCCGCATACGGTATTCAACAAGAATATACAACTTTCACCGGTCTGAAATACATTCGCGGTAGAGGAACAAGCACGTGGAGCGAATGGAAAGAGATATACGGCGAGGCATCTTCTGTTCAGTTTGTGAATAAAAAGGGCGATACAATTAGCGGTACGTTGAAATCAACGGCTAATATTGTCATTGAAAGCACATACGATAGTATGTTGACCCTGAACTCTACTGACGACGGTCCGAATTATATTACGTTCGCTCGTAACGGAGATAACAGATTCTTCATTCGTCAATCCACAACCGGTGATATCGCAACTGATAGACTTGAGTTGTTAAGTGGTGTTAAAAACGCAGGAGGTGCTTACCTGACTCCATTCTGGGTTAGCAGCACTGGCGTTTATACCAACTTGCCACAGAGCGATAGCGCAAACGCATTAACTCGTAAGGATTATGTAGACACCAAAGTTGGCACAGCGGTACAGAGCGTTACGGCTACAGGTGCAGTTAAGAGTACAGGTGGAATTAACCCAGTTATTAGTCTGACAAACGCAACAAACTCTGCCGACGGTGCAATGTCCGCTGCCGATAAGGCTAAACTGGACGGATTGCCTGCTGCTGCTGTCAATAAGACTGGCGATAGTATGACTGGTAACTTGACATTCTCAAATGACAGTATTCTTCAATGGTCACGTAATACAGATTACGCTAGAATTGGATTTAAAAACGATTCAAATGGTGATGTCGATAGTTACATGCACTTTACCGTTGGTGACGATGATAATGAGTATTTCAAGTTTAGAACTCAAGCGAGTGGCAAAGCGGCTGTTGATTTAATAAACATCAAGAAAGCGAACACGACATTTATGCATGATGTTGTTCTTGCTGCTAGAGAATCAAACGAACTTACTTTGACCAACGATGCCGCAGAATACACAGGCAATACTGGTGTAACTCGCATTATCGGTGGTGTATTCTCACAGTGGTACAAAGATAATATGATATTTGGTCATGTTAGAGGTAGTTCAACCGGATCGGCTGGATTTGGTGTTAAGTTGAACGACAAGTATCTGATGCAATTAAGTCCGGATAGATCGCTTGTTACCGGCGCTGTTATTGGTGATAGTTATCTCGCAGTTCAAAAGAATGATCGCATTTTGGCTATGGAAGTTGATGCTACAAATAAGATTCCATACATTAGCGTTGATGGTACTTATCAAGCGATTCGATTCGAAAACGACAGAGCTATAACTATGCCGGCTGGCGATTTGAGCGTCGCAAAGACTATTAATGCCGGTGGTAACGTAGTTGCGTATAATAACGTAAGCGTTACTGGACAAGAGATCGTGTTTGCAGACAAAGCTACAGGTAAAACTTCTGGTGAAACTGGTATTACCACAGCTCGTATGATTGAAATGCTAACTACAATGGGAGCATTCAAGACTGTTTATTGGTGCGGTAAAGCCACGTGGGATTATGCTGGTAATAACGTTTTGACTGATACTGGATACGGTAACATTCACTTGGCTGGGTGTATTGTTGAAGTAATTGGTAAAGCTCAATACATGATTCGTATTACTACGCCAACAACAACAGGCTCTAGTTTGACACCAAATTCACAGAATAACGCCAGTGGACAGTTTATCTACGTGAATCATGGTTCTGCTTATTCTCCGGGTTGGAGACGACAAATGAATGCTCATGAAGTCAACTATGGTCAAGCCGGAACGAAAGATGGCATCCTTAATAAGATCCCATTCGTCGGCCCTAACGGTGTGATGGAGATTGGACAATACATTGATTTCCACCATACTCAAATAGCAGATGAAGATTTCCATGTTCGCTTACAAGTTGGTGGTTCTAAGCAATTGCAGATCGTTAGCACAAACGGTTCTATTGATATTGGTGCTCAGAATACTAGCTATGCTCACATTTACACCGACAGACCTTCTTTCTATTTGAATAAAGGTCTAACCGCTCTCGGTGCGTTGAACATAACTGGGAACATGAACATCAACAACGGCGCTCCAACTATCGTATTGCAAGATACAGATCACATGGGAGCATTCTTACACTGCAACAGTAACTTGTTCTATGTGTTGAGGTCCCCTAGCGCAAACAACGGTACATTTGACTCGGGTCCTAACGGCATTCATCCAATGACGTTGAACTTGGAAAACGGTGATGTTCAATTCAGTCGAAACGGTAGTTTCAACGATGTTCAGATTCGTTCTGATATTCGATTGAAATCTAATTTCCAACCGATTTTGAATGCAGTTGATAAAGTTTGCACTCTGAGTGGACAAACATTTGACAAGTTTGGCTGTGATAAGCGTGAAGCTGGTATTATCGCTCAACATCTGCAAAAAGTATTACCGGAAGCAGTTGGTAGCTTTAAAAATACCGCTGGCGAAGAATTCTTGACAGTTTCTAACTCTGGCGTTAACGCGCTGTTGGTAGAAGCAATCAAAGAACTTAAAGCCGAAATTGAAGAACTTAAATCTAAACTTAAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
3b3afd338dd98c4b225657e9364c916a836ae11a6170654b0f9b7d103c96e0de
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5335
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
On Diversity and Genetic Richness: Insights on Aeromonad Phage Diversity through Physicochemical and Molecular Analysis Papa,D.M., Rousseau,G., Tremblay,D., Labrie,S., Gutierrez,T.A., Ramos,J.D. and Moineau,S. 2024-03-24 — GenBank