Genbank accession
QAX99600.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,70
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MADLKLGSQIGGNLIWHQGILELNPLDDSLFYKEFDMITSKGGQTINGTLSLAGDVDTKGRFTAVGNDTSWGSVAQPAFGMDKDNTAGAHWLLASRKRDGSQRAGIQVLTNDSGEMRIYTNKHANYTSFKDGQIYIQATTPSADANATRKDYVDKEINRAMTFAETTTDKLTADLATANTRINTLNAQNVKITGNQNIAGTKTFTDLPVIQDQPTADTHATNKKYVDTKVGTAVQSIGTTAPLTTTGGVNPTLAINQATRTAAGSMSAQDKVKLDDLPADALSRSGGNMKNNGFIKIEGIGGIKSLYNSKEYSILRDHNNGNVTLGGAGGDLYVGYNTTSEEYTTKNVLLYAPMKWTNTNRILVDSDGFIPWLSIKDRVGMEGMSMMLKGPINFDNYNLTGDYNLYLARAAGSNNPPPFDCGTMSVVGSAVIANAFVTQTATDKITGKVYIRTRNDDANKTWSKWKETLNEDSDVAYGYHNKFEVGGDANTFYPVVINLRGEVDQYSWKRYCFSRHYAAKAPDTWNNKTHRGGLTLEFQMTNDGSWGGNSHNVNVNEFSQSYTTVCGGMTLTTGSMIVWLRGGGAEYMFHSDEGIKGDIVVYLDRYIAADKVEFLTRNMEQAIAANLAEIMPRWSVRNGEVYDRNRRVLVADGSTSMIGDLKIEKEQAALILKNAAGNAADRPENYGRIRFEHATGDQHVELWHSVHDDYRQGYGLRVLKPSDNSGASGAWLDVQGDVFGQNFIQTTAQSTNAASSTRKDYVDALIATKVNKSDVAASSDYAGLLGKIPRVGGDGVFEIARYIDFHTNGSTRDFDVRLDCYETGKLNVVGGVLQVGGGDVYHSKNKPTNTDLNLVSRAGDTMTGALTLPKIKGAINLMDKASVKFVDGANTWFHLFSEGNLFKISQGTTGQNNVLSIGSDGAVNMIGNLTNTKMITSNTAIGVNSNTRKLALEVGDDKTPYISVDYAYRALQFNENKTVTATHGFEINGKNGNGDYFVNHTGFVGGWARGLRAVNSAGAISAGIGFNGEGDKVDGIYLGVGATPWGDGTLSAMKISADKVNISKPTWVNSGRFQINSTSHNILEFHTPGKHARIMWMDGGTGQLNIGTSNGSFTEASRIVSIGNSTMEMNGAAWSANYRHDYAGQFSTTAPFQVSYGAVAGGSDYYPLVRSRGWVTGSGYTTDVDFGVLRSGGTWGQGVIRVGSAESNSAGVQAAFYFDINGNFKAPAGVYDSGNRCYSASNPVPAGHHNHANLRARDAVIIWDGNIDKGNFTLTRPWSDFDFVCFCVLWDDYGGLTTKTFSRYDLEINQSIGVNYDISGGAGGIQWMGRFAADNRSFATSYENGRMRRVFGYNMGTVN
Physico‐chemical
properties
protein length:1359 AA
molecular weight: 147223,88200 Da
isoelectric point:6,31938
aromaticity:0,09639
hydropathy:-0,39617

Domains

Domains [InterPro]
DC_0505
ATT
92–660
Coil
Unmapped
168–188
QAX99600.1
1 1359
Architecture
ATT
STR
STR
ATT 1-660 | STR 673-793 | STR 806-1276 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QAX99600.1
1 1359
Domain Start End Length (AA) Confidence
N-terminal 1 1001 1001 0,1433
Central domain 1002 1200 200 0,3202
C-terminal 1201 1359 158 0,9465
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-1001
Central
1002-1200
C-terminal
1201-1359

Taxonomy

  Name Taxonomy ID Lineage
Phage Aeromonas phage AsFcp_4
[NCBI]
2419737 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Aeromonas salmonicida
[NCBI]
645 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Aeromonadales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QAX99600.1 [NCBI]
Genbank nucleotide accession
MH791407.1 [NCBI]
CDS location
range 113318 -> 117397
strand +
CDS
ATGGCAGATCTTAAATTAGGGTCACAGATTGGCGGAAATCTAATCTGGCACCAAGGCATTCTAGAATTAAATCCTCTGGACGATAGCCTATTTTACAAAGAATTCGACATGATCACTTCTAAGGGTGGTCAGACAATTAATGGTACACTGTCACTAGCTGGTGATGTTGATACAAAAGGAAGATTTACCGCAGTTGGTAATGATACTTCTTGGGGTTCGGTCGCTCAACCAGCATTTGGAATGGACAAAGATAATACCGCTGGTGCTCATTGGCTGCTTGCAAGTCGCAAACGTGACGGAAGTCAACGTGCTGGTATTCAAGTTCTTACAAATGATTCTGGTGAAATGCGTATCTACACAAACAAACATGCTAATTACACTTCATTTAAAGACGGTCAAATCTATATTCAAGCGACGACTCCATCCGCAGATGCAAATGCAACGCGCAAAGATTACGTCGATAAAGAAATCAATCGCGCAATGACATTTGCCGAAACAACAACTGATAAACTCACTGCCGATTTAGCTACTGCTAATACCAGAATTAATACTCTGAATGCGCAGAACGTTAAGATTACTGGCAATCAGAATATCGCTGGCACTAAGACGTTTACCGACTTGCCTGTTATTCAAGATCAGCCGACTGCTGATACTCACGCGACAAACAAGAAATACGTCGATACAAAGGTTGGGACTGCGGTACAGAGCATCGGTACAACTGCCCCACTGACTACTACTGGTGGCGTTAACCCAACGCTGGCAATCAATCAGGCAACTCGTACCGCTGCTGGTAGTATGAGCGCACAAGACAAAGTTAAACTTGATGATCTACCCGCCGATGCATTAAGTCGTTCCGGTGGCAACATGAAGAACAATGGGTTTATTAAGATTGAAGGTATTGGTGGTATCAAATCACTGTATAACAGTAAAGAATATTCTATTCTGAGAGATCATAATAATGGCAACGTTACTCTTGGTGGAGCAGGGGGCGATCTGTATGTTGGTTATAACACAACATCAGAAGAATACACAACCAAAAACGTATTGCTTTATGCGCCTATGAAATGGACTAACACAAATCGTATTCTAGTTGATTCCGACGGATTTATTCCGTGGTTAAGTATTAAAGATCGAGTTGGTATGGAAGGTATGTCCATGATGCTCAAAGGGCCAATCAACTTTGATAATTACAATCTAACCGGCGATTATAACTTGTATCTAGCTCGCGCCGCTGGATCTAATAACCCACCACCGTTCGATTGTGGTACTATGAGTGTGGTTGGTTCTGCTGTTATTGCAAATGCTTTTGTAACTCAAACAGCAACAGACAAAATCACTGGAAAAGTTTATATTCGAACTCGAAATGACGATGCAAATAAAACTTGGTCCAAGTGGAAAGAAACATTGAATGAAGATTCAGACGTCGCATATGGATATCATAATAAGTTTGAAGTTGGTGGTGACGCTAATACATTCTATCCAGTTGTTATTAATCTGAGAGGTGAAGTAGATCAGTATAGCTGGAAGCGTTATTGTTTCTCTCGTCATTATGCAGCAAAAGCCCCGGATACTTGGAATAATAAAACACATCGAGGTGGTTTGACTCTTGAATTCCAAATGACAAATGATGGAAGTTGGGGTGGTAATTCTCATAATGTGAATGTGAATGAGTTCAGTCAATCTTATACAACTGTTTGTGGTGGTATGACTCTTACTACCGGATCAATGATCGTTTGGTTGCGTGGCGGTGGCGCTGAATATATGTTCCATAGCGACGAAGGTATTAAAGGTGATATTGTTGTTTATCTGGATAGATATATTGCTGCTGATAAAGTTGAGTTTTTGACTCGAAATATGGAACAAGCGATTGCTGCTAACTTAGCTGAAATAATGCCGCGTTGGTCAGTTAGAAATGGCGAAGTTTATGATCGCAACCGCAGAGTTCTAGTTGCCGATGGTTCTACCTCAATGATTGGCGATCTCAAAATTGAGAAAGAACAAGCCGCATTGATTCTGAAAAACGCTGCTGGTAACGCAGCGGATAGACCAGAAAACTATGGTCGTATTAGATTCGAACATGCAACTGGGGATCAACACGTTGAGTTGTGGCATTCAGTACATGACGATTACAGACAAGGGTATGGACTAAGAGTTCTTAAACCTTCTGATAATAGTGGTGCGAGTGGCGCTTGGCTTGATGTTCAAGGTGATGTATTTGGACAAAACTTTATTCAAACTACAGCACAATCCACAAATGCGGCATCTAGCACACGGAAAGATTATGTTGACGCATTAATTGCAACTAAAGTGAATAAATCTGATGTTGCTGCTAGTTCTGATTACGCTGGACTATTGGGTAAGATTCCAAGAGTTGGTGGCGATGGTGTATTTGAAATTGCTCGTTATATTGATTTCCACACAAATGGAAGCACAAGAGATTTCGATGTTAGACTGGATTGCTATGAAACTGGAAAGCTTAATGTTGTTGGTGGGGTTTTGCAAGTTGGCGGTGGCGATGTGTATCACAGCAAAAACAAACCAACTAATACGGATTTGAACTTAGTTTCTCGCGCTGGTGATACCATGACTGGCGCGTTGACACTGCCGAAGATCAAGGGTGCTATTAACTTGATGGACAAAGCAAGTGTTAAATTTGTTGATGGTGCGAATACTTGGTTCCATTTGTTTTCCGAAGGTAATCTATTCAAGATAAGTCAAGGAACAACTGGTCAGAATAATGTTCTGAGTATCGGAAGTGATGGTGCCGTTAATATGATTGGTAACTTGACTAACACCAAAATGATAACATCAAACACCGCTATCGGTGTTAATTCAAATACCAGAAAACTTGCACTTGAAGTTGGTGATGATAAAACTCCTTATATCAGTGTTGATTATGCATATAGAGCATTACAGTTTAACGAAAATAAAACTGTTACCGCAACTCATGGATTTGAGATTAATGGCAAAAACGGAAACGGTGATTACTTCGTTAATCACACTGGATTTGTTGGAGGATGGGCTCGTGGTTTACGTGCTGTAAACTCTGCTGGTGCTATTAGTGCTGGTATTGGGTTTAATGGCGAAGGCGATAAAGTTGACGGCATTTATCTTGGAGTTGGTGCAACACCGTGGGGTGATGGAACATTAAGTGCAATGAAGATTTCTGCCGATAAAGTTAACATCAGTAAACCAACATGGGTAAATAGCGGTAGATTCCAGATTAACTCGACCAGTCATAACATTCTTGAATTCCATACGCCGGGAAAACATGCTCGAATTATGTGGATGGATGGTGGAACCGGACAGTTGAATATCGGTACATCGAACGGATCATTCACAGAAGCGTCTCGTATTGTGTCTATCGGAAATTCAACTATGGAAATGAACGGTGCTGCTTGGTCTGCAAATTATCGACATGATTATGCCGGTCAGTTTTCTACCACTGCTCCATTCCAAGTTAGTTATGGTGCCGTTGCGGGTGGAAGTGATTATTACCCACTTGTTCGTAGTAGAGGTTGGGTGACTGGTTCTGGATATACAACTGACGTTGATTTTGGTGTATTGCGTTCCGGTGGAACTTGGGGTCAAGGCGTTATTCGCGTTGGTTCGGCAGAAAGTAACTCTGCCGGGGTACAAGCGGCGTTTTACTTTGATATCAATGGGAACTTTAAAGCGCCGGCTGGTGTTTATGATAGTGGAAACAGATGTTATTCAGCGAGTAACCCAGTTCCAGCTGGTCATCACAATCACGCGAATTTGAGAGCAAGAGACGCTGTTATTATTTGGGACGGTAATATTGACAAGGGAAACTTTACTCTAACCAGACCGTGGTCGGATTTTGACTTCGTTTGCTTCTGTGTATTGTGGGATGATTACGGTGGACTAACTACCAAGACATTCTCAAGATACGATTTGGAGATAAACCAATCAATAGGCGTCAACTATGATATCTCTGGCGGTGCTGGCGGTATTCAGTGGATGGGTAGATTTGCCGCTGATAATAGATCGTTCGCAACTAGCTATGAAAACGGTCGTATGCGTAGAGTGTTTGGATATAACATGGGAACAGTGAACTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
6a6adcb75aa576ad37d591e5b358ba40255bcacc6ec82a66c24c6f59e12c0a29
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5056
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
AsFcp_4, Complete genome sequences of 3 novel enterobacteria, Pakpunavirus like phages Yuan,S., Ma,Y. and Liu,Q. 2020-07-27 — GenBank