UniProt accession
A0AAX4MWU8 [UniProt]
Protein name
Tail fiber protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,90
TF
Evidence RBPdetect2
Probability 0,95
Protein sequence
MVDIVKQDMTYLWAIGGDVVAPDNAKIQEGWAVEVVPRQWWNWMQYRTDSNIAYMLQKGLPEWDGTTEYLANKSFVTVGGVVYKCIVTNTNKNPTTNPANWVRAFSDYSVAVTALGTLTPAADRMPYFTGANTAALTTLTSFARTLLDDTSATAARTTLGAQASSTNLTALSGVTAATNALPYFNGTTTMATTTLSAFGRSLIDDADAAAARETLELGSAATYNVNGTVYGNTAVGGIGTSVLRNGSFGLGAIDLQDQPAGTNWNTINATGFYQMSTAGGDNSPGLSGQMMVMTNATNYITQLFSPQDTTGRLMVRSSSAGVFGSWNTVWTTGNLVKTTSETDTTAGAMLKVGDFGLGNTGPVATTALDTINAGGFYRASSTATGLPTANSTSIIQSQFNTGGALQIAGALTSGGGLYWRQQSGGSWGVWYQAAKTEYVDSQVSTLNSAINLKANIASPSFTGTPTAPTPTANDNSSKIATTAFVQSSRRNYSGSVLSVTTNTTFTISNSGYLYQAGADNLTVTIPVAGTVPVGTTYSFRNNRSSNFTISVPTGSIIADGSSTPSTLILAGGEWVEITNNNTSWYVAARGTLSEGSTAAEVALKAPLASPAFTGTPTVPTAATATSNTQAASTAFVKAALAAGNALSATTAARWTTGRTITLTGDVTGSVSIDGSANVSLAATLNSGSLTNFYTKAQSDGRYVVNGATGSNLYVNVTNNSIPTISAATASFGSNSLRVSNGGNGNASAVLSFVREGTYATWFGLDTDNELAFGGWSDGAIRYRLWTEKNFVVGNHIALQGTGGIGTYALMVVGGGGGINPGDLAAGGNLRYSSTAASVSGAVPVGTWRLMGFVTNSDGSSSDSVTLCLRIS
Physico‐chemical
properties
protein length:871 AA
molecular weight: 89698,13010 Da
isoelectric point:5,23353
aromaticity:0,08611
hydropathy:-0,01814

Domains

Domains [InterPro]
DC_0043
STR
1–166
cd19958
STR
259–330
A0AAX4MWU8
1 871
Architecture
STR
ATT
RBD
STR 1-166 | ATT 220-609 | RBD 611-871
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Pseudomonas phage vB_PpuM-KoPa-4
[NCBI]
3132618 Uroviricota > Caudoviricetes > Vandenendeviridae > Tartuvirus > Tartuvirus kopa4
Host Pseudomonas putida KT2440 and
[NCBI]
1481724 Heterolobosea > Eutetramitea > Lyromonadida > Psalteriomonadidae > Monopylocystis >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WYV99193.1 [NCBI]
Genbank nucleotide accession
PP496414 [NCBI]
CDS location
range 19170 -> 21785
strand +
CDS
ATGGTCGATATCGTAAAACAGGATATGACATACCTTTGGGCAATTGGTGGTGACGTAGTTGCACCTGACAATGCCAAGATTCAAGAGGGTTGGGCTGTAGAAGTTGTGCCGCGTCAGTGGTGGAACTGGATGCAATACCGCACAGACAGCAACATCGCCTATATGCTGCAAAAAGGTCTACCAGAGTGGGACGGTACAACCGAGTATCTCGCTAACAAATCTTTTGTAACTGTCGGTGGAGTTGTTTACAAGTGCATTGTCACCAACACAAACAAAAACCCAACAACAAACCCAGCAAACTGGGTTAGGGCGTTCAGCGATTACAGCGTTGCTGTTACTGCACTGGGGACACTTACACCAGCAGCTGACCGTATGCCCTATTTCACAGGTGCAAATACCGCTGCTCTGACGACCCTCACAAGCTTTGCACGTACACTGCTAGATGACACCTCTGCAACAGCAGCAAGAACAACACTTGGCGCTCAAGCTTCAAGCACAAACCTTACTGCATTGTCTGGTGTAACAGCTGCAACAAACGCACTGCCATACTTCAACGGGACAACTACAATGGCAACAACAACGTTGTCTGCGTTTGGTCGTTCTCTGATTGATGATGCAGACGCTGCTGCTGCTCGTGAAACACTTGAACTAGGGTCAGCTGCAACTTACAACGTAAACGGCACTGTATACGGAAACACGGCTGTTGGTGGTATCGGCACTTCGGTACTTCGTAACGGATCTTTTGGACTTGGTGCCATTGACCTGCAAGACCAACCAGCAGGAACAAACTGGAACACAATTAACGCCACTGGGTTCTACCAGATGTCAACAGCGGGCGGAGATAACAGCCCCGGCTTGTCTGGACAGATGATGGTAATGACCAATGCCACAAACTATATCACTCAGCTGTTTAGCCCGCAAGACACTACTGGCCGTTTGATGGTCAGATCTTCGTCTGCTGGTGTATTCGGGAGTTGGAATACTGTCTGGACAACTGGCAACTTGGTCAAGACAACAAGCGAAACAGACACAACTGCAGGGGCTATGCTGAAAGTTGGAGACTTTGGTCTTGGTAATACTGGCCCTGTAGCAACTACAGCCCTAGACACCATTAACGCTGGTGGGTTCTACAGGGCTTCAAGTACTGCAACTGGGCTACCCACTGCAAACTCTACTTCAATTATTCAAAGCCAGTTCAATACTGGTGGAGCATTGCAGATTGCAGGTGCACTGACCTCTGGTGGAGGTTTGTATTGGAGGCAACAGTCTGGAGGATCTTGGGGTGTTTGGTATCAAGCTGCCAAGACTGAGTATGTAGACTCTCAAGTGAGTACACTTAACTCTGCAATCAACCTCAAGGCCAATATTGCAAGCCCCTCATTCACTGGCACTCCAACAGCGCCAACTCCAACAGCTAACGACAACAGCTCTAAGATAGCCACAACTGCGTTTGTTCAGTCTTCTAGAAGAAATTACAGTGGATCTGTGCTGAGCGTTACAACCAACACAACGTTTACAATCAGTAACTCTGGATACCTGTATCAAGCTGGTGCTGATAACTTGACTGTTACAATCCCAGTCGCCGGTACTGTGCCAGTAGGTACAACTTACAGTTTCAGAAACAATAGAAGCTCAAACTTCACAATTTCTGTCCCAACTGGCAGCATCATCGCAGATGGATCTTCAACTCCTTCAACTCTAATTCTTGCTGGTGGTGAATGGGTTGAGATCACGAACAACAACACAAGCTGGTATGTCGCAGCAAGGGGTACTCTGTCCGAAGGTTCAACGGCTGCGGAAGTTGCTTTGAAGGCTCCTTTGGCTTCACCTGCTTTTACAGGCACGCCAACAGTACCAACTGCGGCCACAGCCACAAGCAACACTCAGGCCGCCTCTACAGCGTTCGTTAAGGCTGCCCTTGCAGCTGGTAACGCCTTGAGCGCTACCACAGCTGCTCGATGGACAACAGGCCGTACAATCACCCTGACAGGCGACGTAACAGGTAGCGTGTCGATTGACGGTAGTGCAAACGTAAGCTTGGCAGCAACACTTAACTCTGGAAGCTTGACAAACTTCTACACGAAGGCTCAATCTGACGGAAGATACGTTGTTAACGGTGCAACTGGTTCAAACCTGTATGTGAACGTCACTAACAACTCGATCCCGACAATCTCTGCTGCCACTGCCTCTTTCGGAAGCAACAGCTTGAGAGTGTCTAACGGGGGTAACGGTAACGCTTCTGCTGTTCTTTCATTTGTTCGTGAAGGTACATACGCAACATGGTTTGGTCTTGATACTGACAACGAGCTGGCCTTCGGTGGTTGGTCCGATGGGGCTATCAGATACCGTCTGTGGACAGAGAAAAACTTCGTGGTTGGTAACCACATTGCTCTACAAGGTACTGGTGGAATCGGTACATACGCACTTATGGTAGTTGGCGGTGGCGGTGGTATCAACCCCGGCGATCTGGCTGCTGGCGGTAACTTGAGATACTCTTCTACAGCTGCAAGTGTTTCTGGTGCAGTTCCAGTTGGTACTTGGAGACTTATGGGCTTCGTAACTAACTCAGACGGATCTAGCTCAGACTCCGTTACACTGTGCTTGAGAATCTCTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
2a1e70f011fe7c0fe8bd38276033adb63de6d4f74d8df5642170d2ecc82e6543
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6867
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50