Protein
View in Explore- Genbank accession
- WMI31845.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TFTF
- Protein sequence
-
MSIQSGPSVLNQFVPDFLIDSTPTNGQFLVYDDTVQAFVNSTNPRIVLDSSNILDGSITIDKLAISGNKVPGYVLTITSAGGMAFLPVPGNGGQLPSLDELLDTNIVSPTVTQYLKWDGSAWVNSNITLNDVSDVSVISPTADDVLAWESGSWTNKKIDYTSLTNKPDLSDVVRSSELSSVAFSGDYNDLVNIPSATSNTIVGLTDVNDTALPNGFLRWNASGDEVEFITSISATVITGLAPVATSGNYNDLLGKPNLSVYPLRTEFSTVATTGNYSDLNNVPLTFAPSAHTHPAAQITGLASVATSNDYNDLVNKPTAMAPTAHTHAISDIIGLQNSLDSKLTVNLTTRLPKDVIYFNGTSWINKQLSYTDISGTPNLDNYVTDSELSTVATTGRYSDLINKPELVENLNDLLDVDVSSKQTGNVLTWNGTAWVASAITQASIDWANISNKPSVFSPAAHTHDVVDVLGLQSLLDSKLDANIAFDGDYNSLTNKPGLIDLQDTFSPAVPNGFLRWNNLGTLVAYQDYIYPQDISGLSDVAISGQYSDLLGTPSLSTVAITGSYSDLIDAPPAFDGDYDSLTNKPFIPTNFDFKFIGLNDVSPTVQPGGYLKWNLDGSFVVSSANIPATDVAGLSVVSTTGQYSDLLGKPLLATVSSSGSYTDLINIPTEFNPAEHTHNIADVSGLQASLDNKLNTSDAFSGDYNDLTNAPTNSSYSLVGLSDTNSVPVANGFLRWNASGSSVEYIQTIPVNAITGLAPVASSGQYADLQGTPDLSDYVLSVSLADIATTGEYSDLINAPDLSVYANKTDLSDVATTGQYSDLLGIPTQFTPTVHVHNVSQISGLSTVATSGSYNDLSNKPSFANVATTGSYDDLNNKPSIPTNGSFSLLGLNDTNNTPVADGILRWNSSANQVIYANTIDAQSVSGLATVATIGKLSSLSDVDLIGLNQNEILQWNGSAWVPVPYNPNQIQAYIESGNTKVSTNDILDSIVLTAGPTTGNIIFELGNTNSSIILNPVANNVDALISSTSRIKLDSSTGISLGNISYPMTDGTVGQAVVTNGAGQLSFETVVKPSQLATVATSGNYNDLTNKPTLVTELNGLADVRMRDTNGNYLAQPEDVLTYSNGIWQARPNTSSSFIGLSDTQNITLPEDRANAYLRWDTTGNLIIYEDSISASVIAGLAEVATTGDLHDLINVNVNLPDMNNPATQAVWGLIWDRQNQRWINYNLRNIAGSGGSTVVALNDLTDVTLTFPVVDGNVLRATVQPDNSIVWQNKQLSYSDLTGTISMSLLQLTDTSSSAVPNGFLRWDSSGSTVQYITTISTNDITGLAPVATSGNYNDLSNTPAIPASINDLADVNTVSPVPTNGYVLTWDSSSNNWIAKEPATNPSGSTALADLTDVSLSDLAASDVLKYNGTTWVNEPVTYSELTDLPTFALVAFSGDYNDLTNKPSGSTTSILDLTDTADTALPNGFLRWNASGDEVLYQSSINVSDIIGLSGVAISGDYNDLSNKPENNSYYFRKLADAGNPQPNTFIKYPAFTIPPGSDIDDVNPILEYVSSINALTDIDNLAPVATNGILGSLVDVNLNSVEDGQVLTYDAVTNSWINKNSSGSPVVTSWTKINGNYTVTGSEYLLVDTTSASVTITLPVAPTENMVIRIADWKGTFRTNSCVVNTNGMPLMGASMDNTLTIQNQNASIELTFVDTTYGWKITDGIGEISKQNIPVTNWRTVDSSSTPAMLIAQPGEAIYVNTNNGAVTVKLPTGASVNAVVRIADLLGTYDKASCFVDGNGNPIMGKNEILEIANENASIEFTYVDSVVGWKVTDGIGELGRKTDIASDSDIIVYVATDGNDTTGSGTEESPFATLNAAFLSLDGKFVNSSAEIIVRVAEGVYEPTNPVAFSHIQGMNVKLIGELPQASSLFTVTNITNDAGLAKVTMQLSSVSDYEVGDIIKITSAATMLECVEIITAINTGSNTLEIVIPNSVLADVSDYTGYTGTISKFTTVFKNTNMYVAGGYSLGFIDNIALVDDTGLGTALTVGRTYTTGIYDGPAYVGLGANFAVYGYETAIQSIPGSSVVLAGNLCRQAGAAIRADGSILSFNAGQSVYIANQAQDGIVLKHGSKLIHNDDASQSFVFVIFNNIKSGTILSLDTSISTANFEVKNSEGIMIAATRHSTVDARSAIVSGTITGDLEVNATGMSVISINEPADSTDIPLAVVCNPAYGSNIELQKGYIGL
- Physico‐chemical
properties -
protein length: 2236 AA molecular weight: 236441,96660 Da isoelectric point: 4,08527 aromaticity: 0,07424 hydropathy: -0,02648
Domains
Domains [InterPro]
DC_0165
STR
1–265
STR
1–265
PF12789
STR
324–347
STR
324–347
DC_0165
STR
693–785
STR
693–785
1
2236
Architecture
STR 1-265 | ATT 321-592 | STR 593-862 | STR 880-1118 | ATT 1119-1394 | STR 1395-1841 | RBD 1842-2236
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Pseudomonas phage Callisto [NCBI] |
3061955 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Pseudomonas aeruginosa [NCBI] |
287 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Pseudomonadales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WMI31845.1
[NCBI]
Genbank nucleotide accession
OR142618.1
[NCBI]
CDS location
range 104981 -> 111691
strand +
strand +
CDS
ATGAGTATACAATCAGGTCCTTCTGTATTAAATCAATTTGTTCCAGATTTTCTGATAGATAGTACACCAACTAATGGTCAATTTTTAGTTTATGACGATACTGTCCAGGCATTTGTAAATAGCACAAATCCCAGAATCGTATTAGATTCGTCTAATATATTAGACGGTTCTATAACAATTGATAAACTTGCAATATCTGGTAATAAAGTACCTGGATACGTACTAACTATAACTTCCGCAGGCGGAATGGCATTTTTACCAGTGCCCGGCAACGGCGGTCAGCTACCTAGTCTAGATGAATTACTAGACACAAATATAGTATCTCCTACTGTAACCCAATATCTTAAATGGGACGGTTCTGCATGGGTTAATAGTAATATAACATTAAATGATGTATCAGATGTCTCTGTTATCTCCCCTACAGCCGATGATGTATTAGCATGGGAATCAGGTTCTTGGACAAATAAGAAAATAGATTATACATCACTAACAAACAAACCAGATTTGAGTGATGTAGTTAGATCTAGCGAATTGTCATCAGTTGCATTCAGTGGTGATTATAATGATTTAGTAAATATTCCCAGTGCAACTTCTAATACTATAGTTGGATTAACAGATGTTAACGATACTGCACTACCCAACGGATTCTTGCGCTGGAACGCAAGCGGTGATGAGGTAGAATTTATTACTTCAATTTCTGCTACTGTAATAACCGGGTTAGCTCCAGTTGCTACTAGTGGAAATTATAATGACTTATTAGGAAAACCTAATTTGTCAGTGTATCCGCTTAGAACTGAATTTTCTACTGTTGCAACCACCGGTAATTATTCTGATTTGAACAATGTGCCTTTGACATTTGCACCAAGTGCGCATACTCACCCGGCTGCACAAATCACAGGATTGGCATCTGTAGCTACTAGCAACGATTATAACGATTTAGTTAATAAACCGACTGCAATGGCGCCAACCGCACATACGCATGCTATATCTGATATTATAGGATTGCAAAATTCGCTAGATAGTAAATTGACTGTCAATTTAACTACTAGACTTCCAAAAGATGTTATTTATTTTAACGGCACTTCATGGATAAACAAGCAATTATCTTATACTGATATTTCCGGTACTCCTAACTTAGATAACTATGTTACTGATTCAGAATTATCTACTGTTGCTACAACTGGCAGATATTCTGATTTAATAAATAAACCCGAGTTAGTAGAAAATTTAAACGACTTATTAGATGTAGATGTTTCTTCTAAACAAACAGGGAACGTATTAACCTGGAACGGAACAGCATGGGTTGCTAGTGCAATAACACAAGCAAGCATAGATTGGGCTAATATAAGCAATAAACCAAGCGTTTTTAGCCCCGCTGCGCATACACACGACGTAGTAGACGTACTAGGCCTGCAAAGTTTACTAGACAGTAAACTTGACGCAAATATTGCATTCGACGGCGATTATAATAGTTTAACAAATAAACCGGGGTTAATAGATCTTCAAGATACATTTAGTCCTGCTGTGCCTAATGGATTCTTACGGTGGAATAATTTAGGTACCTTAGTTGCATATCAAGATTACATATATCCGCAAGATATTTCAGGATTGTCAGATGTTGCTATATCGGGTCAGTATTCAGATTTATTGGGTACCCCTTCCTTATCGACTGTTGCTATAACCGGGAGTTATAGCGACTTAATTGATGCGCCGCCTGCGTTTGACGGCGATTATGATAGTTTAACAAATAAACCGTTTATTCCTACTAATTTTGATTTTAAATTTATAGGTTTGAATGATGTAAGTCCCACAGTTCAGCCCGGTGGCTATTTAAAATGGAACTTAGACGGTTCATTTGTTGTATCGTCAGCAAACATTCCTGCAACAGATGTAGCAGGATTGTCTGTTGTGTCTACAACCGGACAATATTCGGATTTATTAGGCAAACCGTTATTAGCTACAGTTTCTTCATCAGGTAGTTATACTGATTTAATAAATATTCCTACTGAATTTAATCCAGCCGAACATACCCACAATATAGCAGACGTATCCGGATTACAGGCATCCCTAGATAATAAATTAAATACCTCTGATGCATTTAGTGGTGATTATAATGATTTAACTAACGCACCTACTAATAGTTCATATTCATTAGTGGGATTATCAGATACTAATTCTGTACCTGTTGCAAACGGATTCTTACGCTGGAATGCATCTGGAAGTAGTGTTGAATATATTCAAACAATTCCTGTAAATGCAATAACTGGATTGGCTCCTGTCGCATCATCTGGCCAGTATGCAGATTTGCAAGGAACACCGGATTTATCTGATTATGTTTTATCTGTATCATTAGCTGACATAGCTACAACTGGAGAATATTCAGATTTAATAAATGCACCCGATTTAAGTGTGTATGCTAATAAAACTGATCTGTCAGATGTAGCTACAACAGGACAATATTCGGATTTGTTGGGTATTCCTACGCAATTTACACCGACAGTTCATGTCCATAACGTTTCTCAAATAAGTGGATTATCTACAGTTGCTACTAGCGGAAGTTATAATGATTTATCTAATAAACCGTCGTTTGCTAATGTTGCAACAACAGGCAGCTATGATGATCTAAACAATAAACCATCCATACCTACTAATGGCAGTTTTAGTTTACTTGGGTTAAATGATACGAATAATACGCCAGTTGCAGATGGTATATTGCGTTGGAATTCCAGTGCAAATCAGGTAATATATGCAAATACAATCGATGCACAATCTGTTTCTGGATTAGCTACTGTTGCGACTATAGGTAAACTATCTTCACTAAGTGATGTTGATTTAATAGGTTTGAACCAGAATGAAATATTGCAGTGGAACGGTTCTGCATGGGTACCTGTACCTTATAATCCTAATCAAATACAAGCTTACATAGAGAGCGGAAATACAAAAGTTTCTACTAACGATATTTTAGATAGCATTGTTCTAACAGCAGGACCTACCACTGGAAATATAATATTCGAGTTAGGAAATACAAATAGCTCAATTATTCTAAATCCAGTTGCTAATAACGTAGATGCTCTTATTTCTTCTACTTCTAGAATAAAATTAGATTCATCCACTGGCATATCATTAGGTAATATAAGTTATCCAATGACCGACGGTACAGTTGGACAAGCAGTAGTTACAAATGGAGCTGGCCAACTATCGTTTGAAACGGTAGTTAAACCCTCTCAATTGGCTACAGTTGCTACTAGTGGAAATTATAATGACTTAACTAATAAACCTACATTAGTAACCGAACTAAACGGACTTGCTGACGTTCGTATGCGTGATACTAATGGAAATTATTTAGCACAACCAGAGGATGTGTTAACATATTCTAACGGAATATGGCAAGCACGACCGAACACTAGTTCTTCTTTTATAGGTTTAAGCGATACCCAAAATATAACATTGCCGGAAGATAGGGCCAATGCATACCTACGTTGGGATACTACTGGAAATCTAATTATATACGAAGATAGTATTTCTGCAAGCGTAATTGCCGGATTAGCAGAAGTAGCAACCACAGGAGATTTGCACGATTTAATAAATGTAAATGTAAATTTACCTGATATGAACAATCCAGCTACACAAGCTGTTTGGGGTTTAATATGGGATCGTCAGAATCAACGTTGGATAAATTACAATTTACGTAATATAGCAGGTTCGGGTGGATCTACAGTAGTAGCATTAAATGACTTAACTGATGTTACTCTTACTTTCCCTGTAGTTGACGGTAATGTTCTTAGAGCAACTGTGCAACCAGACAATAGTATTGTTTGGCAGAACAAACAACTATCTTATAGTGACTTAACTGGAACTATAAGTATGAGTCTGTTGCAATTAACTGATACTAGTTCATCTGCTGTACCTAATGGATTCTTGCGGTGGGACTCGTCGGGTAGTACAGTTCAGTATATTACTACAATAAGTACAAATGATATAACTGGGTTAGCTCCGGTTGCTACTAGTGGAAATTATAATGACTTATCTAATACACCTGCTATACCGGCATCAATTAACGATTTAGCAGATGTTAATACCGTTAGTCCTGTTCCTACAAACGGATATGTATTAACATGGGATAGTAGTTCGAATAATTGGATTGCAAAAGAACCTGCAACTAACCCATCTGGTAGTACAGCCCTAGCTGATCTAACAGATGTATCTCTATCTGATCTAGCTGCTAGTGATGTTTTAAAATACAACGGCACTACATGGGTAAACGAACCAGTTACGTATTCTGAATTAACAGATTTACCTACATTTGCGTTAGTTGCATTTAGTGGTGATTATAATGATTTAACTAATAAGCCATCGGGATCTACTACATCTATACTAGATCTAACTGATACTGCAGATACTGCACTACCTAACGGATTCTTGCGCTGGAACGCAAGCGGTGATGAGGTTTTATATCAATCATCTATTAATGTTTCTGATATAATAGGATTATCCGGTGTAGCTATAAGTGGTGATTATAACGATTTATCCAACAAACCGGAAAATAATTCGTATTATTTTAGAAAGTTAGCTGATGCAGGAAATCCGCAGCCTAATACATTTATAAAATATCCTGCGTTTACTATTCCGCCCGGTAGTGATATAGACGATGTTAATCCTATACTCGAATATGTAAGTAGCATAAATGCACTAACTGACATAGATAACCTAGCTCCGGTTGCCACTAACGGAATACTAGGAAGTTTAGTAGACGTAAATCTAAATTCAGTAGAAGACGGACAAGTTCTTACTTATGATGCTGTAACAAATAGCTGGATAAACAAAAATAGTTCAGGATCGCCGGTAGTAACTTCGTGGACAAAGATAAATGGCAACTATACTGTAACTGGTTCAGAATATTTATTGGTAGATACAACTTCTGCTAGTGTAACAATTACTCTGCCTGTTGCCCCTACCGAAAATATGGTAATTCGTATTGCTGATTGGAAAGGTACATTTAGAACAAATAGTTGCGTAGTGAATACTAATGGCATGCCTTTAATGGGTGCCAGCATGGATAACACACTAACTATTCAGAACCAAAATGCAAGTATAGAGTTAACATTTGTAGACACAACGTACGGTTGGAAAATAACAGATGGTATAGGTGAGATATCTAAACAAAACATTCCAGTTACGAATTGGCGTACTGTAGATTCATCTAGCACTCCTGCTATGCTAATAGCTCAACCGGGCGAAGCAATTTATGTTAATACCAACAATGGTGCAGTAACTGTTAAATTACCGACAGGAGCAAGTGTTAACGCTGTTGTTAGAATAGCTGACTTGTTAGGTACTTACGATAAAGCAAGTTGCTTTGTAGATGGCAACGGCAACCCAATAATGGGTAAAAACGAAATATTAGAAATTGCAAACGAAAATGCTTCTATAGAATTTACATACGTCGATTCGGTAGTAGGGTGGAAAGTAACAGACGGCATAGGTGAGTTAGGTAGAAAAACTGATATTGCATCTGATTCGGATATAATAGTTTATGTAGCTACAGACGGTAACGACACTACAGGAAGTGGAACCGAAGAATCTCCATTTGCTACATTAAATGCTGCTTTCCTTAGTCTAGATGGCAAATTTGTAAATAGTTCTGCAGAAATTATAGTTCGTGTTGCAGAAGGTGTCTACGAACCTACCAATCCTGTTGCGTTTAGTCACATTCAGGGAATGAATGTAAAACTTATAGGCGAATTGCCCCAAGCAAGTAGTTTATTCACTGTTACTAATATAACCAATGATGCAGGATTGGCAAAAGTAACAATGCAACTTTCTTCTGTCAGTGACTACGAAGTAGGGGACATTATAAAGATTACGTCGGCAGCAACTATGTTAGAATGTGTTGAAATTATAACAGCAATAAACACAGGATCTAATACTTTAGAGATAGTAATTCCTAATAGTGTATTAGCCGATGTATCTGACTATACTGGGTACACCGGAACTATATCTAAATTCACTACAGTATTTAAAAATACAAACATGTATGTAGCTGGCGGATATTCGTTAGGTTTCATAGATAACATAGCGTTAGTAGACGATACTGGATTAGGAACTGCACTTACTGTAGGAAGAACATATACCACAGGTATATATGATGGACCTGCGTATGTTGGTTTAGGTGCAAACTTTGCAGTATATGGATACGAAACTGCAATACAATCTATACCGGGTTCCAGTGTAGTATTGGCAGGAAATCTATGCAGGCAAGCAGGCGCTGCAATCCGTGCAGACGGTTCTATATTGTCATTTAATGCCGGACAATCTGTTTATATTGCAAACCAAGCACAAGATGGTATTGTGTTAAAACACGGAAGTAAACTAATACACAACGACGATGCTAGTCAATCGTTTGTATTTGTGATATTCAATAATATCAAATCCGGCACAATCCTGTCGTTAGATACAAGTATATCTACTGCTAATTTTGAAGTTAAAAACTCAGAAGGCATAATGATAGCTGCAACCAGACATAGTACAGTTGATGCTAGATCAGCTATTGTATCTGGAACAATAACGGGCGATTTAGAAGTAAATGCAACAGGCATGTCTGTAATCAGCATAAACGAACCTGCAGACAGTACAGATATACCATTAGCAGTTGTTTGTAATCCTGCTTATGGATCTAATATAGAATTACAAAAAGGTTACATAGGATTATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
76375a330909aec41ca992e3d0fa721b23c85b2867686fe5e10f2194f48af1bb
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50