Genbank accession
UKL14932.1 [GenBank]
Protein name
central tail fiber J
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,77
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MNTLVETEVVKPQVLFIYIENPMQAADSRVLVAQDHDSTRTLSECLGPLEGDWAVSVSGLVIPKDQWPEVYLRENDCVVVAPLIMGGGQGGGGKQIMRLVALAALTYFTAGAAAGVAGAIGVTSAGGIALVGAGMIMAGTMAINALLPPAQPKVPTSGNDYDSSPTYGIDGPKNMSTRSIPVPVIYGECWFAGNFIQSYIDNVGDDQYLNLLINVGEGPVEGIQEIQINDQPMDNYVGVETWFRDGSENQELIPYFDDIIVPVNRSVNLTNAVYTVHSVEAPVDRLRLDFVLPAGFNHLDDEDGMGPTTVQWTAEIREVGGAWGPFTGGDSVLSVTGKQMSAARRSYYSQTLDRNKRYEIRCIHNQPTDDSNTSNKVTLSDVNYITFDDMTYKHTALLGMRIKLSDQLNGLPSVKYRIKGRKVPVYNVLTGQYIETWTDNPAWITLDVLMNKRYGGQLSANRMKMDYFRKWATFCTQNNLKFNGAIDQRTNLWDACAPICKVGRAQLVRSGTKFQVSLVRKTSPVQLFSMASIKKGSLAIDWMASDERANEVHVTYFDKGDQGKQKTVIVANEAARERGEEARPTEVTLYGVDNVDQATREGTLAMNMQQLLQTISFEAPPEAIACTLGDVIAIQHDMPDWGQGGFTDVGSTKTKLVIDKPVSMPLGGNYVVQVRHDSLLQGTWEAEAVVGNIVVPTGPFNVQMFERYRRLVTPGNGRDYEIEEAVIDQFGRHGLRLSTTAGISVGDTIQLWDTNVIETRNVATFDDERMTITPTVPFSAVPRAESPWAFGLYESVTQMLTVMNIGGKDDMWKQISGIEYKDDAYDDTVIDYRPDPINTSPEMPVVVFNGFQERRYLIGASYTSDIEMTWASSDINYSYCEVHIRIDDESWKFMDANATLYTLINISSGKIQLKLVPVTIEGFKPNFGSVPIYTYEIVGGVPRVPPVPLNFRPGVITGDIIELLWGDLDAWSASQNVYKYEVFHAGYKDARIEDAQLIAVTGNNHYPHIGLERLSWHTYWLRATNTQAANSKSQFAGPLSLQVIDNDPYGLVDLTNIANDLREAIDYPKILDDLSVIVANATTKLEEATDEQKQEVFNREQAVGDVRAYVNETVGAFADENEAQAIRLTTLEATTNASTQAKIDELTQVVVNGDSSLAQRISLMQVKFADDLSAAILTEQQARADALGAIASQVTTLNTTVGENTTSLQQTMKVVDGISGQYTLRIDVNGIVSGFGLATGAGGTSEFAIMATRFKIYGPGPGGTVVKTPIFSVNTETGVAYLRNAVVGDLSSDNYISGVSGWCLKK
Physico‐chemical
properties
protein length:1306 AA
molecular weight: 143228,86880 Da
isoelectric point:4,74403
aromaticity:0,08499
hydropathy:-0,17910

Domains

Domains [InterPro]
DC_0129
STR
2–709
IPR053171
Unmapped
215–675
IPR055385
ATT
263–386
NF040662
Unmapped
283–676
UKL14932.1
1 1306
Architecture
STR
ATT
STR
ATT
STR
RBD
STR 2-262 | ATT 263-386 | STR 387-487 | ATT 488-638 | STR 639-709 | RBD 716-1306
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
UKL14932.1
1 1306
Domain Start End Length (AA) Confidence
N-terminal 1 111 111 0,9569
Central domain 112 310 200 0,0989
C-terminal 311 1306 995 0,0728
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-111
Central
112-310
C-terminal
311-1306

Taxonomy

  Name Taxonomy ID Lineage
Phage Pseudomonas phage hairong
[NCBI]
2912595 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Pseudomonas syringae pv. actinidiae
[NCBI]
103796 Bacteria > Proteobacteria > Gammaproteobacteria > Pseudomonadales > Pseudomonadaceae > Pseudomonas

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UKL14932.1 [NCBI]
Genbank nucleotide accession
OM223115.1 [NCBI]
CDS location
range 22094 -> 26014
strand +
CDS
ATGAATACGTTGGTTGAGACTGAGGTTGTAAAACCACAAGTCCTCTTTATCTACATCGAAAACCCGATGCAGGCGGCAGACTCTCGAGTCCTGGTAGCACAGGACCACGACTCCACGCGCACGCTCTCTGAATGCCTGGGTCCGCTCGAAGGCGATTGGGCTGTATCTGTTTCTGGTCTGGTGATCCCGAAAGATCAATGGCCAGAGGTATATCTGCGCGAGAACGACTGCGTCGTAGTTGCCCCACTGATCATGGGTGGCGGGCAAGGCGGTGGCGGCAAGCAGATCATGCGACTGGTTGCTCTCGCCGCGCTGACCTATTTCACTGCTGGTGCTGCGGCCGGTGTTGCTGGTGCGATCGGCGTGACATCTGCCGGCGGTATCGCTCTGGTTGGCGCGGGCATGATCATGGCCGGTACGATGGCGATCAACGCTCTCTTGCCGCCTGCCCAGCCAAAAGTCCCAACCAGCGGCAACGACTACGACTCCAGCCCAACCTACGGCATCGACGGCCCGAAGAACATGAGTACCCGGAGCATTCCGGTACCGGTTATTTACGGCGAGTGCTGGTTTGCGGGCAACTTCATTCAGTCCTACATCGACAACGTTGGTGACGATCAATATCTCAACCTGCTGATCAACGTCGGTGAAGGCCCGGTCGAAGGCATTCAAGAGATTCAGATCAACGACCAGCCGATGGACAACTACGTTGGCGTCGAAACCTGGTTTCGTGACGGCTCTGAGAATCAGGAGCTGATCCCGTACTTTGACGACATCATCGTCCCGGTCAACCGCAGTGTGAATTTGACGAATGCCGTTTATACGGTTCACAGCGTCGAAGCACCTGTTGATCGCTTGCGTCTGGATTTCGTGCTGCCAGCCGGCTTCAACCATCTGGATGATGAAGATGGGATGGGGCCAACTACAGTTCAGTGGACAGCAGAGATTCGCGAAGTCGGTGGGGCTTGGGGGCCTTTCACTGGTGGCGACAGCGTTCTGTCGGTGACAGGCAAGCAGATGTCTGCGGCTCGTCGCAGCTACTACAGCCAGACTCTGGACCGTAACAAGCGTTACGAGATTCGCTGCATTCACAACCAGCCAACAGACGACAGCAACACCAGCAACAAGGTGACGCTCTCTGACGTCAACTACATCACCTTCGACGACATGACCTACAAGCACACCGCTTTGTTGGGCATGCGTATCAAGCTCTCTGATCAGCTCAACGGCCTGCCATCGGTCAAGTATCGAATCAAGGGTCGCAAGGTGCCGGTCTACAACGTGTTGACCGGCCAGTACATCGAGACCTGGACCGACAACCCGGCCTGGATCACTCTTGATGTCCTGATGAACAAGCGCTATGGCGGCCAGTTGTCTGCCAATCGCATGAAGATGGACTACTTTCGCAAGTGGGCGACCTTCTGCACGCAGAATAACCTCAAGTTCAACGGCGCAATCGATCAGCGCACCAACTTGTGGGATGCATGCGCGCCGATCTGCAAGGTCGGCCGGGCACAGCTCGTTCGATCTGGTACCAAGTTTCAGGTGTCGCTCGTTCGCAAGACCTCTCCGGTTCAGTTGTTCTCGATGGCCAGCATCAAGAAGGGTTCGCTCGCAATCGACTGGATGGCCAGCGACGAGCGCGCCAACGAAGTGCATGTGACCTACTTCGACAAAGGTGATCAGGGCAAACAGAAGACTGTCATCGTTGCCAACGAAGCGGCCCGCGAGCGCGGTGAAGAAGCCCGGCCGACCGAAGTGACTCTGTACGGCGTGGATAACGTCGATCAGGCCACTCGTGAAGGCACCCTGGCGATGAACATGCAGCAGCTCTTGCAGACCATCAGCTTCGAAGCGCCGCCAGAAGCAATCGCCTGCACTCTGGGCGATGTCATTGCGATTCAGCATGACATGCCTGACTGGGGTCAGGGCGGCTTCACAGACGTTGGCAGCACCAAGACTAAACTGGTGATCGACAAGCCGGTGTCGATGCCCCTGGGCGGCAACTACGTTGTTCAGGTCCGCCACGACAGCTTGCTGCAAGGAACGTGGGAAGCAGAAGCGGTTGTGGGCAACATCGTTGTCCCAACTGGCCCTTTCAACGTCCAGATGTTTGAGCGGTATCGCCGCCTGGTTACGCCTGGTAACGGGCGTGACTACGAAATCGAAGAGGCTGTGATTGATCAGTTCGGGCGACACGGCCTGCGACTGTCCACGACGGCTGGCATCAGTGTGGGCGACACGATCCAACTGTGGGACACCAACGTCATTGAGACGCGCAACGTCGCGACCTTTGATGATGAGCGCATGACGATCACCCCTACTGTCCCATTCAGCGCTGTACCGCGTGCAGAGAGCCCCTGGGCATTCGGTCTGTACGAGTCTGTCACTCAAATGCTGACCGTGATGAACATCGGCGGCAAAGATGACATGTGGAAGCAGATCAGCGGCATCGAGTACAAGGATGACGCCTACGATGACACGGTGATCGACTATCGTCCTGACCCAATCAACACCAGCCCTGAAATGCCAGTGGTCGTGTTCAATGGCTTTCAGGAACGCCGGTACCTGATCGGTGCGAGCTACACGTCCGACATCGAAATGACCTGGGCTTCCTCGGACATCAACTACAGCTACTGTGAAGTCCACATCAGGATTGACGACGAATCTTGGAAGTTCATGGACGCAAACGCGACCCTGTACACCTTGATCAACATCAGCTCTGGGAAGATTCAGCTCAAGCTGGTCCCGGTGACAATCGAAGGGTTCAAGCCGAACTTCGGGTCGGTGCCGATCTACACCTACGAAATCGTGGGTGGGGTTCCTCGTGTCCCACCAGTGCCGCTCAACTTCCGCCCAGGTGTGATCACCGGCGACATCATCGAGCTGCTGTGGGGAGACCTGGATGCATGGTCTGCATCGCAGAACGTCTACAAGTACGAAGTGTTCCATGCAGGCTACAAGGACGCTCGCATCGAAGATGCTCAACTGATCGCTGTGACCGGCAACAACCACTACCCTCACATCGGTCTTGAGCGTCTGAGCTGGCACACTTACTGGTTGCGGGCCACAAACACTCAGGCTGCAAACAGCAAGTCGCAGTTCGCCGGCCCGCTGAGCTTGCAGGTGATCGACAATGACCCATACGGTCTGGTCGACTTGACCAACATCGCCAATGACCTGCGCGAAGCGATTGATTACCCAAAAATCCTCGACGATCTGTCGGTGATCGTGGCTAACGCTACGACCAAACTGGAAGAGGCCACCGACGAGCAGAAGCAGGAAGTTTTCAACCGTGAGCAGGCGGTCGGTGATGTTCGCGCCTACGTGAATGAGACAGTTGGCGCATTCGCAGACGAGAACGAAGCCCAGGCCATTCGCCTGACTACACTCGAAGCGACCACCAACGCATCGACGCAGGCCAAGATCGACGAGCTGACCCAAGTTGTCGTGAACGGCGACAGCAGTCTGGCGCAGCGTATCTCGCTGATGCAGGTGAAGTTCGCAGACGATCTGTCCGCAGCCATCCTGACTGAGCAGCAAGCCCGCGCAGACGCATTGGGCGCGATTGCAAGTCAGGTGACAACCCTGAACACGACAGTGGGCGAGAACACCACCAGCCTGCAACAGACCATGAAGGTCGTTGACGGCATCAGTGGTCAGTACACCCTGCGAATCGACGTGAACGGGATCGTCTCGGGCTTTGGTTTGGCAACTGGCGCAGGTGGTACTTCTGAGTTCGCAATCATGGCAACCCGGTTCAAGATTTACGGACCAGGCCCAGGCGGTACTGTCGTGAAGACTCCGATCTTCTCGGTCAACACTGAAACCGGTGTTGCGTACCTGCGAAACGCAGTGGTGGGCGATCTGTCCAGTGACAACTACATTTCTGGCGTGTCGGGGTGGTGCCTAAAAAAGTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
811182e0920d5c9a06971dae961f57ba6b75d72fde0554964d8c51c2f06a09d8
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7217
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Genomic characterization of two nickie-like bacteriophages that infect the kiwifruit canker phytopathogen Pseudomonas syringae pv. actinidiae Zhang,H., Wu,H., Xia,H., Zhong,C., Li,L. and Zeng,C. 2022 — GenBank