Protein

View in Explore

Genbank accession

WZB34829.1 [GenBank]

Protein name

central tail fiber J

RBP type

Evidence Phold

Probability 1,00

TSP

Evidence RBPdetect

Probability 0,50

Evidence RBPdetect2

Probability 0,96

Protein sequence

MGAVHQHLAGRKGGSSKPKQPSIARDSLQSVATAKLLLAVGEGEFAEGPSDQDIYLDNTPLMDASGNVNFPNVKWEWRSGSVDQDYIPGIPSVENETTVNVELRSDTPWVRSVTNAQLSAVRLRFAWPALQKQESSGDVTGYRIEYAVDVSTDGGAYQQVLLDAVDGKTTSRYERSQRIDLPAATTGWQVRVRRITPNQNSSLIADTMLIAGLTEVIDAKLRYPNTALLYIEFSAEQFSNIPAVTVECKARKVQVPTTYDPELRTYTGVWDGSFKSAWTNNPAWITYDISTNARFGLGKRIKPWMVDKWELYKIAQYCDQLVPDGKGGQEPRFLCDLNLQSRSQAWTLLRDIAAIYRGMSYWAQGQLVSQADMPRTADFDYVFTRANVIDGKMTYGAASARTRYSRALVSYDNPANNYDTDVTGYSDAPLLRRYGDNPVELSAIGCTRESEAQRRGKWAVLTSVQDRTITFATGMEGRIPLPGYIIPVADSLLAGREIGGRISAVAGRVVTLDRVTQAKAGDRLIINLPSGRAEGRTVQSVNGKVVTVTAAYSETPEPELCWALDADDLAVQLYRVMSTKRDENGQWTINGLQYEPSKFDHIDTGARLEERPISIIPVTTVQPPASVTLSSRWTIDQGLAVSTMTITWPAAEGAVAYDVEWKKDSGNWIRLPRAGTTSVDVTGIYAGGYLARVRAVSAFDITSVWKSSILTQLSGKTGAPPALAFLRTTSGPWKIGLEWGFPASGAADTAYTEIQQSVTPGGSEQNATALGLFAYPTDTHTLTSLAAGARLAFRGRLIDRTGNVGPWSAWVDGISSTDASEYNELITKEYVESALGEQFFENIEQIGGNVDQLMEQYYDAGTVYQKGQIVRLNGRFYQALQDVPAGNPPPNPVYWADVGELVESVDALALRVTENAAAIEELDGVVQSSASSLDVLQAAARREPATGEKADALKGWDTIARAATEVIVRANEIEAQAKRVETVQAQTSANGAAIQTTQSVVASLDQGVKAMYSVKLQAHANGQSYAAGWQLGFDSGTSVTTMAFQADRFLWFNSSSGQTVAPVSIVGGQMFINNAMIQDGSITNAKIGNVIQSTALGANGEPLWKLDKAGSLTMNSATSGGFMRQTAEAVKVYDANLVLRVQIGNLDA

Physico‐chemical properties

protein length:	1148 AA
molecular weight:	124552,06320 Da
isoelectric point:	5,10996
aromaticity:	0,08362
hydropathy:	-0,25017

Domains

Domains [InterPro]

DC_0014
STR
1–1148

DC_0014

IPR053171
Unmapped
5–939

IPR053171 IPR015406

IPR055385
ATT
93–219

IPR055385 IPR032876 G3DSA:2.10.10.20

WZB34829.1

1 1148

Architecture

STR

ATT

STR

ATT

STR

ATT

STR

STR 1-92 | ATT 93-219 | STR 220-340 | ATT 341-505 | STR 506-856 | ATT 857-900 | STR 901-1148

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_0014	STR	DC_0014	1	1148	Novel HMM	DC_0014	Central	Low	Positional only	830 proteins / 830 hits
IPR053171	Unmapped	-	5	939	InterPro	Viral Tip Attachment Protein	-	-	-	-
IPR055385	ATT	DC_0360	93	219	InterPro cluster	Tip attachment protein J, HDII-ins2 domain	N-terminal	High	Text match	1136 proteins / 1139 hits
IPR032876	ATT	DC_0307	341	505	InterPro cluster	Tip attachment protein J	Central	Medium	Text match	1111 proteins / 1112 hits
G3DSA:2.10.10.20	ATT	G3DSA:2.10.10.20	857	900	Merged direct domain	G3DSA:2.10.10.20	N-terminal	Low	Positional only	19 proteins / 19 hits
IPR015406	RBD	DC_0135	993	1126	InterPro cluster	Tip attachment protein J, central straight fiber domain	C-terminal	High	Text match	1265 proteins / 1266 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

WZB34829.1

1 1148

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	539	539	0,8416
Central domain	540	1015	477	0,0353
C-terminal	1016	1148	132	0,3671

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-539

Central
540-1015

C-terminal
1016-1148

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Pseudomonas phage vB_Pae_U2 [NCBI]	3126746	Viruses >
Host	Pseudomonas aeruginosa [NCBI]	287	cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Pseudomonadales

Coding sequence (CDS)

Genbank protein accession

WZB34829.1 [NCBI]

Genbank nucleotide accession

PP003914.1 [NCBI]

CDS location

range 2085 -> 5531
strand -

CDS

ATGGGCGCAGTTCACCAGCACCTGGCCGGCCGCAAGGGCGGCAGTAGCAAGCCCAAGCAACCGTCGATCGCGCGCGACAGCCTGCAGTCGGTGGCCACCGCCAAGCTTCTGCTGGCGGTGGGCGAGGGCGAGTTCGCCGAGGGGCCGAGCGACCAGGACATCTACCTGGACAACACCCCGCTGATGGACGCCAGCGGCAACGTCAACTTCCCCAACGTGAAGTGGGAATGGCGCAGCGGCAGTGTCGATCAGGACTACATCCCCGGCATCCCCTCGGTGGAGAACGAGACCACGGTGAACGTGGAGCTGCGCAGCGACACTCCGTGGGTGCGTTCGGTGACCAACGCCCAGTTGTCCGCCGTGCGCCTGCGCTTCGCCTGGCCGGCCCTGCAGAAGCAGGAGAGCAGCGGGGACGTGACGGGCTACCGGATCGAGTATGCCGTAGATGTCAGCACCGACGGCGGCGCCTACCAGCAGGTGCTGCTGGATGCTGTCGACGGCAAGACCACCAGCCGCTATGAGCGGAGCCAGCGCATCGACCTGCCGGCGGCGACCACTGGCTGGCAGGTGCGCGTGCGCCGGATCACGCCGAACCAGAACAGCAGCCTGATCGCCGATACCATGCTGATCGCAGGTCTGACTGAGGTGATCGACGCGAAGCTGCGCTACCCAAACACAGCTCTGCTCTACATCGAGTTCAGCGCAGAGCAGTTCAGCAACATTCCGGCCGTCACCGTCGAGTGCAAGGCGCGCAAGGTCCAAGTGCCGACCACCTACGACCCGGAGCTGCGCACGTACACCGGCGTCTGGGATGGCAGTTTCAAGAGCGCCTGGACCAACAATCCCGCGTGGATCACCTACGACATCAGCACCAACGCGCGCTTCGGCCTGGGCAAGCGGATCAAGCCCTGGATGGTGGACAAGTGGGAGCTCTACAAGATCGCCCAGTATTGCGACCAATTGGTGCCAGACGGGAAGGGCGGCCAGGAGCCGCGCTTTCTGTGCGATCTGAACCTGCAGTCGCGCTCCCAGGCATGGACGCTGCTGCGGGATATCGCGGCGATCTATCGGGGTATGAGCTATTGGGCGCAGGGCCAGCTTGTGTCGCAGGCCGACATGCCGCGCACTGCCGACTTCGACTACGTGTTCACCCGGGCGAATGTGATTGACGGGAAGATGACCTACGGCGCCGCCTCGGCTCGCACCAGATACAGCCGCGCCCTCGTCAGCTACGACAACCCGGCGAACAACTACGACACCGACGTGACGGGCTATTCCGACGCGCCGTTGCTGCGTCGCTATGGCGACAACCCGGTGGAGCTGTCTGCCATCGGATGTACGCGAGAGAGCGAGGCGCAGCGGCGCGGAAAGTGGGCGGTGCTGACCAGCGTGCAGGACCGCACCATCACCTTCGCCACCGGTATGGAAGGCCGGATTCCGCTGCCGGGCTACATCATCCCGGTGGCTGACTCTCTGCTGGCCGGCCGCGAGATTGGCGGCCGGATCTCGGCTGTTGCTGGCCGCGTGGTAACGCTCGATCGCGTCACTCAAGCCAAGGCCGGTGATCGCCTGATCATCAACCTGCCGAGCGGGCGCGCCGAGGGCCGGACGGTGCAGTCGGTCAACGGCAAGGTCGTCACCGTCACCGCGGCCTACTCGGAGACGCCGGAGCCGGAACTGTGCTGGGCGCTCGACGCCGATGACCTAGCTGTCCAGCTCTATCGGGTGATGAGCACCAAGCGTGACGAAAACGGCCAGTGGACCATCAACGGCCTGCAGTACGAGCCGAGCAAGTTCGACCACATCGATACCGGCGCACGGCTGGAGGAGCGCCCGATCAGTATCATCCCGGTCACCACCGTGCAGCCACCGGCCAGCGTCACGCTCTCGTCGCGCTGGACAATCGACCAGGGGCTGGCGGTGAGCACCATGACGATCACCTGGCCGGCAGCGGAGGGCGCCGTCGCCTACGACGTGGAATGGAAGAAGGACAGCGGCAACTGGATCCGCCTGCCGCGTGCCGGTACCACCAGCGTCGATGTGACCGGTATCTACGCAGGTGGCTATCTGGCGCGAGTGCGTGCGGTTTCGGCCTTCGACATCACGTCGGTCTGGAAGAGCTCGATCCTGACCCAGCTCAGCGGCAAGACCGGCGCGCCGCCGGCGCTGGCGTTCCTGCGTACCACCAGCGGACCGTGGAAGATCGGCCTGGAGTGGGGATTCCCGGCCAGTGGCGCGGCGGACACCGCCTACACCGAGATCCAACAGTCGGTCACCCCGGGCGGCAGCGAACAGAACGCAACTGCCCTGGGCTTGTTCGCATACCCGACCGACACCCACACGCTGACCTCGCTGGCGGCCGGCGCTCGCCTGGCCTTCCGCGGGCGGCTGATCGACCGGACCGGCAACGTCGGCCCATGGTCGGCCTGGGTCGACGGCATCAGCTCGACGGATGCGAGCGAGTACAACGAACTGATCACCAAGGAGTACGTCGAGTCCGCACTGGGCGAGCAGTTCTTCGAAAATATCGAGCAGATCGGCGGTAACGTCGACCAGTTGATGGAGCAGTACTACGACGCCGGCACGGTATACCAGAAGGGCCAGATCGTTCGATTGAACGGCAGGTTCTATCAAGCCCTCCAGGACGTTCCCGCGGGCAATCCGCCGCCGAACCCCGTTTACTGGGCTGATGTGGGCGAGCTCGTCGAATCGGTCGATGCCCTTGCGTTACGCGTGACTGAGAATGCGGCCGCGATTGAAGAGCTCGACGGCGTTGTTCAGTCCAGTGCCTCCAGCCTGGACGTGCTGCAAGCTGCCGCGCGCCGGGAGCCGGCTACCGGCGAGAAAGCGGATGCGCTGAAGGGGTGGGACACCATTGCTCGAGCAGCCACCGAGGTCATCGTGCGCGCGAATGAGATCGAGGCGCAGGCGAAGCGTGTAGAGACCGTCCAGGCGCAAACGAGCGCCAACGGGGCCGCGATTCAGACCACACAGAGCGTTGTAGCGTCACTGGATCAGGGCGTGAAGGCGATGTACAGCGTAAAGCTCCAGGCCCATGCCAATGGGCAGTCGTACGCCGCTGGCTGGCAACTGGGCTTCGACAGCGGCACGAGCGTGACGACCATGGCGTTCCAGGCTGATCGGTTCCTCTGGTTCAACAGTTCCAGCGGGCAGACCGTGGCGCCGGTCTCGATCGTCGGAGGCCAGATGTTCATCAACAACGCGATGATTCAGGACGGTTCGATTACGAACGCGAAGATCGGCAACGTGATTCAGTCGACCGCACTCGGTGCCAACGGCGAGCCGCTGTGGAAGCTTGATAAAGCAGGGAGTTTGACGATGAACAGCGCAACGTCCGGAGGCTTCATGAGGCAGACAGCGGAGGCCGTTAAAGTCTACGACGCGAACCTGGTGTTACGGGTACAGATCGGGAATCTCGACGCATGA

Genome Context

Tertiary structure

PDB ID

29090a68cf374e5e36c0ffa7c1d6124b87aebde97cab1834bd1854332ac02702

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,7966

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence