Protein

View in Explore

Genbank accession

YP_010740271.1 [GenBank]

Protein name

central tail fiber J

RBP type

Evidence UniProt/TrEMBL

Probability 1,00

Evidence Phold

Probability 1,00

TSP

Evidence RBPdetect

Probability 0,87

Evidence RBPdetect2

Probability 0,96

Protein sequence

MTIIYDVTGHKGGGGKQHTPQETPDSLHSLAKIRILLALGEGEFEGIPDPNELRRRVYLEGTPIQNADLSENFPGARVEFRPGTQHQDVIHGFSAVESEQSVGVKLENGTPWVRQVNDTSLDAVRIRIGIPALYTNEDNGDLVGGRIDYKIVVYTDNADPREFRFAAVGKTMSLYERDHRIELPPNVNAGWRVEVHRITADSTSAKVVNDIRVQSITEIIDARLRYPLTALLFVEFDAKAFQNIPRVSIKCKGRKVLIPNNYDPINHTYSGDWDGTFKRAWTDNPAWHWYDICITERFGLGRRIKPQMLNRYALYQIAQRCDQLVSDGNGGREIRFKNDMYIQSQTDAWTVLKDLAAIFAGMTWWGNQMLNIVSDQPVAAVSHTITNASVIDGRFDYASGSQKTRYSTFAVAYGNPKNHYEDAIATGQRVELVRRHKINRLDITAIGCTRESEAQRRGHWALISNQLDQQVSFKVGMEGLFFIPGSVVAIADTNISGGFETRGGRLLSDPGTRTVLNTDSEITFRPGDKFLVRTDSGNVETREIASVNGNKVTLKTALDADPIPDQPFCVDGDDIQLQKFRITDLEYDDSTSTFSVRGIEYNDSKYDAVDNGARLDPGIFTQVPDGVMKGPESVTITPSQISSQGQLITNVDIVFPPVKDAVVYEIQWRRTSLQNMAVQWGNDWVNIPRTASNGAHIPNVFSGNYQARVRAIGMGEISSPWVSSAITPVEGRLGGLNAPIITNAISGLHQILWKWNHNNAATDISYTELEVRKTGETEWKFLSNVPYPGSDYAQTSLEFGIYQQLRARVADKIGNLSDWSAPFEGQVSDKVDEYMKGLEDEFLTSEDGKHFQEAINTIPQGIYESMLTDAQQMFNARAEYKGIYAEIKVAYNVAADANKAVAQLETLIGTRLDDAEAAIHTLQTAQSTHEQAFAQYQQTVAAKFGEQDAAIQQVQTATADVAGVLAEYKTQVAAQFGKQSAAIEQKMTSSFNHAGGSATYSLKAGVTYNGAYYDAGMQLSVVAEGGAVKSRIAFKADQFYIMHPSNGSLSSAFIVDGGQVYIDTARIKNASINFAQITDTLQSNNWNPGSSGWRIAKDGGAEFNNVTVRGNLFATTGNFGFSGGSVTIDATGVNVPLPGGGRVKVGTW

Physico‐chemical properties

protein length:	1148 AA
molecular weight:	126398,68390 Da
isoelectric point:	5,46117
aromaticity:	0,09146
hydropathy:	-0,35758

Domains

Domains [InterPro]

DC_0014
STR
1–1148

DC_0014

IPR053171
Unmapped
7–857

IPR053171 IPR015406

IPR055385
ATT
96–222

IPR055385 IPR032876

YP_010740271.1

1 1148

Architecture

STR

ATT

STR

ATT

STR

STR 1-95 | ATT 96-222 | STR 223-343 | ATT 344-495 | STR 496-1148

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_0014	STR	DC_0014	1	1148	Novel HMM	DC_0014	Central	Low	Positional only	830 proteins / 830 hits
IPR053171	Unmapped	-	7	857	InterPro	Viral Tip Attachment Protein	-	-	-	-
IPR055385	ATT	DC_0360	96	222	InterPro cluster	Tip attachment protein J, HDII-ins2 domain	N-terminal	High	Text match	1136 proteins / 1139 hits
IPR032876	ATT	DC_0307	344	495	InterPro cluster	Tip attachment protein J	Central	Medium	Text match	1111 proteins / 1112 hits
IPR015406	RBD	DC_0135	982	1118	InterPro cluster	Tip attachment protein J, central straight fiber domain	C-terminal	High	Text match	1265 proteins / 1266 hits

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

YP_010740271.1

1 1148

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	512	512	0,9188
Central domain	513	1080	569	0,0406
C-terminal	1081	1148	67	0,8384

Note: Constraints were applied during segmentation.
Fixed 39 C-terminal predictions appearing before Central domain

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-512

Central
513-1080

C-terminal
1081-1148

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Escherichia phage PEC14 [NCBI]	2970333	Uroviricota > Caudoviricetes > Dhillonvirus >
Host	Escherichia coli [NCBI]	562	cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Genbank protein accession

YP_010740271.1 [NCBI]

Genbank nucleotide accession

NC_073051.1 [NCBI]

CDS location

range 23348 -> 26794
strand +

CDS

ATGACGATTATTTACGACGTCACGGGCCATAAAGGCGGCGGTGGCAAACAGCACACCCCACAGGAGACACCCGATAGCCTGCATTCTCTGGCTAAAATCCGCATCTTGCTTGCGCTGGGAGAAGGTGAGTTCGAAGGTATTCCAGACCCTAACGAATTACGGCGGCGCGTATATCTGGAAGGAACACCGATCCAGAATGCAGACCTGTCTGAAAACTTCCCTGGGGCGCGTGTGGAGTTCCGCCCCGGAACACAGCACCAGGATGTGATCCACGGATTTTCAGCGGTGGAAAGTGAGCAATCTGTCGGCGTAAAACTGGAAAACGGCACGCCGTGGGTGCGCCAGGTTAACGACACCAGTCTGGACGCCGTTCGCATTCGCATCGGCATTCCGGCCCTGTACACTAACGAAGATAACGGCGACCTGGTGGGCGGGCGCATCGACTATAAGATCGTTGTATATACGGATAACGCCGACCCGCGTGAGTTCAGATTCGCCGCCGTTGGTAAAACAATGTCGCTATATGAGCGCGACCACCGCATCGAATTACCGCCGAACGTGAATGCCGGCTGGCGAGTGGAGGTGCACCGCATAACGGCAGACTCCACATCGGCGAAAGTTGTTAATGATATCCGGGTGCAATCCATCACTGAGATTATCGACGCCCGCCTGCGTTACCCGCTAACCGCGCTGTTGTTTGTGGAGTTCGACGCTAAAGCGTTCCAGAACATCCCGCGCGTGTCCATTAAGTGCAAAGGTCGCAAAGTTCTAATACCGAACAACTACGACCCGATCAATCATACCTATTCCGGTGACTGGGACGGCACGTTTAAACGCGCATGGACGGATAACCCTGCGTGGCACTGGTACGATATTTGTATTACTGAGCGCTTCGGCCTCGGTCGGCGTATCAAACCGCAAATGCTAAACCGATACGCGCTCTACCAGATTGCGCAGCGCTGCGATCAGTTGGTCAGCGACGGCAACGGTGGTCGAGAAATCCGCTTTAAGAATGATATGTACATTCAGTCACAGACGGATGCCTGGACCGTGCTTAAGGATTTAGCCGCCATCTTCGCCGGAATGACCTGGTGGGGCAACCAGATGTTGAATATCGTCAGTGACCAACCGGTCGCAGCAGTGTCGCACACTATCACCAACGCCTCGGTAATTGATGGTCGATTCGACTACGCATCTGGCAGCCAGAAAACTCGCTATTCCACATTTGCGGTCGCATACGGCAACCCGAAGAACCACTATGAAGATGCCATCGCCACGGGGCAGCGCGTCGAACTGGTACGCCGCCATAAGATTAACCGTCTTGATATTACGGCGATCGGCTGTACGCGCGAATCTGAAGCGCAACGCCGCGGGCATTGGGCGCTAATATCCAACCAGCTTGACCAGCAAGTTAGTTTTAAGGTAGGCATGGAAGGGTTATTCTTTATTCCTGGTAGCGTAGTCGCGATCGCGGATACAAACATTTCTGGCGGATTCGAGACTCGCGGCGGTCGCCTGTTGTCGGACCCCGGAACGCGTACCGTGCTGAACACGGACAGCGAAATCACATTCCGCCCTGGCGACAAGTTCCTGGTGCGCACCGATAGCGGTAACGTGGAGACTCGCGAGATCGCCAGCGTCAACGGCAACAAGGTCACGCTAAAAACCGCACTGGATGCCGACCCGATTCCAGACCAACCGTTTTGCGTTGATGGCGATGATATCCAGTTGCAAAAATTCCGCATCACCGATCTGGAGTATGACGACTCTACGAGCACTTTCTCGGTGCGCGGGATTGAATACAACGATAGCAAGTATGATGCCGTTGATAATGGCGCTCGCCTTGATCCTGGTATCTTCACGCAAGTGCCAGACGGTGTAATGAAGGGGCCGGAATCCGTTACCATCACCCCGTCGCAGATCTCATCGCAAGGCCAGCTAATCACCAACGTGGATATTGTTTTCCCGCCGGTGAAGGATGCCGTTGTTTATGAAATCCAGTGGCGGCGTACAAGCCTGCAGAATATGGCGGTCCAGTGGGGTAACGACTGGGTGAATATCCCACGCACGGCGTCGAATGGCGCGCACATCCCTAACGTGTTCTCCGGCAACTACCAGGCGCGCGTCCGTGCGATCGGTATGGGCGAGATTTCATCCCCGTGGGTGTCGTCCGCCATCACGCCGGTCGAAGGTCGCCTCGGTGGGCTTAACGCACCAATCATCACCAACGCGATTTCGGGTCTGCACCAGATTCTATGGAAGTGGAACCACAACAACGCCGCTACGGATATCTCATACACCGAGCTTGAAGTGCGCAAGACGGGTGAGACGGAATGGAAATTCCTGTCCAACGTCCCATACCCAGGGTCGGATTATGCGCAAACGTCGCTGGAGTTCGGGATTTACCAGCAGTTGCGCGCCCGTGTAGCGGATAAAATCGGCAACCTGTCGGACTGGTCCGCCCCGTTCGAAGGCCAGGTTAGTGACAAAGTTGACGAGTACATGAAGGGGCTTGAAGACGAGTTCTTGACTTCCGAGGATGGTAAACACTTCCAAGAAGCCATTAATACGATTCCGCAAGGCATTTACGAATCAATGCTCACGGACGCCCAGCAGATGTTCAACGCCCGCGCCGAGTACAAAGGGATTTACGCAGAAATCAAGGTCGCATATAACGTGGCGGCAGACGCCAACAAGGCTGTCGCGCAACTGGAAACGTTGATCGGCACTCGCCTTGACGATGCGGAAGCGGCAATCCACACGTTGCAGACAGCGCAAAGCACGCACGAGCAAGCATTCGCCCAGTATCAGCAAACTGTTGCCGCTAAGTTCGGGGAACAGGACGCCGCCATCCAGCAGGTACAAACGGCAACGGCAGACGTAGCGGGCGTGCTGGCGGAGTACAAGACCCAGGTGGCGGCACAGTTCGGTAAGCAGTCTGCAGCTATCGAGCAGAAGATGACGTCTTCGTTTAATCATGCTGGGGGCAGCGCCACATATAGCCTTAAGGCTGGCGTGACGTATAACGGGGCTTACTACGATGCCGGTATGCAGCTTTCCGTCGTTGCGGAAGGCGGCGCGGTTAAATCACGCATCGCGTTCAAGGCGGACCAGTTCTACATCATGCACCCGTCGAATGGGTCGCTTTCGTCCGCGTTTATCGTTGACGGCGGACAGGTGTACATTGACACGGCGCGCATCAAGAATGCGTCCATCAACTTCGCACAGATCACGGACACGCTGCAATCCAATAACTGGAATCCGGGTAGCAGCGGCTGGCGTATCGCGAAGGATGGCGGGGCGGAGTTCAACAACGTAACGGTCCGAGGCAACTTGTTCGCGACTACGGGTAATTTCGGATTCTCCGGCGGGTCCGTTACGATCGACGCAACGGGCGTTAACGTGCCATTACCTGGCGGTGGTAGGGTGAAAGTGGGGACGTGGTAA

Genome Context

Tertiary structure

PDB ID

376c96093efabb799aebd452765e03f9a3b9403779ade11d5994bbe3ed14eb26

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,7794

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence