Protein
View in Explore- Genbank accession
- UYE91775.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MGKGSSKGHTPREAKDNLKSSQMLSVIDAISEGPVEGPVDGLKSVLLNSTPVLDSEGNTNISGVTVVFRAGEQEQTPPEGFESSGSETVLGTEVKYDTPITRTITSANIDRLRFTFGVQALVETTSKGDRNPSEVRLLVQIQRNGGWVTEKDITIKGKTTSQYLASVVVDNLPPRPFSIRMRRMTPDSTTDQLQNKTLWSSYTEIIDVKQGYPNTALVGVQVDSEQFGSQQVSRNYHLRGRILQVPSNYNPQTRQYSGIWDGTLKPAYSNNMAWCLWDMLTHPRYGMGKRLGAADVDKWALYVIGQYCDQSVPDGFGGTEPRITCNAYLTTQRKAWDVLSDFCSAMRCMPVWNGQTLTFVQDRPSDKVWTYNRSNVVMPDDGAPFRYSFSALKDRHNAVEVNWIDPDNGWETATELVEDTQAIARYGRNVTKMDAFGCTSRGQAHRAGLWLIKTELLETQTVDFSVGTEGLRHVPGDVIEICDDDYAGISTGGRVLAVNSQTRTLTLDREITLPASGTTLISLVDGQGSPVSVEVQSVTDGVKVKVSRVPDGVAEYSVWGLKLPTLRQRLFRCVSIRENDDGTYAITAVQHVPEKEAIVDNGAHFDGDQSGTVNGVTPPAVQHLTAEVTADSGEYQVLARWDTPKVVKGVSFMLRLTVAADDGSERLVSTARTTETTYRFTQLAPGNYRLTVRAVNAWGQQGDPASVSFRIAAPAAPSRIELTPGYFQITATPHLAVYDPTVQFEFWFSEKRIADIRQVETTARYLGTALYWIAASINIKPGHDYYFYIRSVNTVGKSAFVEAVGQPSDDASGYLDFFKGEIGKTHLAQELWTQIDNGQLAPDLAEIRTSITDVSNEITQTVNKKLEDQSAAIQQIQKVQVDTNNNLNSMWAVKLQQMQDGRLYIAGIGAGIENTPDGMQSQVLLAADRIAMVNPANGNTKPMFVGQGDQIFMNDVFLKRLTAPTITSGGNPPAFSLTPDGKLTAKNADISGSVNANAGTLNNVTVNENCTIKGMLEATQVRGDFVKAVSKSFPKQAGTWGNTETPNGTVTVTISDDHNFDRQIIIPPIIFNGIAYSDPGSGNNPGGTRYTGYGFEVRKNGVLIASRETKGAIPGSYSAVIDMPSGRGSVTLEFKVFHKGNQRAGNITDCTVIVTKKAASGISIR
- Physico‐chemical
properties -
protein length: 1165 AA molecular weight: 127144,16180 Da isoelectric point: 5,72786 aromaticity: 0,07811 hydropathy: -0,33871
Domains
Domains [InterPro]
IPR053171
Unmapped
1–837
Unmapped
1–837
DC_0014
STR
1–1162
STR
1–1162
IPR055385
ATT
86–207
ATT
86–207
IPR036116
STR
617–717
STR
617–717
IPR003961
STR
618–701
STR
618–701
IPR003961
STR
618–710
STR
618–710
IPR003961
STR
620–715
STR
620–715
IPR013783
STR
648–717
STR
648–717
1
1165
Architecture
STR 1-85 | ATT 86-207 | STR 208-330 | ATT 331-498 | STR 499-715 | ATT 716-818 | STR 819-1164 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1165
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 1024 | 1024 | 0,8989 |
| Central domain | 1025 | 1154 | 131 | 0,1306 |
| C-terminal | 1155 | 1165 | 10 | 0,9790 |
Note: Constraints were applied during segmentation.
Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-1024
1-1024
Central
1025-1154
1025-1154
C-terminal
1155-1165
1155-1165
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage phi458 [NCBI] |
2982894 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Escherichia coli MC1061 [NCBI] |
1211845 | Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Escherichia > Escherichia coli |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
UYE91775.1
[NCBI]
Genbank nucleotide accession
OP434518.1
[NCBI]
CDS location
range 33102 -> 36599
strand +
strand +
CDS
ATGGGTAAAGGCAGCAGTAAGGGGCATACCCCGCGCGAAGCGAAGGACAACCTGAAATCATCCCAGATGCTGAGCGTGATAGACGCCATCAGCGAAGGGCCGGTTGAAGGTCCGGTGGATGGATTAAAAAGCGTGCTGCTGAACAGTACACCGGTGCTGGACAGTGAGGGGAATACCAACATCTCCGGTGTCACGGTGGTGTTCCGTGCCGGTGAGCAGGAGCAGACACCGCCGGAGGGGTTTGAATCCTCCGGCTCCGAGACGGTGCTGGGTACGGAAGTGAAATATGACACGCCGATCACCCGCACCATTACGTCTGCAAACATCGACCGTCTGCGCTTTACCTTCGGTGTGCAGGCACTGGTGGAAACCACCTCAAAGGGGGACCGGAATCCATCGGAAGTCCGCCTGCTGGTTCAGATACAACGTAACGGTGGCTGGGTGACGGAAAAGGACATCACCATTAAGGGCAAAACCACCTCGCAGTATCTGGCCTCGGTGGTGGTGGATAACCTGCCGCCGCGCCCGTTCAGTATCCGGATGCGCAGAATGACGCCGGACAGCACCACAGACCAGTTGCAGAACAAAACGCTCTGGTCGTCATACACCGAAATTATCGATGTGAAACAGGGCTACCCGAACACGGCACTGGTCGGCGTACAGGTGGATTCGGAGCAGTTCGGCAGCCAGCAGGTGAGCCGTAATTATCATCTTCGCGGGCGCATTCTGCAGGTGCCGTCGAACTATAACCCGCAGACGCGACAATACAGCGGTATTTGGGACGGAACGTTAAAACCAGCATACAGCAACAACATGGCCTGGTGTCTGTGGGATATGCTGACCCACCCGCGCTACGGCATGGGGAAACGTCTTGGTGCGGCAGATGTGGATAAATGGGCGCTGTATGTCATCGGCCAGTACTGCGACCAGTCAGTGCCGGACGGTTTTGGCGGCACGGAGCCGCGCATCACCTGTAATGCGTACCTGACCACACAGCGCAAGGCGTGGGATGTGCTCAGTGATTTCTGCTCGGCGATGCGCTGTATGCCGGTATGGAACGGGCAGACGCTGACGTTCGTGCAGGACCGACCGTCGGATAAGGTGTGGACCTATAACCGCAGTAATGTGGTGATGCCGGATGATGGCGCGCCGTTCCGCTACAGCTTCAGCGCCCTGAAGGACCGCCATAATGCCGTTGAGGTGAACTGGATTGACCCGGATAACGGCTGGGAGACGGCGACAGAGCTTGTGGAGGACACGCAGGCCATTGCCCGTTACGGTCGTAACGTCACGAAGATGGATGCTTTTGGCTGTACCAGCCGGGGGCAGGCACACCGCGCCGGGCTGTGGCTGATTAAAACGGAGCTGCTGGAAACGCAGACCGTGGACTTCAGCGTGGGCACAGAAGGGCTTCGCCATGTACCGGGCGATGTCATTGAAATCTGCGATGATGACTATGCGGGCATCAGCACCGGTGGGCGCGTGCTGGCGGTGAACAGCCAGACGCGGACACTGACGCTCGACCGTGAAATCACGCTGCCAGCCTCCGGCACCACGCTGATAAGTCTGGTTGACGGGCAGGGGAGTCCGGTCAGCGTGGAGGTTCAGTCCGTCACCGACGGCGTGAAGGTAAAAGTGAGCCGGGTTCCTGACGGTGTTGCTGAATACAGCGTGTGGGGGCTGAAGCTGCCGACGCTGCGCCAGCGCCTGTTCCGCTGCGTGAGTATCCGTGAGAACGACGACGGCACGTATGCCATCACTGCCGTGCAGCATGTGCCGGAGAAAGAGGCCATCGTGGATAACGGGGCGCACTTTGACGGTGACCAGAGCGGCACGGTGAATGGTGTCACGCCGCCAGCAGTGCAGCATCTGACCGCCGAAGTCACTGCAGACAGCGGGGAATATCAGGTGCTGGCGCGATGGGACACGCCGAAGGTGGTGAAGGGTGTGAGCTTTATGCTTCGCCTGACTGTGGCAGCAGACGACGGCAGTGAGCGGCTGGTCAGCACGGCCCGGACGACGGAAACCACATACCGCTTCACGCAACTGGCGCCAGGGAACTACAGGCTGACAGTCCGGGCGGTAAATGCGTGGGGGCAGCAGGGCGATCCGGCATCGGTATCGTTCCGGATTGCCGCACCGGCAGCACCGTCGCGGATTGAGCTGACGCCGGGCTATTTTCAGATAACCGCAACGCCGCATCTTGCCGTTTATGATCCGACGGTACAGTTTGAGTTCTGGTTCTCGGAAAAGCGGATTGCGGATATCAGGCAGGTTGAAACCACAGCCCGCTATCTTGGTACGGCGCTGTACTGGATAGCTGCCAGTATCAATATCAAACCGGGCCATGATTATTACTTTTATATCCGCAGTGTGAACACCGTTGGCAAATCGGCATTCGTGGAGGCTGTTGGTCAGCCGAGTGATGATGCATCCGGTTATCTGGATTTTTTCAAAGGCGAGATAGGGAAAACCCATCTGGCTCAGGAGCTGTGGACGCAGATTGATAACGGTCAGCTTGCGCCTGACCTGGCTGAAATCAGGACGTCCATTACGGATGTCAGCAATGAAATCACGCAGACCGTCAATAAGAAACTGGAAGACCAGAGTGCGGCAATTCAGCAGATACAGAAGGTTCAGGTTGATACAAATAATAACCTGAACAGCATGTGGGCTGTGAAGCTGCAGCAGATGCAGGACGGACGCCTTTATATCGCGGGTATTGGTGCCGGTATTGAGAACACCCCTGACGGCATGCAGAGTCAGGTGCTGCTGGCGGCGGACAGGATTGCGATGGTTAATCCTGCGAATGGCAACACAAAACCGATGTTTGTTGGTCAGGGCGATCAGATATTCATGAACGACGTGTTCCTGAAACGCCTGACGGCCCCCACCATTACCAGCGGTGGAAATCCACCGGCATTTTCCCTGACACCGGACGGAAAGCTGACCGCTAAAAATGCGGATATCAGTGGCAGTGTGAATGCGAACGCCGGGACGCTCAACAATGTCACGGTAAATGAAAACTGTACGATTAAGGGCATGCTGGAGGCGACTCAGGTCAGAGGTGACTTCGTTAAAGCTGTATCCAAATCATTTCCGAAACAGGCTGGTACGTGGGGTAACACGGAAACACCAAACGGGACGGTTACAGTCACCATCAGCGATGATCATAACTTTGACCGTCAGATTATTATTCCGCCCATTATCTTTAACGGAATAGCGTATAGCGATCCGGGAAGTGGTAATAACCCGGGAGGTACAAGATACACGGGTTATGGTTTTGAAGTTCGCAAAAACGGTGTATTAATCGCATCCAGAGAAACTAAAGGGGCCATTCCCGGTAGCTACAGTGCGGTTATTGATATGCCGAGTGGCAGGGGAAGCGTCACTCTGGAGTTTAAGGTTTTCCATAAAGGCAATCAGCGGGCAGGTAATATCACCGACTGTACGGTGATTGTGACCAAAAAAGCCGCTTCCGGCATCAGTATTCGTTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
b2a8de642e15960aa07f05a993349c09c10a10adb2f238baca0956b1ff200f92
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50