Protein
View in Explore- Genbank accession
- WNO25457.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MIKNNVVTGRKGGGSKPHTPQEMEDNLISINKIKVLLAVSDGEVDENFSLKDLYLNDVPVIAPSGEVNYEGIKAEFRPGTQTQDYIKGFNDTAAEFTVGRELTTTTPYVISVTNKQLSAVRVKVMMPRGVKTEENGDMVGVVVNWAVDMAVDGGSYQEVLSDTIDGKTISGYDRTRRIDLPTFNSQVLLRVRRITPDSNNARVVDAINIQSYAEVIDAKFRYPLTGLVYVEFNSDLFPQIPSISTKKKWKIINVPSNYDPVLREYSGTWDGSFKKAWSNNPAWVLYDLITNQRYGLDQRELGIAVDKWSLYDAGQYCDQKVPDGHGGLEPRYLCDVVIQSQVEAYNLVRDICSIFRGMSFWNGESLSIVIDRPREASYIFTNDNVVDGSFAYTFASEKSMYTTCNVTFDDEQNMYSQDIEGVFDLNASLRFGHNPTSITAIGCTRRSEANRRGRWVLKTNLRSTTVSFATGLEGMIPMIGDVVAIADNFWSSNLTLSLSGRVMEVSGLQVFTHFKVDARAGDFIIVNKPDGNPVRRTISKVSADGKTIELNVGFGFDVKPNTVFAIDRTDVALQKYVVTGITKGDGDDEFTYSITAVEYDPNKYDEIDYGVNIDDRPTSIVDPDNMQPPKNIVVSSYSRIVQGMSVETMVIGWDKVQYASKYDVQWRKDNGNWMNVPRTASSEVEVEGIYAGNYHVRVRSISSGGNTSPWSDVVSVGLTGKIGKPNKPTVITASDDQVFGIRVKWGFPEGSGDTAYTELQQIPDNGAGGHTGEENASLLTMIPYPQYEYWHSTLPAGYVNWYRARLVDRIGNASDWSDIVRGMASDDVESIIGEIKVDIENSDGFKYLQQNAIESNGAIQAQAESILENALANDTDVRRMTKENGKRKAEYVQAVNLIADETQARVEALTALKAQIDDEVVASITEVQTALATETEARTTADTALSAQLGDTQAVLNEKLDSWVDAESAGAQYGVKLGLKYNGVEYSAGMSMELVGSGAGVKSQFIFDANRFAISNGIGSGSGQWALPFVVESNQVFIQSAVIKDGSITNAKIGNRIQSNNYVQGSQGWAIDKSGFAELSNATVRGSLYANNGNFAFNGTSNTVQIDGNGITVNLPGGGRVVVGVWS
- Physico‐chemical
properties -
protein length: 1127 AA molecular weight: 123665,62170 Da isoelectric point: 4,82258 aromaticity: 0,09051 hydropathy: -0,30461
Domains
Domains [InterPro]
DC_0014
STR
1–1127
STR
1–1127
IPR053171
Unmapped
3–880
Unmapped
3–880
IPR055385
ATT
93–218
ATT
93–218
IPR036116
STR
628–716
STR
628–716
IPR003961
STR
628–722
STR
628–722
IPR003961
STR
628–716
STR
628–716
IPR003961
STR
648–715
STR
648–715
1
1127
Architecture
STR 1-92 | ATT 93-218 | STR 219-339 | ATT 340-502 | STR 503-1127
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1127
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 504 | 504 | 0,8761 |
| Central domain | 505 | 1058 | 555 | 0,0637 |
| C-terminal | 1059 | 1127 | 68 | 0,6878 |
Note: Constraints were applied during segmentation.
Fixed 47 C-terminal predictions appearing before Central domain
Fixed 47 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-504
1-504
Central
505-1058
505-1058
C-terminal
1059-1127
1059-1127
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage vB_EcoM_50EP [NCBI] |
3075958 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WNO25457.1
[NCBI]
Genbank nucleotide accession
OR472545.1
[NCBI]
CDS location
range 11485 -> 14868
strand +
strand +
CDS
ATGATTAAAAATAATGTAGTGACGGGCCGAAAGGGTGGAGGCAGTAAGCCTCACACACCACAGGAGATGGAAGACAACCTGATCTCAATCAACAAGATTAAGGTTTTGCTCGCTGTCAGTGATGGTGAGGTTGATGAGAATTTCTCATTAAAGGACTTATATCTTAATGACGTTCCTGTGATTGCACCTTCAGGCGAAGTTAACTATGAAGGTATTAAGGCTGAGTTCCGCCCAGGCACGCAGACTCAGGATTACATCAAAGGATTCAACGACACGGCGGCTGAGTTCACTGTTGGTCGTGAATTGACGACTACGACGCCTTACGTGATCTCAGTAACAAACAAGCAGCTTTCCGCCGTCCGCGTCAAGGTAATGATGCCTCGCGGCGTAAAGACGGAAGAAAACGGCGACATGGTCGGGGTTGTCGTCAATTGGGCTGTTGATATGGCTGTTGATGGCGGGAGCTATCAGGAAGTATTGTCTGACACAATAGACGGAAAGACAATTAGCGGGTATGACAGGACTAGGCGCATTGACTTGCCGACATTTAATAGTCAAGTCCTTCTTCGGGTTCGTCGTATTACTCCTGATTCGAATAATGCAAGAGTTGTTGACGCGATCAACATTCAGTCATATGCGGAAGTTATTGACGCTAAATTCCGTTATCCTCTGACTGGTCTTGTTTACGTCGAGTTTAACAGCGATCTTTTCCCGCAGATCCCAAGCATTAGCACGAAAAAGAAATGGAAGATCATCAACGTTCCGAGCAACTACGACCCAGTGCTGAGAGAATACAGCGGCACATGGGATGGCAGCTTTAAAAAAGCGTGGTCAAATAACCCCGCGTGGGTGCTTTATGATTTGATTACCAATCAGAGATATGGACTCGACCAAAGAGAACTAGGGATCGCGGTCGATAAGTGGTCGCTATATGATGCTGGTCAATACTGCGATCAGAAAGTTCCTGACGGTCACGGAGGTTTGGAGCCTCGCTACCTTTGCGACGTGGTAATCCAGTCTCAGGTTGAGGCTTACAATCTGGTTCGAGATATTTGCTCAATATTCCGAGGGATGAGCTTCTGGAACGGCGAGAGCCTTTCAATTGTCATCGACCGACCGCGAGAGGCGTCTTATATTTTCACTAACGACAACGTCGTTGACGGCTCATTTGCCTATACGTTCGCAAGTGAAAAAAGCATGTACACGACTTGCAACGTCACATTTGACGATGAGCAAAACATGTACAGCCAGGATATTGAGGGCGTATTCGACCTTAACGCATCGTTACGGTTCGGGCACAACCCTACAAGCATCACCGCGATCGGATGTACTCGACGAAGCGAGGCGAACCGACGAGGCCGCTGGGTTCTTAAAACAAACCTTCGCAGCACGACGGTGAGTTTTGCAACTGGCCTTGAGGGTATGATTCCGATGATTGGCGACGTAGTGGCTATCGCTGATAACTTTTGGTCAAGCAACCTGACGCTTTCATTATCAGGTCGTGTCATGGAAGTATCTGGACTGCAAGTGTTCACTCACTTTAAAGTCGATGCTCGTGCTGGTGACTTTATTATCGTCAATAAGCCTGACGGTAATCCGGTTCGCCGTACTATTTCAAAGGTATCGGCAGACGGAAAGACGATTGAGCTTAATGTTGGTTTTGGTTTTGATGTTAAGCCCAACACTGTTTTCGCAATCGACAGAACTGACGTGGCTTTGCAGAAATACGTCGTAACTGGAATCACGAAGGGTGACGGTGATGATGAGTTCACATACAGCATCACGGCGGTTGAGTATGATCCCAATAAATACGACGAGATCGACTACGGAGTAAATATTGATGACCGACCAACCAGTATTGTAGATCCTGACAACATGCAGCCACCAAAAAACATTGTTGTTTCATCATACTCTCGAATTGTGCAGGGGATGAGCGTTGAGACAATGGTGATAGGGTGGGATAAAGTTCAGTACGCGAGCAAGTACGACGTGCAGTGGAGAAAGGATAACGGTAACTGGATGAACGTACCGCGTACAGCAAGCTCAGAGGTTGAGGTTGAAGGGATTTATGCGGGTAATTATCACGTACGCGTAAGGAGCATATCAAGCGGTGGAAACACGTCTCCATGGTCTGATGTTGTCAGCGTTGGGTTGACTGGTAAGATTGGGAAGCCAAATAAACCAACAGTCATAACCGCATCTGACGATCAGGTATTTGGGATCAGGGTTAAATGGGGATTCCCTGAAGGTTCTGGCGACACTGCCTACACTGAATTGCAGCAGATACCAGATAATGGTGCCGGAGGTCACACTGGTGAGGAGAATGCAAGTCTATTAACAATGATTCCTTACCCTCAGTACGAGTACTGGCACTCAACATTACCAGCAGGTTATGTAAACTGGTACAGGGCAAGATTGGTAGACAGGATTGGTAACGCCTCTGACTGGTCTGACATTGTTCGCGGAATGGCAAGCGATGACGTTGAGTCCATCATTGGAGAAATAAAGGTTGATATCGAGAATTCCGATGGGTTTAAGTACCTACAGCAGAACGCCATTGAGTCAAACGGAGCTATTCAGGCGCAGGCGGAATCAATTCTTGAAAACGCACTTGCAAACGATACTGACGTGCGACGAATGACCAAGGAGAACGGCAAGAGAAAAGCTGAATACGTTCAGGCAGTGAATCTTATTGCCGATGAAACTCAGGCTCGCGTAGAGGCTCTCACGGCCCTTAAAGCGCAGATAGATGATGAAGTTGTAGCATCGATTACAGAAGTTCAGACTGCATTAGCCACAGAGACAGAAGCAAGGACTACAGCAGACACGGCTTTGAGCGCTCAACTTGGCGATACGCAGGCCGTGCTTAATGAAAAACTTGACTCTTGGGTAGATGCGGAATCTGCTGGCGCTCAGTACGGCGTTAAGTTAGGACTAAAATACAATGGGGTTGAGTATAGCGCAGGGATGAGCATGGAACTTGTTGGTAGTGGTGCTGGCGTTAAGAGTCAGTTCATCTTTGACGCAAACAGATTCGCTATCAGTAATGGGATTGGATCTGGTTCCGGTCAGTGGGCATTGCCTTTTGTTGTTGAGAGCAATCAGGTGTTCATCCAGAGCGCTGTGATCAAGGACGGTTCAATCACGAACGCGAAGATTGGTAACAGGATCCAATCTAACAACTACGTTCAAGGAAGTCAGGGGTGGGCTATTGATAAATCTGGTTTTGCTGAACTAAGTAATGCCACCGTTAGAGGAAGCCTTTACGCTAACAATGGTAACTTCGCGTTTAACGGAACAAGCAACACTGTTCAGATTGACGGTAACGGAATCACTGTTAACCTGCCAGGTGGAGGAAGGGTTGTAGTTGGAGTATGGAGTTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
ddbbe6603c0b1094682939c8a96eedb5137bd3dce7f0b64e7de8a75725ca60b6
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50