Protein
View in Explore- Genbank accession
- UOX38477.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MIKNNVVTGRKGGSSKPHTPQEMEDNLISINKIKVLLAVSDGEVDANFSLKDLYLNDVPVIAPSGEVNYEGVTAEFRPGTQTQDYIKGFNDTAAEFTVGRELKTTTPYVISVTNKQLSAVRVKILMPRGVTTKENGDMVGVVVKWAVDMAVDGGNYQEVLSDVIDGKTISGYDKTKRIDLPKFNSQVLLRVRRVTADSTDSRVVDTINIQSYAEVVDAKFRYPLTGLVYVEFNSDLFTQIPSISTKKKWKLINVPSNYNPELREYSGTWDGSFKKAWSNNPAWVLYDLITNQRYGLDQRELGIAVDKWSLYDAGQYCDQKVPDGHGGLEPRYLCDVVIQSQVEAYNLVRDICSIFRGMSFWNGESLSIVIDRPREASYIFTNDNVVDGSFAYTFASEKSMYTTCNVTFDDEQNMYSQDIEGVFDLNASLRFGHNPTSITAIGCTRRSEANRRGRWVLKTNLRSTTVSFATGLEGMIPMIGDVVAIADNFWSSNLTLSLSGRVMEVSGLQVFTHFKVDARAGDFIIVNKADGNPVRRTISKVSADGKTIELNVGFGFDVQPNTVFAIDRTDVALQQYVVTGITKGDGDDEFTYSITAVEYDPNKYDEIDYGVNIDDRPTSIVDPDNMQPPKNIIVSSYSRIVQGMSVETMVIGWDKVQYASKYDVQWRKDNGNWMNVPRTASSEVEVEGIYAGNYHVRVRSISSGGNTSPWSEVVSVGLTGKIGKPDKPTVITASDDQVFGIRVKWGFPEGSGDTAYTELQQIPDNGAGGHTGEENASLLTMIPYPQYEYWHSTLPAGYVNWYRARLVDRIGNASDWSDIVRGMASDDVESIIGEIKVDIENSEGFKYLQQNAIESNGAIQAQAESILENALANDTDVRRMTKENGKRKAEYVQAVNLIADETQARVEALTQLKAQIDDEVVASITEVQTALATETEARTTADTALSAQLGDTQAALNEKLDSWVDAESAGAQYGVKLGLKYNGVEYSAGMSMELVGTDGNVRSQFIFDANRFAISNGIGSGSGQWQLPFVVENGNVIIQSAVIGDGSITNAKIGNFIQSSNYVAGSTGWRIDKSGNAEIRGKLYANSGEFAFNGTNNTVQINGNGITVNLPGGGRVVVGTF
- Physico‐chemical
properties -
protein length: 1121 AA molecular weight: 123101,94750 Da isoelectric point: 4,81241 aromaticity: 0,09010 hydropathy: -0,31311
Domains
Domains [InterPro]
DC_0014
STR
1–1121
STR
1–1121
IPR053171
Unmapped
3–881
Unmapped
3–881
IPR055385
ATT
93–218
ATT
93–218
IPR036116
STR
628–716
STR
628–716
IPR003961
STR
628–716
STR
628–716
IPR003961
STR
628–722
STR
628–722
IPR003961
STR
648–715
STR
648–715
1
1121
Architecture
STR 1-92 | ATT 93-218 | STR 219-339 | ATT 340-502 | STR 503-1121
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1121
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 503 | 503 | 0,8861 |
| Central domain | 504 | 1058 | 556 | 0,0622 |
| C-terminal | 1059 | 1121 | 62 | 0,7936 |
Note: Constraints were applied during segmentation.
Fixed 40 C-terminal predictions appearing before Central domain
Fixed 40 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-503
1-503
Central
504-1058
504-1058
C-terminal
1059-1121
1059-1121
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage P818 [NCBI] |
2930318 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Escherichia coli 187 [NCBI] |
55511 | Uroviricota > Caudoviricetes > Phietavirus > |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
UOX38477.1
[NCBI]
Genbank nucleotide accession
ON062054.1
[NCBI]
CDS location
range 4855 -> 8220
strand -
strand -
CDS
ATGATTAAAAATAATGTAGTGACGGGCCGAAAGGGTGGCAGCAGCAAGCCGCATACCCCACAGGAGATGGAAGATAACCTGATCTCAATCAACAAGATTAAGGTTTTGCTCGCCGTTAGTGATGGCGAGGTTGATGCTAATTTCTCATTAAAGGACTTATATCTTAATGATGTTCCTGTAATTGCACCATCCGGCGAGGTTAACTATGAAGGCGTAACGGCTGAGTTTCGCCCTGGAACGCAGACTCAGGATTACATCAAAGGATTCAACGACACGGCGGCTGAGTTCACTGTAGGTCGTGAATTGAAAACAACGACGCCTTACGTGATCTCGGTAACGAATAAGCAGCTATCAGCAGTCCGCGTAAAAATCCTGATGCCTCGCGGCGTTACCACGAAAGAAAACGGCGATATGGTCGGCGTGGTTGTGAAGTGGGCCGTAGATATGGCGGTTGATGGCGGGAACTACCAGGAAGTTTTATCAGACGTAATCGACGGTAAGACAATTAGCGGATATGACAAAACAAAACGAATCGACCTCCCAAAGTTCAATAGTCAGGTTCTATTGCGTGTGCGACGCGTTACGGCTGATTCAACTGATTCGCGCGTCGTTGACACGATAAACATTCAGTCTTATGCCGAAGTGGTTGATGCTAAATTCCGTTACCCTCTGACTGGTCTTGTTTACGTCGAGTTTAACAGCGATCTATTCACGCAAATCCCAAGCATTAGCACGAAAAAGAAATGGAAGCTCATTAACGTTCCGAGCAACTACAACCCAGAGCTACGTGAATATAGCGGCACATGGGATGGGAGTTTTAAAAAAGCATGGTCAAATAATCCGGCGTGGGTGCTTTATGATTTGATCACCAATCAGCGCTACGGACTCGACCAAAGAGAGTTGGGGATCGCCGTTGATAAGTGGTCGCTATATGATGCTGGTCAATACTGCGATCAGAAGGTTCCTGACGGTCACGGAGGGTTGGAGCCTCGCTACCTTTGCGATGTGGTAATCCAATCTCAGGTTGAGGCTTACAATCTGGTTCGAGATATTTGCTCAATCTTCCGAGGGATGAGCTTCTGGAACGGTGAGAGCCTCTCAATTGTCATCGACCGACCGAGAGAGGCTTCATATATTTTCACTAACGACAACGTCGTTGATGGCTCATTTGCCTATACGTTCGCAAGTGAAAAAAGCATGTACACAACCTGCAACGTCACGTTCGACGACGAGCAGAACATGTACAGCCAGGACATTGAGGGGGTATTCGACCTTAACGCCTCATTACGCTTCGGTCATAATCCGACAAGCATCACGGCGATCGGGTGTACTCGACGCAGTGAAGCGAATCGACGGGGCCGTTGGGTTCTCAAAACAAACCTTCGCAGCACGACGGTGAGTTTTGCTACTGGCCTTGAGGGTATGATTCCGATGATTGGCGACGTGGTAGCAATCGCTGATAACTTCTGGTCAAGTAACCTGACGCTTTCGTTATCAGGTCGTGTGATGGAAGTTTCTGGCCTGCAAGTGTTCACACACTTTAAGGTCGATGCGCGCGCTGGTGATTTCATTATCGTGAACAAGGCTGACGGAAATCCGGTGCGCCGGACGATTTCAAAAGTTTCTGCGGACGGGAAAACCATTGAGCTTAACGTTGGATTCGGTTTTGATGTTCAACCCAACACAGTGTTCGCAATCGACCGCACTGATGTGGCCTTGCAGCAATACGTTGTAACCGGAATCACGAAGGGCGACGGAGACGATGAGTTCACGTACAGCATCACGGCGGTTGAATACGATCCAAACAAATACGATGAGATCGACTACGGCGTAAATATTGATGACCGACCAACAAGCATTGTTGATCCTGACAACATGCAGCCACCAAAAAACATTATCGTTTCATCATACTCTCGAATTGTGCAGGGGATGAGCGTTGAGACAATGGTGATAGGGTGGGACAAGGTTCAGTACGCGAGCAAGTACGACGTGCAGTGGCGAAAGGATAACGGCAACTGGATGAACGTGCCGCGCACAGCAAGCTCAGAGGTTGAAGTGGAAGGTATTTATGCGGGTAATTATCACGTACGCGTAAGGAGTATCTCAAGCGGTGGAAACACGTCTCCATGGTCTGAAGTTGTCAGCGTCGGATTGACGGGTAAGATTGGGAAGCCAGATAAACCAACAGTCATAACTGCATCTGACGACCAGGTGTTTGGGATACGGGTTAAATGGGGTTTCCCTGAAGGTTCTGGCGACACTGCCTACACTGAGTTGCAGCAGATACCAGATAATGGCGCCGGAGGTCACACAGGCGAGGAGAACGCAAGCCTGTTAACAATGATTCCATACCCTCAGTACGAGTACTGGCACTCGACACTACCGGCAGGATATGTGAACTGGTACAGGGCAAGATTGGTAGACAGGATTGGTAACGCCTCTGACTGGTCTGACATTGTTCGCGGAATGGCAAGCGATGACGTTGAGTCAATCATTGGAGAGATAAAGGTTGATATCGAGAATTCCGAGGGGTTTAAGTACCTACAGCAGAACGCCATTGAGTCAAACGGAGCTATTCAGGCGCAGGCGGAGTCAATTCTTGAAAACGCACTTGCAAACGATACTGACGTTCGACGAATGACCAAGGAGAACGGCAAGAGAAAGGCTGAATACGTTCAGGCAGTGAATCTTATTGCCGATGAAACTCAGGCTCGCGTAGAGGCTCTCACTCAGCTTAAAGCGCAGATTGATGATGAGGTCGTAGCCTCCATAACTGAAGTTCAGACGGCACTAGCCACCGAAACGGAAGCAAGGACCACGGCGGATACAGCTCTGAGTGCTCAGCTTGGAGATACTCAGGCAGCACTGAATGAAAAACTTGATTCCTGGGTGGATGCAGAATCCGCTGGCGCTCAGTACGGCGTTAAGTTAGGTCTAAAATATAATGGGGTTGAGTATAGCGCAGGGATGAGCATGGAGCTAGTTGGCACTGATGGAAACGTTCGCAGTCAGTTCATTTTTGACGCAAACAGATTCGCAATCAGTAACGGAATTGGTTCTGGTTCCGGTCAATGGCAACTCCCCTTCGTTGTAGAGAACGGAAACGTAATCATCCAAAGCGCTGTAATTGGCGATGGCTCAATTACTAACGCGAAGATTGGTAACTTTATTCAGTCCAGCAACTACGTAGCAGGAAGCACAGGCTGGAGGATTGATAAGTCTGGTAACGCTGAGATTCGCGGTAAACTGTACGCCAACAGTGGTGAATTCGCATTCAACGGAACAAACAATACGGTACAGATTAACGGAAACGGAATAACGGTTAACTTGCCTGGAGGAGGAAGAGTTGTGGTAGGTACTTTCTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
a4891a51723430f0ed0482df9a8c513c64a1465bcd7976165d5c4ce00d476e9f
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50