Protein
View in Explore- Genbank accession
- UGV21782.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MIKNSVVTGRKGGSSKPHTPQEMEDNLISINKIKVLLAVSDGEVDADFSLKDLYLNNVPVIAPSGEVNYEGVTAEFRPGTQTQDYIKGFNDTAAEFTVGRELKTTTPYVISVTNKQLSAVRVKILMPRGVTTKENGDMVGVVVKWAVDMAVDGGNYQEVLSDVIDGKTISGYDKTKRIDLPTFNSQVLLRVRRVTADSTDSRVVDTINIQSYAEVVDAKFRYPLTGLVYVEFNSDLFTQIPSISTKKKWKLINVPSNYNPELREYSGTWDGSFKKAWSNNPAWVLYDLITNQRYGLDQRELGIAVDKWSLYDAGQYCDQKVPDGHGGLEPRYLCDVVIQSQVEAYNLVRDICSIFRGMSFWNGESLSIVIDRPREASYIFTNDNVVDGSFAYTFASEKSMYTTCNVTFDDEQNMYSQDIEGVFDLNASLRFGHNPTSITAIGCTRRSEANRRGRWVLKTNLRSTTVSFATGLEGMIPMIGDVIAIADNFWSSNLTLSLSGRVMEVSGLQVFTHFKVDARAGDFIIVNKADGNPVRRTISKVSADGKTIELNVGFGFDVQPNTVFAIDRTDVALQQYVVTGITKGDGDDEFTYSITAVEYDPNKYDEIDYGVNIDDRPTSIVDPDNMQPPKNIIVSSYSRIVQGMSVETMVIGWDKVQYASKYDVQWRKDNGNWMNVPRTASSEVEVEGIYAGNYHVRVRSISSGGNTSPWSEVVSVGLTGKIGKPDKPTVITASDDQVFGIRVKWGFPEGSGDTAYTELQQIPDNGAGGHTGEENASLLTMIPYPQYEYWHSTLPAGYVNWYRARLVDRIGNASDWSDIVRGMASDDVESIIGEIKVDIENSDGFKYLQQNAIESNGAIQAQAESILENALANDTDVRRMTKENGKRKAEYVQAVNLIADETQARVEALTQLKAQIDDEVVASITEVQTALATETEARTTADTALSAQLGDAQAALNEKLDSWVDAESAGAQYGVKLGLKYNGVEYSAGMSMELVGTDGNVRSQFIFDANRFAISNGIGSGSGQWQLPFVVENGNVIIQSAVIGDGSITNAKIGNFIQSSNYVAGSTGWRIDKSGNAEIRGKLYANSGEFAFNGTNNTVQINGNGITVNLPGGGRVVVGTF
- Physico‐chemical
properties -
protein length: 1121 AA molecular weight: 123017,82780 Da isoelectric point: 4,79127 aromaticity: 0,09010 hydropathy: -0,30535
Domains
Domains [InterPro]
DC_0014
STR
1–1121
STR
1–1121
IPR053171
Unmapped
3–881
Unmapped
3–881
IPR055385
ATT
93–218
ATT
93–218
IPR036116
STR
628–716
STR
628–716
IPR003961
STR
628–716
STR
628–716
IPR003961
STR
628–722
STR
628–722
IPR003961
STR
648–715
STR
648–715
1
1121
Architecture
STR 1-92 | ATT 93-218 | STR 219-339 | ATT 340-502 | STR 503-1121
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1121
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 503 | 503 | 0,8795 |
| Central domain | 504 | 1058 | 556 | 0,0627 |
| C-terminal | 1059 | 1121 | 62 | 0,7913 |
Note: Constraints were applied during segmentation.
Fixed 42 C-terminal predictions appearing before Central domain
Fixed 42 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-503
1-503
Central
504-1058
504-1058
C-terminal
1059-1121
1059-1121
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Phage vB_EcoM-p111 [NCBI] |
2900303 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
UGV21782.1
[NCBI]
Genbank nucleotide accession
OL449681.1
[NCBI]
CDS location
range 832 -> 4197
strand -
strand -
CDS
ATGATTAAAAATAGTGTAGTGACGGGCCGAAAGGGTGGCAGCAGCAAGCCGCATACCCCACAGGAGATGGAAGATAACCTAATCTCAATCAACAAGATTAAGGTTTTGCTCGCTGTTAGTGATGGCGAGGTTGACGCGGATTTCTCATTAAAGGACTTATATCTTAATAACGTTCCTGTAATTGCACCATCCGGCGAGGTTAACTATGAAGGCGTAACGGCTGAGTTTCGCCCTGGAACGCAGACTCAGGATTACATCAAAGGCTTCAACGATACGGCGGCTGAGTTCACTGTAGGCCGTGAATTGAAAACAACGACGCCTTACGTGATCTCGGTAACGAATAAGCAGCTTTCAGCCGTCCGCGTCAAGATCCTGATGCCTCGCGGCGTTACAACGAAAGAAAACGGAGATATGGTCGGCGTGGTCGTGAAGTGGGCCGTAGATATGGCGGTTGATGGCGGGAACTACCAGGAAGTTTTATCAGACGTAATCGACGGAAAGACAATTAGCGGATATGACAAAACAAAGCGAATAGACCTACCAACGTTCAATAGTCAGGTTCTATTGCGTGTGCGACGCGTTACGGCTGATTCAACTGATTCGCGCGTCGTTGACACGATAAACATTCAGTCTTATGCCGAAGTGGTTGATGCTAAATTCCGTTACCCTCTGACTGGTCTTGTTTACGTCGAGTTTAACAGCGATCTATTCACGCAAATCCCAAGCATTAGCACGAAAAAGAAATGGAAGCTCATTAACGTTCCGAGCAACTACAACCCAGAGCTACGTGAATATAGCGGCACATGGGATGGGAGTTTTAAAAAAGCATGGTCAAATAATCCGGCGTGGGTGCTTTATGATTTGATCACCAATCAGCGCTACGGACTCGACCAAAGAGAGTTGGGGATCGCCGTTGATAAGTGGTCGCTATATGATGCTGGTCAATACTGCGATCAGAAGGTTCCTGACGGTCACGGAGGGTTGGAGCCTCGCTACCTTTGCGATGTGGTAATCCAATCTCAGGTTGAGGCTTACAATCTGGTTCGAGATATTTGCTCAATCTTCCGAGGGATGAGCTTCTGGAACGGTGAGAGCCTCTCAATTGTCATCGACCGACCGAGAGAGGCTTCATATATTTTCACTAACGACAACGTCGTTGATGGCTCATTTGCCTATACGTTCGCAAGTGAAAAAAGCATGTACACAACCTGCAACGTCACGTTCGACGACGAGCAGAACATGTACAGCCAGGACATTGAGGGGGTATTCGACCTTAACGCCTCATTACGCTTCGGTCATAATCCGACAAGCATCACGGCGATCGGGTGTACTCGACGCAGTGAAGCGAATCGACGGGGCCGTTGGGTTCTCAAAACAAACCTTCGCAGCACGACGGTGAGTTTTGCTACTGGCCTTGAGGGTATGATTCCGATGATTGGCGACGTGATAGCAATCGCTGATAACTTCTGGTCAAGTAACCTGACGCTTTCGTTATCAGGTCGTGTGATGGAAGTTTCTGGCCTGCAAGTGTTCACACACTTTAAGGTCGATGCGCGCGCTGGTGATTTCATTATCGTGAACAAGGCTGACGGAAATCCGGTGCGCCGGACGATTTCAAAAGTTTCTGCGGACGGGAAAACCATTGAGCTTAACGTTGGATTCGGTTTTGATGTTCAACCCAACACAGTGTTCGCAATCGACCGCACTGATGTGGCCTTGCAGCAATACGTTGTAACCGGAATCACGAAGGGCGACGGAGATGATGAGTTCACGTACAGCATCACGGCGGTTGAATACGATCCAAACAAATACGATGAGATCGACTACGGCGTAAATATTGATGACCGACCAACAAGCATTGTTGATCCTGACAACATGCAGCCACCAAAAAACATTATCGTTTCATCATACTCTCGAATTGTGCAGGGGATGAGCGTTGAGACAATGGTGATAGGGTGGGACAAGGTTCAGTACGCGAGCAAGTACGACGTGCAGTGGCGAAAGGATAACGGCAACTGGATGAACGTGCCGCGCACAGCAAGCTCAGAGGTTGAAGTGGAAGGTATTTATGCGGGTAATTATCACGTACGCGTAAGGAGTATCTCAAGCGGTGGAAACACGTCTCCATGGTCTGAAGTTGTCAGCGTCGGATTGACGGGTAAGATTGGGAAGCCAGATAAACCAACAGTCATAACTGCATCTGACGACCAGGTGTTTGGGATACGGGTTAAATGGGGTTTCCCTGAAGGTTCTGGCGACACTGCCTACACTGAGTTGCAGCAGATACCAGATAATGGCGCCGGAGGTCACACAGGCGAGGAGAACGCAAGCCTGTTAACAATGATTCCATACCCTCAGTACGAGTACTGGCACTCGACACTACCGGCAGGATATGTGAACTGGTACAGGGCAAGATTGGTAGACAGGATTGGTAACGCCTCTGACTGGTCTGACATTGTTCGCGGAATGGCAAGCGATGACGTTGAGTCAATCATTGGAGAGATAAAGGTTGATATCGAGAATTCCGATGGGTTTAAGTACCTACAGCAGAACGCCATTGAGTCAAACGGAGCTATTCAGGCGCAGGCGGAGTCAATTCTTGAAAACGCACTTGCAAACGATACTGACGTTCGACGAATGACCAAGGAGAACGGCAAGAGAAAGGCTGAATACGTTCAGGCAGTGAATCTTATTGCCGATGAAACTCAAGCTCGCGTAGAGGCTCTCACTCAGCTTAAAGCGCAGATTGATGATGAGGTCGTAGCCTCCATAACTGAAGTTCAGACGGCACTAGCCACCGAAACGGAAGCAAGGACCACTGCGGATACAGCTCTGAGTGCTCAGCTTGGAGATGCTCAGGCAGCACTGAATGAAAAACTTGATTCCTGGGTGGATGCAGAATCCGCTGGCGCTCAGTACGGCGTTAAGTTAGGTCTAAAATATAATGGGGTTGAGTATAGCGCAGGGATGAGCATGGAGCTAGTTGGCACTGATGGAAACGTTCGCAGTCAGTTCATTTTTGACGCAAACAGATTCGCAATCAGTAACGGAATTGGTTCTGGTTCCGGTCAATGGCAACTCCCCTTCGTTGTAGAGAACGGAAACGTAATCATCCAAAGCGCTGTAATTGGCGATGGCTCAATTACTAACGCGAAGATTGGTAACTTTATTCAGTCCAGCAACTACGTAGCAGGAAGCACAGGCTGGAGGATTGATAAGTCTGGTAACGCTGAGATTCGCGGTAAACTGTACGCCAACAGTGGTGAATTCGCATTCAACGGAACAAACAATACGGTACAGATTAACGGAAACGGAATAACGGTTAACTTGCCTGGAGGAGGAAGAGTTGTGGTAGGTACTTTCTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
dcc06231b19e31fd7b89ffc3a91e795ced16494c720a6ae9fcbf3feab872c0ce
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50