Protein
View in Explore- Genbank accession
- QQK88364.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MTQITGRKGGGGSPRTPVEQPDDLQSVAKAKLLIALGEGEFAGELTGKNIFLDGTPLLNADGSENFPGVVWEYRPGTQAQTYIQGMPAAENEITVGTTVQSSTPWAHAFTNPQLSAVRVRLKWPSLFRQEDNGDMVGNEVKYAVDLQTDGGSWKTVVDGRVKGKTTSGYERTHRIDLPQSATSWTLRVRKITEDANSAKIGDTMVLQSYTEVIDAKLRYPHTALLYIEFGSKQFNGSIPQVTCEPKMRIIRVPSNYDPEHRTYSGTWDGSFKWAWTNNPAWVFYDIVVSDRFGLGDRIKMQNIDKWELYRVAQYCDQLVPDGKGGSGTEPRYVCDVYVQDRNEAYTVLRDFAAIFRGMTYWGGNQIITLADMPRDIDYSYTKANVIDGKFTYSGSSSKARYSSALVSYSDPLNGYADAMEPVFENELVYRFGFNQLEMTAIGCTRQSEANRKGRWGILTNNKDRVVTFGVGLDGNIPQPGYIIAVADENLSGKVTGGRVSAVNGRSITLDRKPDAALGDRLMLNLPSGKSQARTIQMVTDNVITVTTEYSEIPEPECVWVTESDELYAQQYRVVSVTENDDGTFTISAAMHDPDKYDRIDTGAVLDERPISVIPPGNQFPPKDITISSYSVVNQGISVETMQVTWSPAENAIAYEAQWRRDDGNWINVPRNATTSFDVPGVYSGRYLVRVRAINAAEISSGWGYSEETRLTGKVGDPPMPLNFRASTLVFGIKLNWEFGKFTEDTLKTEIQYSKTNDGQNLLLLADVPYPSRSHELAGLAAGTAFYFRARLVDKTGNQSPWTEFVRGVAEFDASTIIDEVAAGLGDSQIIKDLQSQADDNFEAIINNANNAYGQWGYWQRENGAMKAEIIEVRNYTVTETKALAEKLDAVKVTADDSFAMAQNSIRAQWDMASGQASVVHDMKVRIHYNGEDYSAGMVIGAELKGGQVNTLIGFNAQKFAFYNPSSKSMDLFMYMEGGQIFMREAFINQAWLNEVVVTDKMQSENYVPGKTGFLIDAKGGNAEFNSATFRGTLDVRSAASGGRMEINNAMIDVFDENNVLRVRIGRLS
- Physico‐chemical
properties -
protein length: 1068 AA molecular weight: 118377,08900 Da isoelectric point: 5,02340 aromaticity: 0,10019 hydropathy: -0,39682
Domains
Domains [InterPro]
DC_0014
STR
1–1068
STR
1–1068
IPR053171
Unmapped
3–836
Unmapped
3–836
IPR055385
ATT
90–215
ATT
90–215
IPR003961
STR
620–699
STR
620–699
IPR003961
STR
620–714
STR
620–714
IPR003961
STR
630–699
STR
630–699
IPR036116
STR
632–698
STR
632–698
1
1068
Architecture
STR 1-89 | ATT 90-215 | STR 216-339 | ATT 340-502 | STR 503-1068
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1068
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 535 | 535 | 0,8020 |
| Central domain | 536 | 1029 | 495 | 0,0754 |
| C-terminal | 1030 | 1068 | 38 | 0,5365 |
Note: Constraints were applied during segmentation.
Fixed 66 C-terminal predictions appearing before Central domain
Fixed 66 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-535
1-535
Central
536-1029
536-1029
C-terminal
1030-1068
1030-1068
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Providencia phage PSTRCR_117lys [NCBI] |
2800825 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QQK88364.1
[NCBI]
Genbank nucleotide accession
MW358929.1
[NCBI]
CDS location
range 14540 -> 17746
strand +
strand +
CDS
ATGACACAAATCACAGGCCGCAAAGGTGGCGGTGGCAGCCCGCGTACGCCCGTCGAACAACCGGACGACTTACAGTCCGTAGCCAAAGCCAAATTGCTGATCGCCCTCGGTGAAGGGGAATTTGCCGGGGAACTGACCGGAAAGAATATTTTTCTGGATGGTACCCCGTTGCTGAATGCTGACGGATCAGAAAACTTTCCCGGCGTGGTGTGGGAATACCGTCCCGGCACCCAGGCACAAACCTATATTCAGGGGATGCCGGCGGCGGAGAATGAAATCACCGTTGGTACCACTGTGCAGAGCAGCACGCCATGGGCACATGCGTTTACTAACCCGCAGTTGTCTGCGGTCCGCGTCCGCCTGAAATGGCCGTCCCTGTTCCGCCAGGAGGATAACGGGGACATGGTCGGGAATGAGGTGAAATACGCCGTTGATTTGCAGACTGACGGCGGGAGCTGGAAAACCGTTGTGGATGGACGGGTGAAAGGTAAAACCACCTCAGGTTATGAGCGTACTCACCGAATTGATCTGCCGCAGTCTGCGACATCCTGGACACTGCGGGTGCGAAAAATCACTGAAGATGCCAACAGTGCCAAAATTGGTGACACTATGGTGCTGCAGAGTTACACCGAAGTGATAGACGCCAAACTGAGGTATCCGCATACCGCGCTGCTATATATCGAGTTTGGCTCAAAACAGTTTAACGGCTCTATCCCGCAGGTCACCTGTGAGCCGAAAATGCGTATTATCCGCGTGCCGTCAAACTATGATCCGGAACACCGGACATATTCCGGTACCTGGGACGGTTCGTTTAAGTGGGCGTGGACCAATAACCCCGCCTGGGTCTTTTACGATATTGTGGTTTCCGATCGCTTCGGCCTCGGCGACCGCATCAAAATGCAGAATATCGATAAGTGGGAGCTGTACCGGGTTGCGCAGTATTGTGATCAGCTGGTGCCGGATGGTAAGGGCGGCAGCGGTACCGAACCGCGTTATGTCTGTGACGTGTATGTGCAGGATCGCAATGAAGCCTATACAGTGCTGCGTGATTTTGCTGCCATTTTCCGGGGTATGACCTACTGGGGAGGCAACCAGATTATCACCCTGGCGGATATGCCCCGGGACATTGATTACAGTTACACCAAAGCCAACGTGATCGATGGGAAATTCACCTATTCCGGCAGCAGCAGTAAGGCCCGCTATTCCTCCGCACTGGTGTCGTACTCCGATCCACTGAATGGTTATGCCGATGCAATGGAGCCGGTGTTTGAAAACGAACTGGTTTACCGGTTCGGCTTTAACCAGCTGGAGATGACGGCGATCGGCTGTACCCGCCAGTCAGAGGCCAACCGCAAAGGCCGCTGGGGCATCCTCACCAACAACAAAGACCGCGTGGTGACATTCGGTGTGGGGCTGGACGGTAATATCCCGCAGCCGGGCTACATCATCGCAGTGGCGGATGAAAACCTGTCCGGGAAAGTGACCGGCGGCCGTGTCAGTGCAGTGAATGGCCGGAGTATCACACTCGACCGTAAACCGGATGCGGCGCTGGGTGACCGGCTGATGCTGAATCTGCCTTCCGGCAAATCACAGGCCCGCACCATTCAGATGGTCACGGATAACGTGATCACCGTTACCACGGAATACAGTGAAATACCGGAGCCGGAATGTGTCTGGGTAACGGAATCGGATGAGCTGTACGCCCAGCAGTACCGGGTGGTGAGCGTGACTGAGAATGATGACGGCACGTTCACCATATCGGCGGCCATGCATGATCCGGACAAATACGACCGGATAGATACCGGCGCGGTACTCGATGAACGTCCAATCAGTGTTATTCCGCCCGGCAACCAGTTCCCGCCGAAAGATATCACCATCAGCTCTTACTCTGTGGTGAATCAGGGGATCAGCGTCGAAACCATGCAGGTTACCTGGTCACCGGCCGAGAACGCCATTGCCTATGAGGCGCAGTGGCGGCGTGATGACGGTAACTGGATCAATGTGCCGCGTAATGCCACCACCTCGTTTGACGTGCCCGGGGTCTATTCAGGCCGCTATCTGGTGCGGGTAAGAGCGATTAATGCAGCGGAAATCTCCAGCGGCTGGGGGTATTCAGAGGAAACCCGGCTGACCGGTAAGGTGGGTGATCCGCCGATGCCGCTGAACTTCCGTGCGAGCACGCTGGTATTCGGGATCAAACTGAACTGGGAATTCGGGAAATTCACGGAAGATACCCTGAAAACTGAAATTCAGTACAGCAAAACCAACGATGGTCAGAACCTGTTGCTCCTGGCCGATGTGCCGTACCCGTCCCGCTCTCATGAACTGGCCGGTCTGGCCGCCGGTACCGCGTTTTATTTCCGTGCCAGGCTGGTGGATAAAACCGGCAATCAGTCACCCTGGACTGAGTTTGTGCGCGGCGTGGCCGAGTTCGATGCATCAACCATTATTGATGAAGTGGCCGCCGGGTTGGGCGACTCTCAAATCATCAAAGACCTGCAGTCTCAGGCTGATGACAACTTCGAAGCCATCATCAACAACGCCAATAACGCCTACGGCCAGTGGGGTTACTGGCAGCGCGAAAACGGTGCGATGAAAGCAGAAATTATCGAAGTCCGCAACTACACAGTCACGGAAACGAAGGCACTTGCAGAGAAACTGGACGCGGTTAAGGTGACTGCAGACGACAGTTTCGCCATGGCACAGAACTCTATCCGCGCACAGTGGGATATGGCATCTGGTCAGGCATCGGTGGTCCACGATATGAAAGTCCGGATCCATTACAACGGTGAGGATTATTCCGCCGGTATGGTTATCGGGGCAGAGCTGAAAGGCGGTCAGGTAAACACACTTATCGGTTTTAACGCACAGAAATTCGCGTTTTATAACCCTTCCAGTAAGTCGATGGATCTGTTTATGTACATGGAGGGCGGGCAGATCTTCATGCGTGAGGCATTTATCAACCAGGCCTGGCTTAATGAAGTAGTTGTCACTGACAAAATGCAGTCGGAGAACTACGTGCCGGGTAAAACCGGATTTCTGATTGATGCTAAGGGTGGAAATGCTGAATTTAACAGTGCGACATTTCGCGGAACACTCGATGTTCGCAGCGCGGCATCAGGTGGCCGGATGGAAATTAATAACGCAATGATAGATGTTTTTGATGAAAACAATGTGTTGCGGGTCAGGATCGGGAGGTTGTCTTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
dc6bbd13daef85a2eaa9326483d851aabec3c54fa32d40e364091f3287db800a
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50