Protein
View in Explore- UniProt accession
- O64335 [UniProt]
- Protein name
- Gp21
- RBP type
-
TFTSPTF
- Protein sequence
-
MATSTPIRGRKGGSSSSRTPTEQPDDLQSVAKAKILVALGEGEFAGQLTAKDIYLDGTPLENADGSQNFSGVAWEFRPGTQAQNYIQGIPGTENEISVGTEVSSATAWTHTFTNTQLSAVRLRLKWPSLFKQEDDGDLVGYSINYAIDLQTDGGTWQTVLNTSVTGKTTSGYERSHRIDLPQAGSTWTVRIRKLTADANSAKIGDKMTLQSYTEVIDAKLRYPNTALLYIEFDSSQFNGSIPQISCEPRGRVIRVPDTYDPETRTYNGTWLGTFKWAWTDNPAWIFYDLVVSDRFGLGDRLTAANIDKWTLYQVAQYCDQPVPDGKGGSGTEPRYTCNVYVQERNDAYTVLRDFAAIFRGMTYWGGDQIVALADMPRDVDYSYTRANVVDGRFTYSGSTTKTRYTTALVSWSDPGNAYADAMEPVFEQELVSRFGSNQLEMTAIGCTRQSEANRKGRWGILTNNKDRVVSFNVGLDGNIPQPGYIIAVADELLSGKVMGGRIRAVNGRVITLDRDSAAAAGSRLMVNLPSGASQSRTIQSVNGRAVTVTTAYSETPEVESVWIVESDELYAQQYRVISVADNNDGTFSISGVFHDPDKYARIDTGAIIDQRPISVIPPGNQSAPANIVISSFSVVQQNVSVETMRVSWDQAKNAIAYEAQWRRNDGNWVNVPRSSTTSFDVPGIYAGRYLVRVRAINAAEISSGWGYSEEKTLTGKVGNPPKPVGFTATGINWGIRLNWGFPANTGDTLKTEIQYTANSDFSDPLLLTDVPYPSSEYIQLGLKAGQEFWYRAQLVDRTGNESGYTDWIRGMSNDNADDYLGDLADDFMKAEDGERLTGDIDTNIEGILQNALANHGTVEHQWAQYGEVRADILVVKTTIAEVDRAMAEMSTQVQAQISDVTAALEDKLTAVVDASGASAIYTLKAGVRINGIMYNAGMSIAVLAQAGQPIVTRVGFNANQFVLMSGSGDTQYSPFAVVNGQVFISSAFIQDGTITNAKIGNFIQSNNYVAGQSGWKLDKGGTWENYGSDGEGARKTTNVTDSIRDANGVLRVQIGKITGVF
- Physico‐chemical
properties -
protein length: 1061 AA molecular weight: 115800,22050 Da isoelectric point: 4,87186 aromaticity: 0,09425 hydropathy: -0,34552
Domains
Domains [InterPro]
DC_0014
STR
1–1061
STR
1–1061
IPR053171
Unmapped
5–845
Unmapped
5–845
IPR055385
ATT
92–218
ATT
92–218
IPR013783
STR
622–714
STR
622–714
IPR003961
STR
623–717
STR
623–717
IPR003961
STR
628–702
STR
628–702
IPR036116
STR
637–702
STR
637–702
1
1061
Architecture
STR 1-91 | ATT 92-218 | STR 219-342 | ATT 343-505 | STR 506-1061
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1061
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 540 | 540 | 0,7658 |
| Central domain | 541 | 1003 | 464 | 0,0414 |
| C-terminal | 1004 | 1061 | 57 | 0,7359 |
Note: Constraints were applied during segmentation.
Fixed 60 C-terminal predictions appearing before Central domain
Fixed 60 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-540
1-540
Central
541-1003
541-1003
C-terminal
1004-1061
1004-1061
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage N15 [NCBI] |
1604876 | Uroviricota > Caudoviricetes > Ravinvirus > |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
AAC19057.1
[NCBI]
Genbank nucleotide accession
AF064539
[NCBI]
CDS location
range 15342 -> 18527
strand +
strand +
CDS
ATGGCTACATCTACTCCGATTAGAGGCCGCAAGGGCGGCAGCTCCAGTTCCCGCACCCCTACCGAACAACCAGACGATCTCCAGTCCGTAGCGAAGGCCAAGATTCTTGTTGCGCTGGGAGAGGGGGAATTTGCCGGGCAGCTAACGGCTAAAGATATTTATCTTGATGGCACACCACTTGAGAACGCTGATGGGTCGCAGAACTTTAGCGGCGTGGCGTGGGAGTTCCGTCCGGGGACTCAGGCTCAAAACTACATCCAGGGAATCCCCGGTACCGAGAATGAAATCAGCGTCGGTACCGAAGTTTCAAGCGCTACCGCCTGGACGCACACCTTTACCAATACCCAACTGTCAGCTGTTCGTCTGCGGCTCAAATGGCCATCGCTGTTTAAACAGGAGGACGACGGCGATCTGGTTGGCTATTCGATTAACTACGCTATTGATCTGCAGACCGATGGCGGCACCTGGCAGACGGTGCTTAATACCAGCGTAACCGGGAAAACAACATCCGGCTACGAGCGCAGCCACCGTATCGACTTACCACAGGCGGGAAGCACATGGACGGTACGCATTCGCAAGCTCACGGCAGATGCCAATAGCGCGAAAATAGGCGACAAGATGACGCTGCAGAGCTACACAGAGGTCATTGACGCCAAACTGCGTTATCCAAATACCGCGCTGCTGTACATCGAATTCGACTCAAGCCAGTTTAACGGCTCTATCCCGCAAATATCCTGCGAACCGCGAGGGCGTGTTATCCGCGTACCGGATACTTACGACCCAGAAACCCGCACTTATAACGGCACCTGGCTGGGGACGTTTAAATGGGCATGGACTGATAATCCGGCCTGGATTTTTTACGATCTGGTGGTGAGTGACCGCTTTGGCCTTGGCGACCGCCTGACGGCAGCAAATATTGATAAATGGACGCTTTACCAGGTTGCACAATATTGCGATCAGCCGGTACCAGACGGAAAAGGCGGTTCCGGCACCGAGCCTCGCTATACCTGTAACGTGTATGTGCAGGAGAGGAATGACGCTTATACCGTTTTGCGTGATTTTGCGGCCATATTCCGTGGCATGACGTACTGGGGCGGCGATCAAATCGTTGCGCTGGCTGATATGCCCCGCGATGTGGATTACAGCTATACGCGCGCTAATGTGGTTGACGGCCGTTTTACCTATTCAGGCAGCACCACGAAAACCCGCTACACCACGGCACTGGTTTCCTGGTCCGATCCGGGCAACGCCTATGCAGACGCGATGGAGCCTGTATTTGAACAGGAACTCGTGTCCCGCTTTGGTTCAAACCAGCTCGAAATGACAGCTATTGGTTGTACCCGACAGTCAGAGGCAAACCGTAAGGGGCGCTGGGGTATCCTGACCAATAATAAGGATCGCGTCGTATCGTTCAATGTCGGTCTGGACGGCAACATTCCACAGCCCGGTTATATTATTGCGGTTGCCGATGAGCTGCTATCCGGGAAGGTGATGGGAGGGCGTATCAGAGCGGTTAATGGTCGCGTCATTACTCTAGATCGTGATTCTGCAGCAGCAGCCGGAAGCCGCCTCATGGTTAACCTGCCGTCTGGCGCATCGCAGAGCAGGACGATACAGAGCGTAAACGGTCGGGCGGTCACCGTGACCACGGCATACAGCGAAACGCCGGAAGTAGAATCGGTGTGGATTGTCGAATCCGACGAGCTTTATGCGCAGCAATATCGCGTTATTAGCGTCGCTGATAATAATGATGGAACGTTTTCGATTTCGGGTGTTTTTCACGATCCGGATAAGTATGCCCGTATTGATACCGGCGCAATCATCGACCAGCGACCAATAAGCGTTATTCCTCCAGGTAACCAGTCTGCGCCAGCCAATATTGTGATCAGCTCGTTTTCGGTGGTTCAGCAGAATGTCAGCGTTGAGACCATGCGCGTCAGCTGGGACCAGGCGAAAAACGCAATTGCCTATGAGGCACAGTGGCGTCGTAATGACGGGAACTGGGTGAATGTGCCGCGCAGCTCCACCACATCCTTCGATGTTCCGGGCATTTACGCAGGACGCTATCTGGTTCGTGTGCGTGCCATAAATGCCGCCGAAATTTCGTCCGGATGGGGCTATTCAGAAGAGAAAACGCTGACGGGGAAAGTGGGCAATCCGCCAAAGCCTGTTGGATTCACGGCCACGGGCATTAACTGGGGGATTCGTCTGAACTGGGGGTTTCCGGCAAACACCGGCGATACGTTAAAAACGGAAATCCAGTACACAGCTAATAGCGACTTTTCAGATCCTTTGCTGCTTACCGACGTCCCATATCCCTCATCTGAATATATCCAGCTTGGACTGAAGGCTGGGCAAGAGTTCTGGTACCGCGCGCAGCTGGTCGACAGAACGGGTAACGAGTCCGGGTATACCGACTGGATAAGGGGGATGTCTAACGATAATGCCGATGATTATCTTGGCGATCTTGCAGACGACTTTATGAAGGCGGAGGACGGGGAGCGTCTTACCGGTGATATAGATACCAATATTGAGGGAATACTGCAGAACGCGCTGGCCAATCATGGAACAGTCGAGCATCAATGGGCGCAATACGGAGAAGTTCGTGCCGATATTCTTGTAGTCAAAACGACTATTGCTGAAGTTGACAGGGCAATGGCCGAAATGTCAACTCAGGTGCAGGCGCAGATAAGCGACGTCACTGCGGCACTGGAGGACAAACTTACCGCCGTGGTCGATGCCTCCGGCGCTTCGGCGATCTACACCCTTAAAGCAGGCGTGAGGATAAACGGCATCATGTATAACGCAGGGATGTCGATTGCCGTTCTGGCGCAGGCAGGGCAGCCGATTGTTACCCGCGTAGGTTTCAACGCTAACCAGTTCGTGCTGATGAGTGGCAGTGGTGATACCCAGTATTCGCCGTTCGCGGTGGTTAATGGCCAGGTCTTTATCAGCTCTGCGTTTATCCAGGATGGCACGATCACGAATGCCAAAATCGGTAATTTTATCCAGTCCAACAATTATGTCGCCGGGCAGTCCGGGTGGAAACTGGATAAAGGAGGTACCTGGGAAAACTACGGCAGCGACGGGGAGGGCGCAAGAAAGACTACGAATGTAACGGACAGCATCAGGGACGCGAACGGCGTTCTCCGCGTACAGATTGGTAAAATTACGGGGGTATTTTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
56eb5fe89641c79469e3960b124ad4b0e95ae0b5de8adc796ed96d6aea0c2e68
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50