Protein
View in Explore- Genbank accession
- YAS81898.1 [GenBank]
- Protein name
- tail spike protein
- RBP type
-
TFTSPTSPTSP
- Protein sequence
-
MLHGFKMNRRLFFKTIASLSAVIPFSSISKFSNRMTNMPDITPNVVIGMPSQLFTMARSFKAVANGKIYIGKIDTDPVNPENQIQVYVENEDGSHVPVSQPIIINAAGYPVYNGQIAKFVTVQGHSMAVYDAYGAQQFYFPNVLKYDPDQLRQELSAKRGSSLITYTNPNGPGVPMPLDVRVGQTYFMSDYGVSPSSTAEENTARINSVFSSLGGQSFISQFVFDCKGVVLINGSLLLKNNMDILIHAGTEIRNVAGTNRPVFISEYWFDTISNPSDLTKQSDYLGIRGNGIINYNKSGTAPGGLNTHAICIAGVKRLKLGGGLKVGGAFKYAYLVANIDYLDAQGLEFDNQSDGLHLQPPIYHAYVRNLRGHTGDDLFAMTGGDYATYDLGTRGNFTFIDVAGLFNDNTLCAVKLAGNTGVEFKHVSVRGIHGTCQHAPVRIWADHNLTKTTVKYAGFDDISAIPGAGHALCEIYDRGLGEVFADQVVVEGVSTNLTNISTPVVDVRGSVGVTVYNLDMDVPRNSKFGFACGDGSGNDKSRIFNVNIKSKNTSLSADQYSSLCLVTRGVVDNVILSGAVDHKSAATLVQHRGGALKNITVNNITYSNGHVFRQFVANSDNSTPTLHLNNLIGTNSGKLALFHKGGVVSANNVTLLSTSGNPIETTESGIVDIYGSINYGNSLIPSTKEDGFYYRAYGFGLTVDASNLQRYGGQFCKNSNPSFSTGVGLIAFAEGTGWKNIVTGNLG
- Physico‐chemical
properties -
protein length: 747 AA molecular weight: 80434,65990 Da isoelectric point: 7,27394 aromaticity: 0,09639 hydropathy: -0,09692
Domains
Domains [InterPro]
IPR009093
ATT
38–150
ATT
38–150
IPR036730
ATT
39–148
ATT
39–148
G3DSA:2.170.14.10:FF:000001
Unmapped
39–147
Unmapped
39–147
IPR036730
ATT
44–146
ATT
44–146
IPR009093
ATT
50–140
ATT
50–140
1
747
Architecture
ATT 38-150 | STR 228-445 | RBD 552-747
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
747
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 198 | 198 | 0,9931 |
| Central domain | 199 | 693 | 496 | 0,9860 |
| C-terminal | 694 | 747 | 53 | 0,9570 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-198
1-198
Central
199-693
199-693
C-terminal
694-747
694-747
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage vB_EcoP_Z06 [NCBI] |
3464521 | No lineage information |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
YAS81898.1
[NCBI]
Genbank nucleotide accession
PX310629.1
[NCBI]
CDS location
range 14863 -> 17106
strand +
strand +
CDS
ATGTTGCATGGTTTTAAAATGAATAGAAGATTATTTTTCAAAACAATTGCATCTTTGTCTGCAGTCATTCCGTTTTCTTCAATATCTAAATTTTCAAACAGGATGACTAATATGCCTGATATAACTCCAAATGTTGTAATAGGAATGCCTTCGCAACTCTTCACTATGGCTCGTTCTTTTAAAGCCGTAGCCAATGGCAAAATTTATATCGGTAAAATTGACACTGACCCGGTAAATCCTGAAAACCAGATTCAGGTTTATGTGGAGAACGAAGATGGCTCTCACGTTCCTGTTTCTCAACCAATCATCATTAACGCTGCTGGTTACCCTGTATATAACGGACAGATTGCCAAGTTCGTAACTGTGCAAGGCCATTCTATGGCGGTTTATGATGCGTATGGTGCACAGCAATTCTATTTCCCTAATGTGCTGAAGTATGACCCTGATCAGTTAAGGCAGGAGCTTTCTGCAAAAAGAGGCTCATCACTAATCACATACACAAATCCAAATGGCCCAGGAGTTCCTATGCCTTTGGATGTGCGCGTTGGGCAAACTTATTTTATGTCTGATTATGGTGTATCACCATCTTCGACGGCAGAAGAGAATACTGCAAGGATTAACTCGGTATTTTCGTCGCTAGGCGGACAATCTTTCATTTCTCAATTTGTTTTTGACTGCAAAGGGGTCGTGTTAATTAACGGTTCACTGCTACTCAAAAACAATATGGACATTTTGATTCATGCGGGCACAGAAATTAGAAACGTAGCTGGTACAAACAGGCCCGTATTTATCAGTGAGTATTGGTTTGATACCATATCAAACCCTTCAGATCTGACTAAACAATCTGATTATCTTGGGATTCGTGGTAATGGGATTATAAATTATAACAAATCTGGTACGGCTCCAGGAGGATTGAACACTCACGCGATATGTATTGCAGGGGTTAAGCGTCTTAAGCTAGGTGGTGGACTTAAAGTTGGTGGAGCGTTCAAGTACGCTTATCTTGTAGCGAATATTGACTACCTTGATGCTCAGGGTCTTGAGTTTGACAATCAGTCCGATGGTCTTCACTTGCAACCACCCATCTACCATGCGTATGTAAGGAATCTGCGCGGTCATACCGGAGACGACTTATTCGCAATGACCGGTGGAGATTATGCAACATATGACCTGGGAACGCGCGGAAACTTCACGTTTATTGATGTCGCAGGGTTGTTTAATGACAACACACTTTGTGCTGTTAAGCTGGCGGGAAATACGGGTGTAGAGTTTAAGCATGTATCTGTACGAGGAATACATGGCACCTGCCAGCATGCCCCGGTAAGGATTTGGGCTGATCATAACCTAACAAAAACAACGGTTAAATACGCAGGATTTGATGATATATCCGCTATTCCTGGAGCGGGCCATGCACTGTGTGAAATTTACGACCGTGGCCTGGGCGAAGTGTTTGCTGATCAAGTGGTAGTGGAGGGTGTATCTACTAACTTAACTAATATATCCACGCCTGTTGTTGACGTTAGGGGGTCTGTTGGTGTCACTGTTTATAACTTAGACATGGATGTGCCAAGAAATTCTAAGTTTGGATTCGCATGTGGTGACGGATCTGGAAATGATAAATCAAGAATCTTTAACGTTAATATCAAGTCAAAAAATACTTCGTTAAGTGCTGACCAATACAGTTCATTATGTCTGGTTACTCGTGGCGTTGTGGACAACGTAATTCTCAGCGGAGCGGTGGACCATAAATCGGCGGCGACCCTTGTTCAGCATCGGGGAGGAGCCCTGAAGAATATAACCGTTAATAATATTACATATTCAAACGGTCACGTATTTAGGCAGTTTGTGGCTAATTCTGATAACTCAACTCCTACGCTGCACCTAAATAATCTAATTGGCACAAATAGCGGGAAACTTGCTTTATTCCATAAAGGAGGTGTAGTTTCAGCAAATAACGTTACACTGCTATCAACCAGTGGAAATCCGATAGAGACTACAGAGTCTGGGATTGTGGATATTTATGGTTCTATTAACTACGGGAATTCTCTAATACCATCAACTAAAGAGGATGGATTTTATTACAGAGCTTATGGATTTGGCCTAACAGTTGATGCTTCAAATCTCCAAAGATACGGTGGTCAGTTTTGCAAAAATTCAAATCCTTCATTTTCAACAGGAGTTGGGTTAATAGCTTTTGCTGAAGGTACAGGATGGAAGAATATAGTAACAGGAAATTTGGGATAG
Genome Context
Genome Context
Tertiary structure
PDB ID
7b034bc22b8e6913c022ea50ace3af3ce297723343e1241da5ce0906227e528e
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50