Protein
View in Explore- Genbank accession
- WZP35041.1 [GenBank]
- Protein name
- tail protein
- RBP type
-
TSP
- Protein sequence
-
MICSNKPNYTPFELTSLAPTKQWGLGRSAGYERFNPEEFHALEDTFKITFPVDFRGKVKGSLTPNPSIAEGHNDQMYPENILRGSKFLSKPTLLFNGAEYNESTLSNGAAVATTQRANQGLMFYWEEFINPIKRIKEGDLVTFSVDVRSTGEDIPTNAVAFKGTSNFEDYYHVIEQPVTKEFTRITYSTRFLSENWEWDEAFAMFWGAENPPVTDYPSFKYDKNKLAGFIQAEDSIQLEFARPMVSVVGASNYIEAGEDFYSANKWDFKKATQWAYINYQGIWKTKNTGGAQKEDWAMKEFIPIKDGASKLSVYKLTTQTVPPNKDNVYGNIAFYSAANEESFVSAKLLGNETGKYGGYLSIADIPTGAAYYRIGISAVKGDASARVFVQQSNDNWTEFRQEWYNAIANKLDGNVARAETVYRKEPVAMQFNIDFKSAVEKVLPKVFADLSTDEEKQQRLRGLADIFTTSVTARSITQGVGGLDLYFLRWLPDGTKRQSVVQKLYGKGLTTVVHPSTYQEWINPKGEVVSFVKSNKLVADNLYNGEDTLSGYMDSIMDTVKLEVNGVITDITAEVNRDASSFVFKGLAGKLKESDNVRLLGYYSKEANKQYFAKLFWANKPADVEEYNQLPFIEVDHVVMTASITVTQSQLDEWGFNPNLPDYRMESLERPISTTEEYMFGSMVQVTHAYDVYGYVESNYPEFFGDCYTFDDRIRKINERIKEFNLVATPIDTDEVPLGSREVLASAEARNPDRDYLIKTELGQTVEMTINNSKGHFIHSNGYIYVGFARKTPSDRESSMALDSSLSFSFLMDRQYDSLPRVFRYNYQKQPWFLFVRNINRSVLAPKVNSLTPINGGTRRYNFGASEDARYISMDCFIKAPAEEDMPKLMEELADFLDVGETVIQFSDNKDRYYKVMLDGSTDLSQTLHVGTLTLTFIMLENTAVGKQVVETVEIDSTEGSVPFIELNNMGTADAYPTYQLTFDEPAGYVDLVGTDTSANVSIGRRPKDTNDETKVDLRPRKFYSKFTATDGAGWMNMNDLQLPNFEGVSAKLQGSVQRANGIGNQNKWNYGDTNHKGHHGAGIIANLQKNVDDFYLEASVVATGKPVKNSLNAIFVVFYDENNSPIAYMKVGSRPQDGNLDCYVAYASDWTKRRTLYNGAKWKDFWGKVSVQRRDNRWRLVVGQYSNRKTNPAPESVFNYGQGMLKDTKDTGWFDLPSESWGKKFARVGVFFSQYHNRPKLGHLSLRRLIVWENLENYRENPIEGTPIMFHEGDTVVIDSNKAQTYLNGELTPALVDPMTDWFPITKGDNYIGVNNFKGKIDIVYNERFK
- Physico‐chemical
properties -
protein length: 1331 AA molecular weight: 150851,28560 Da isoelectric point: 5,34596 aromaticity: 0,12547 hydropathy: -0,49459
Domains
Domains [InterPro]
DC_0142
STR
1–823
STR
1–823
DC_0077
STR
692–1331
STR
692–1331
G3DSA:2.40.30.200
ATT
821–941
ATT
821–941
IPR008841
STR
861–939
STR
861–939
1
1331
Architecture
STR 1-820 | ATT 821-941 | STR 942-1331
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1331
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 29 | 29 | 0,9515 |
| Central domain | 30 | 246 | 218 | 0,4565 |
| C-terminal | 247 | 1331 | 1084 | 0,1713 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-29
1-29
Central
30-246
30-246
C-terminal
247-1331
247-1331
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Enterococcus phage vB_Efs10_KEN05 [NCBI] |
3138312 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Pseudomonas aeruginosa HIM-6 [NCBI] |
29322 | Bacillota > Clostridia > Eubacteriales > Eubacteriaceae > Eubacterium > |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WZP35041.1
[NCBI]
Genbank nucleotide accession
PP582181
[NCBI]
CDS location
range 24925 -> 28920
strand +
strand +
CDS
ATGATATGTTCTAATAAACCTAATTATACACCATTTGAATTAACTAGTCTAGCCCCTACTAAACAGTGGGGCTTAGGCCGTTCTGCTGGCTATGAAAGATTTAACCCAGAGGAGTTCCACGCCTTAGAGGACACCTTTAAGATTACTTTCCCAGTAGACTTTAGAGGAAAGGTTAAAGGAAGCTTAACACCGAATCCTTCTATCGCTGAAGGACACAATGACCAAATGTATCCCGAAAACATCTTGCGAGGAAGTAAATTCTTATCTAAGCCTACTTTACTTTTCAATGGAGCTGAGTATAACGAATCAACACTTTCAAACGGAGCAGCGGTCGCTACTACTCAACGTGCTAACCAAGGACTAATGTTTTACTGGGAAGAGTTCATTAATCCTATCAAGAGAATTAAAGAAGGCGACTTGGTTACTTTCTCAGTGGATGTACGAAGCACTGGAGAAGACATTCCAACAAACGCTGTAGCCTTTAAAGGAACTTCTAACTTCGAGGACTACTACCACGTTATTGAACAGCCTGTGACAAAAGAGTTCACACGGATTACTTACTCTACTAGATTCCTTTCTGAGAACTGGGAATGGGACGAAGCTTTCGCAATGTTCTGGGGAGCAGAGAATCCACCAGTTACTGACTACCCTTCTTTCAAGTATGATAAGAATAAGTTAGCTGGATTTATTCAAGCAGAAGATAGCATTCAGTTAGAGTTTGCACGACCAATGGTATCTGTTGTAGGAGCTTCTAATTACATTGAGGCTGGGGAAGACTTTTACTCAGCTAACAAATGGGATTTCAAGAAAGCTACTCAATGGGCTTACATTAACTATCAAGGAATATGGAAAACAAAAAACACTGGTGGAGCTCAAAAAGAAGACTGGGCTATGAAAGAGTTTATTCCAATTAAAGACGGAGCTAGTAAACTATCTGTGTATAAACTTACGACACAAACTGTTCCGCCTAACAAGGATAACGTATATGGAAACATCGCCTTCTACTCAGCTGCTAACGAAGAGTCTTTTGTGTCAGCTAAGTTACTGGGAAATGAAACAGGTAAGTACGGAGGCTATCTATCAATCGCTGACATTCCTACTGGAGCAGCTTATTACCGTATTGGTATCTCAGCTGTTAAGGGAGACGCTTCTGCTAGGGTATTCGTACAACAGTCTAATGACAACTGGACAGAGTTTCGTCAAGAGTGGTACAACGCTATCGCTAACAAGCTTGATGGAAACGTAGCAAGAGCTGAGACAGTTTACCGTAAAGAGCCTGTGGCAATGCAATTCAATATCGACTTCAAGAGTGCTGTTGAGAAAGTCCTTCCTAAAGTATTCGCTGACCTTTCTACGGACGAAGAGAAACAACAACGTCTAAGAGGTTTAGCTGACATCTTCACAACGTCAGTTACAGCACGCTCTATCACACAAGGAGTCGGAGGACTTGACCTATACTTCTTGAGATGGTTGCCTGACGGAACTAAGCGACAGTCAGTTGTACAGAAGCTTTACGGAAAAGGATTGACAACAGTTGTTCACCCATCGACTTACCAAGAGTGGATTAACCCTAAAGGTGAGGTAGTATCGTTTGTTAAGAGTAATAAGCTTGTTGCAGACAACCTTTACAATGGCGAGGATACACTTTCAGGGTATATGGATTCCATCATGGATACTGTCAAGCTTGAGGTTAACGGAGTTATTACAGACATTACGGCTGAGGTTAACCGAGACGCTAGCTCATTCGTGTTTAAAGGACTTGCTGGAAAGCTTAAAGAAAGCGACAACGTAAGACTTCTTGGTTACTACTCTAAAGAAGCCAACAAGCAATACTTCGCTAAGCTGTTCTGGGCAAACAAACCAGCCGATGTAGAAGAGTATAACCAACTGCCTTTCATTGAAGTTGACCACGTAGTTATGACGGCCTCTATTACAGTTACTCAATCACAGCTTGACGAGTGGGGATTTAATCCGAACCTTCCTGACTACCGTATGGAATCTTTAGAGAGACCTATCTCAACAACTGAAGAGTACATGTTTGGCTCAATGGTTCAAGTCACACACGCTTACGATGTATACGGATATGTGGAAAGCAATTACCCAGAGTTCTTTGGAGACTGCTACACATTCGACGACCGTATCAGAAAGATTAACGAACGTATCAAAGAGTTTAACCTAGTGGCCACTCCAATTGACACTGACGAAGTTCCTCTAGGCAGTAGAGAGGTTCTTGCGAGTGCTGAGGCAAGAAACCCTGATAGAGACTACTTGATTAAGACGGAGCTAGGCCAGACTGTTGAAATGACAATCAATAATTCTAAGGGACACTTTATCCATTCTAATGGTTATATATATGTGGGATTCGCTCGTAAGACACCTAGTGACCGAGAATCTTCAATGGCCCTTGACTCAAGCTTATCATTTAGCTTCTTGATGGACAGACAGTACGACAGCCTTCCAAGAGTCTTCCGATACAACTATCAGAAGCAGCCTTGGTTCTTGTTTGTAAGAAATATTAACAGAAGCGTTCTTGCCCCTAAAGTAAACTCTCTAACACCTATCAACGGAGGTACGAGACGGTATAACTTTGGAGCTTCAGAAGACGCTCGGTATATCTCAATGGACTGCTTTATCAAAGCTCCTGCCGAAGAGGATATGCCTAAGTTGATGGAAGAGCTTGCTGACTTCCTAGACGTTGGAGAAACGGTAATCCAATTCTCTGATAACAAAGACCGCTACTATAAGGTTATGCTAGATGGTTCAACAGACCTTTCTCAAACGCTTCACGTAGGAACGTTAACACTGACTTTCATAATGCTTGAGAATACCGCTGTAGGTAAACAGGTTGTGGAAACTGTTGAGATAGACAGTACAGAAGGCTCTGTACCATTTATCGAGCTTAACAACATGGGTACAGCAGACGCTTATCCAACCTATCAGTTAACCTTTGACGAGCCAGCTGGATATGTCGACCTTGTTGGTACAGACACTTCAGCTAACGTATCAATTGGACGCCGACCTAAAGACACTAACGATGAAACTAAAGTAGACCTACGTCCACGTAAGTTCTATAGTAAGTTTACCGCCACGGATGGAGCCGGATGGATGAACATGAACGACTTACAGCTTCCTAACTTTGAAGGGGTTTCTGCTAAGCTTCAAGGAAGCGTTCAAAGAGCCAACGGAATTGGTAATCAGAACAAGTGGAACTACGGCGACACGAATCATAAAGGACACCATGGAGCAGGCATTATTGCCAACCTTCAAAAGAACGTTGACGACTTCTATTTAGAAGCTTCTGTGGTAGCTACAGGTAAGCCTGTTAAAAACTCTCTGAATGCTATCTTCGTAGTATTCTATGACGAGAATAACAGCCCTATAGCCTACATGAAAGTTGGTTCAAGACCTCAAGATGGTAACCTAGACTGTTACGTGGCTTATGCAAGCGATTGGACTAAACGTAGAACGCTTTATAACGGAGCCAAGTGGAAAGACTTCTGGGGCAAGGTTTCTGTACAGCGTAGAGATAACCGCTGGAGATTAGTTGTTGGACAATACTCTAACAGAAAGACTAACCCAGCTCCTGAATCAGTTTTCAACTATGGCCAAGGAATGCTTAAAGACACTAAGGACACAGGTTGGTTCGACCTTCCGTCAGAGTCTTGGGGCAAGAAGTTTGCCAGAGTTGGAGTGTTCTTCAGTCAATATCATAACCGACCTAAACTAGGCCACTTGTCACTACGTAGATTAATCGTGTGGGAAAACTTAGAGAACTACAGAGAGAATCCTATTGAAGGAACTCCAATCATGTTCCATGAAGGCGACACGGTTGTAATTGACTCAAACAAAGCTCAAACATACCTTAATGGAGAATTAACGCCAGCTTTAGTAGACCCTATGACCGACTGGTTCCCAATTACCAAAGGGGATAACTACATTGGAGTTAATAACTTTAAAGGTAAGATTGACATAGTATATAACGAACGATTTAAATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
c375bc27b4b71d347b73e917c51fb61c1535fe94265f13c5e7725414a344690a
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50