Protein
View in Explore- Genbank accession
- WNL49409.1 [GenBank]
- Protein name
- hypothetical protein
- RBP type
-
TSP
- Protein sequence
-
MNKNIRILQFLVSILYSVQSHFSGAQTIQLNGNGIPESITRSITGVDGNAALNISVPYKTSYTQNILSVESSINIKGGTSNTSIGGAGVYGKNFTLNNNGSVWGGDGYNGGIAVSGNKISINNYRNVYGGNGLGGSGSSGGAGLSGDDIIVDNYRSIYGGDDVGGTGGSGVTGSNITVHNSGGILGGNGVNGGDGINGSNLFITNDNMISGGYGIKQGGDAISGNQITLNNNGIVQGGYGPDGGCSVYGEDIHINNHGNLSGLYNSQKDAYNTSIIFSGGYNSLDIYSDSVINGDIKLASIPVNGTNELIIKNINNATAINGGLMIGNGSSVYLSGKNSIFNGNISIDEDASMNLSVGNANVHANTITLKSDSWLNIDTSIKNWTQDYYTLLSSDTGISIADNSHIVQYNVLLTEGAESYVYTSLNDDDNKLISMLRWNNTKGMGYGTFNIEKDATLNIGVSLSDNLSPLLYDGWDGKSLTKSGNGTLILSATNNYTGNTEVKSGVLILAAPDALGRTEYLYLSRGAELDMNGYPQTISKLLTAAGSVLNIHGGSLILNNGGESAGTIAGDGSLNINGGMLDITGNNRNFSGVFTVNKGAHLAVSTADNLGTAFVDNYGTLTLNSTSAWQLTNNISGYGNVRKTGAGALNISDNAKWTGMTDIIQGTVILGNADSPVMLGSNQVIVEEQGKLSGFGGVAGNLSNSGIVDLTTYMPGNILTVGGNYTGRNGLILLQTETGGDNSKTDRLVIKGNASGRTRVAVTQAGGTGAETLNGIEVIHVSGNADNAEFIQTGRITAGAYDYILKRGQGINSTNWYLISRKDIPVPQPEAVPESHDNNLRPEAGSYVASIAAANNLFVTNLYERQGQELYISHMTGEENEAGIWMYNKGKHNRWRDNSSQLRTRGNSYVVLIGGDIAQWSLNGTDRWHTGMMAGYGHNNNSTNALSTGYHSEGRMNGYTAGLYATWYANDETHNGSYLDSWLQYSWFDNHINGERLPAESWKSKGFTVSLEAGYSWKAGEFTDNYKGSHEWYVQPQLQVVRMNVKSDKYHESNGTSIENTGNGNILTRLGARTWLTSKNGKNTRYAVPFRPFVEAHWLHNSRVFGTSMNGVSIYQDGARDIGEINGGVVGMITPEVAFRADAGIQLGEHGYHNTSAMLSVEYRF
- Physico‐chemical
properties -
protein length: 1165 AA molecular weight: 123559,52070 Da isoelectric point: 5,34215 aromaticity: 0,08240 hydropathy: -0,32335
Domains
Domains [InterPro]
IPR054553
STR
374–437
STR
374–437
IPR013425
STR
479–509
STR
479–509
IPR013425
STR
480–508
STR
480–508
IPR043990
CHP
607–825
CHP
607–825
IPR013425
STR
642–669
STR
642–669
IPR043990
CHP
717–805
CHP
717–805
IPR005546
RBD
885–1143
RBD
885–1143
1
1165
Architecture
STR 374-437 | STR 448-825 | RBD 839-1165
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1165
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 67 | 67 | 0,6519 |
| Central domain | 68 | 862 | 796 | 0,7693 |
| C-terminal | 863 | 1165 | 302 | 0,2504 |
Note: Constraints were applied during segmentation.
Fixed 14 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain
Fixed 14 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-67
1-67
Central
68-862
68-862
C-terminal
863-1165
863-1165
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage phi456 [NCBI] |
3075925 | No lineage information |
| Host |
Escherichia coli MC1061 [NCBI] |
1211845 | Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Escherichia > Escherichia coli |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WNL49409.1
[NCBI]
Genbank nucleotide accession
OR339795
[NCBI]
CDS location
range 49743 -> 53240
strand -
strand -
CDS
ATGAATAAGAATATACGAATTTTACAATTTCTGGTCAGTATACTTTATTCTGTGCAGTCTCATTTTTCTGGTGCGCAAACAATACAACTGAATGGTAATGGTATACCTGAAAGTATAACCAGGAGTATTACAGGTGTTGATGGAAACGCGGCGCTTAATATCAGCGTGCCGTATAAAACAAGTTATACTCAAAATATACTATCTGTTGAAAGCAGTATTAACATCAAAGGAGGAACAAGCAATACATCAATCGGTGGTGCAGGTGTCTACGGTAAAAACTTTACGCTAAATAATAATGGTAGTGTTTGGGGAGGAGATGGATATAATGGTGGAATTGCTGTTAGTGGCAACAAAATATCTATAAACAATTACAGAAATGTATATGGGGGTAATGGTCTTGGTGGCTCAGGAAGTAGCGGAGGTGCAGGGTTAAGCGGGGATGATATTATAGTTGATAATTACAGAAGTATATACGGAGGTGATGATGTAGGTGGGACAGGTGGTTCCGGTGTAACCGGTAGCAATATTACAGTGCATAATTCCGGAGGAATATTGGGCGGTAATGGCGTAAACGGTGGTGATGGTATTAATGGTAGTAATCTTTTCATTACTAACGACAACATGATATCTGGAGGATATGGAATAAAACAAGGGGGAGATGCTATTTCTGGAAATCAAATCACTTTGAATAATAACGGTATTGTTCAGGGGGGATATGGCCCCGACGGTGGTTGCTCTGTTTATGGAGAAGATATCCATATTAATAATCATGGTAATCTTTCAGGATTATATAATAGCCAAAAAGATGCTTATAATACATCAATAATTTTTTCTGGCGGGTATAATTCATTAGATATTTATTCAGATTCTGTGATTAATGGTGATATTAAACTAGCTAGTATACCTGTTAATGGTACAAATGAATTAATTATTAAAAACATCAATAACGCAACAGCAATTAATGGTGGGCTAATGATTGGGAATGGCTCATCTGTTTATCTGTCAGGTAAGAACTCCATTTTTAACGGAAATATAAGTATTGATGAAGACGCATCTATGAACCTGTCTGTAGGAAATGCTAATGTTCACGCAAATACTATTACATTAAAAAGTGATTCATGGCTTAATATAGACACATCAATTAAGAACTGGACTCAGGACTATTACACATTATTGTCGTCAGACACAGGTATCTCGATCGCTGATAATAGTCACATTGTACAATACAATGTATTACTGACAGAAGGTGCTGAAAGTTATGTTTATACGTCTTTAAATGACGACGATAATAAACTGATATCCATGCTGCGATGGAATAATACAAAAGGGATGGGATATGGAACCTTTAATATAGAAAAAGATGCCACTCTGAACATAGGCGTTTCTCTTTCCGATAATCTTTCACCTTTATTATATGATGGCTGGGACGGCAAAAGTCTGACAAAATCAGGTAATGGTACTCTTATACTTTCTGCAACAAACAATTATACAGGAAATACAGAGGTTAAATCTGGCGTATTAATTCTTGCTGCACCTGATGCTCTTGGTCGGACTGAGTATTTATATTTATCCCGTGGCGCAGAACTGGATATGAATGGGTATCCTCAGACAATAAGCAAACTACTGACGGCTGCAGGCTCTGTGCTGAACATTCATGGCGGAAGTCTGATACTGAATAATGGAGGAGAATCTGCAGGTACTATTGCAGGGGATGGTTCTCTGAACATAAATGGGGGAATGCTTGATATAACGGGTAATAATCGTAATTTTTCCGGTGTTTTTACCGTGAATAAGGGGGCTCATTTGGCTGTATCCACGGCTGATAATCTGGGGACAGCCTTTGTTGATAACTATGGCACATTAACTCTGAACAGTACATCAGCATGGCAGCTTACCAACAATATCAGTGGTTATGGTAATGTTCGCAAGACGGGAGCAGGTGCACTGAACATTAGCGATAACGCAAAATGGACCGGGATGACAGATATTATTCAGGGGACAGTGATACTGGGGAACGCAGATTCACCGGTGATGCTCGGCAGTAACCAGGTCATTGTTGAAGAGCAGGGCAAACTCTCCGGGTTTGGGGGCGTTGCAGGAAATCTGAGCAATAGTGGTATAGTCGATCTCACTACATATATGCCGGGTAATATACTGACTGTCGGAGGGAATTACACTGGCAGAAATGGACTTATTCTCCTCCAGACAGAAACAGGTGGTGACAATTCGAAAACAGATCGTCTGGTGATTAAAGGTAATGCCAGTGGCCGTACCCGTGTCGCTGTTACTCAGGCCGGTGGTACTGGTGCAGAGACACTTAATGGGATTGAAGTGATTCACGTCAGTGGCAATGCTGATAATGCTGAATTCATTCAGACGGGACGTATTACAGCCGGAGCTTATGATTACATACTGAAACGTGGTCAGGGGATTAACAGCACTAACTGGTATCTGATTAGCAGAAAAGACATTCCTGTACCACAACCTGAAGCTGTACCGGAAAGCCATGATAATAATTTGCGTCCTGAGGCAGGTAGCTATGTTGCCAGTATTGCTGCTGCAAATAATCTGTTTGTAACGAATCTGTATGAACGACAGGGACAGGAGTTGTATATCAGCCACATGACAGGAGAAGAAAATGAAGCAGGTATCTGGATGTATAATAAAGGAAAACATAATCGCTGGCGTGACAACAGTAGTCAGCTGAGAACCCGGGGGAATAGCTACGTTGTGTTAATAGGGGGAGATATAGCTCAGTGGAGCCTGAATGGTACCGATCGCTGGCATACAGGTATGATGGCTGGCTATGGTCATAATAATAACAGTACGAATGCCCTGAGCACCGGATACCATTCGGAAGGAAGAATGAATGGATACACAGCGGGTCTTTATGCAACATGGTATGCCAATGATGAAACACACAATGGTTCTTATCTTGATAGCTGGCTGCAATACAGCTGGTTTGATAATCATATAAATGGAGAACGGCTGCCTGCTGAGTCATGGAAGTCAAAAGGGTTTACGGTATCTCTGGAAGCAGGATATTCATGGAAGGCTGGAGAGTTTACCGACAATTACAAGGGAAGTCATGAATGGTATGTTCAGCCGCAGCTTCAGGTTGTCCGGATGAATGTAAAATCAGACAAATATCATGAAAGTAACGGAACCAGTATTGAAAATACCGGTAACGGAAATATTCTCACCCGCCTGGGAGCAAGAACATGGCTTACCAGCAAAAACGGTAAAAATACGCGGTATGCGGTTCCGTTCAGACCATTTGTGGAGGCACACTGGTTGCACAATAGTCGTGTTTTCGGCACCAGTATGAATGGTGTAAGTATATACCAGGATGGTGCGCGTGATATCGGAGAAATAAATGGTGGTGTTGTGGGAATGATAACACCAGAAGTAGCATTCCGGGCTGATGCAGGCATTCAACTTGGAGAACATGGATACCATAATACATCTGCCATGTTGAGTGTGGAATATCGTTTCTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
fd08f6aee3073d4607bc56291f67bfb6c7a551be6762701e13fe8930368efc04
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50