Protein
View in Explore- Genbank accession
- WBU87735.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TFTSPTSPTSP
- Protein sequence
-
MGNIKGQHQFPEQVYLWEETDPVQGGDEGIDNVPIKQLANRTQYLGDLSLKTFRDVFNKDPLGSFGMGFTLSSADQVAYDEESKTWYEWLGNIPKVVAPGRTPSNSGGIYNKETNPTGLWKEMELYQWSLIELSKPTGYSLVGTVNSFDSLRLLTNLSVGQRIKLSSYYNLGKFGGGEFIVKEGAATDDGGHICVPTNQSGVYLERVTDCVSLSDYGITTEGNSSGPRVDQSDKLQAAINRAKSLKYILDTGIASENHYIYTGIYVEKGIDITGLKTIRGCFSLLFDSTKIAGLTAPGYSNIQWALVNLNAKFNTAGIIFGTTVGNQSFDNIVVRDVSNRGASCGGQLHVTSGTMVSGALCATDVNGPGVWVLGSYDSVISDIRTVNCGNALFWAIDIAGYKGTRPDNTNCMVIDRIESHNSLDRALHCSADLSDIGEIHVEATMVTSNAVSSSATIADNGWGYANILLQGLGTTYGSVRDLPVSGSIPVVCELVADDTSIGELSLPRSNLSIHYAFTTPRGTLSAGTINLSGDVIVTNGANTNIDALTVTGESSQITSSSANFNVGILRATGANATFTGIGGRYGRLECAVVFLTGSDVARGSITNLTLGDRNTLTQVTAQTLLVNGTRNYLSDGFRVSGVSTLNGINNAASNAVFIGVVTLKDPWKFDKVYINSNLVYTGNTSSNLYDVSFQDVFVDGDLVLSGACRIHAHNLRVINLRIGTMSTGFIVLNNCVVAGGVEGNYVGSFNVPAIGSITQNFTTGIPYIYTPTGWKSLTVA
- Physico‐chemical
properties -
protein length: 780 AA molecular weight: 83164,20100 Da isoelectric point: 5,10115 aromaticity: 0,08462 hydropathy: -0,01974
Domains
Domains [InterPro]
DC_1917
ATT
33–250
ATT
33–250
G3DSA:2.10.10.80
ATT
61–127
ATT
61–127
IPR040775
RBD
64–110
RBD
64–110
1
780
Architecture
ATT 33-250 | STR 251-770 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
780
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 232 | 232 | 0,9918 |
| Central domain | 233 | 735 | 504 | 0,9919 |
| C-terminal | 736 | 780 | 44 | 0,9526 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-232
1-232
Central
233-735
233-735
C-terminal
736-780
736-780
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage EP_H11 [NCBI] |
2996156 | Viruses > |
| Host |
Escherichia coli H11 [NCBI] |
3438210 | Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Escherichia > Escherichia coli |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WBU87735.1
[NCBI]
Genbank nucleotide accession
OP688485.1
[NCBI]
CDS location
range 71487 -> 73829
strand -
strand -
CDS
ATGGGTAACATTAAAGGCCAGCATCAGTTTCCGGAGCAGGTTTATTTATGGGAAGAGACTGATCCTGTACAAGGTGGCGATGAGGGTATCGACAATGTGCCCATTAAGCAGTTAGCCAACAGGACTCAGTACCTTGGTGACTTATCCCTAAAGACTTTCAGAGATGTCTTCAATAAAGATCCTCTGGGATCTTTCGGGATGGGGTTTACTTTATCCTCAGCAGATCAGGTTGCGTACGATGAAGAATCTAAGACCTGGTATGAGTGGCTGGGAAATATCCCTAAGGTGGTTGCTCCAGGTAGAACACCTTCCAATAGCGGTGGAATTTACAATAAAGAAACTAATCCTACAGGATTATGGAAGGAGATGGAGCTTTACCAGTGGTCGCTAATTGAATTATCTAAACCCACTGGGTACTCTCTAGTAGGTACTGTTAATTCCTTCGATAGTCTGAGGCTATTAACCAATTTATCTGTTGGTCAGAGAATTAAACTATCTTCTTACTACAATCTTGGTAAATTTGGTGGTGGGGAGTTTATAGTTAAAGAGGGAGCTGCTACTGACGACGGAGGACACATCTGCGTACCAACTAATCAGTCTGGAGTTTATCTAGAAAGGGTAACAGATTGTGTAAGTCTTTCAGATTATGGTATTACAACAGAGGGAAATAGCTCTGGACCAAGAGTAGACCAATCTGATAAGCTACAAGCAGCTATCAACAGAGCAAAGTCTTTGAAGTATATTTTGGATACAGGAATTGCTTCTGAAAACCACTATATCTACACAGGTATTTATGTAGAGAAAGGTATTGATATTACCGGGTTAAAAACCATTCGAGGTTGTTTCTCTTTACTGTTTGACTCTACTAAAATTGCTGGCTTAACAGCCCCTGGTTATTCTAACATACAATGGGCTTTGGTTAACTTAAACGCTAAGTTTAACACTGCTGGCATCATCTTTGGTACTACTGTAGGTAACCAATCGTTCGATAATATTGTAGTACGCGATGTATCTAACCGGGGTGCATCCTGTGGAGGTCAGTTACATGTTACATCCGGTACTATGGTATCAGGTGCATTGTGTGCTACTGATGTCAATGGACCTGGTGTGTGGGTGCTTGGTTCCTATGATTCTGTGATTTCAGATATCCGTACAGTGAATTGCGGTAACGCTTTGTTCTGGGCTATTGATATTGCAGGTTACAAGGGTACTCGCCCTGATAATACCAACTGCATGGTCATTGACAGAATTGAGAGTCATAATTCACTAGACCGTGCCTTGCATTGTAGTGCAGACCTTTCAGACATTGGCGAGATTCACGTCGAGGCCACTATGGTTACTTCCAATGCCGTGTCAAGCTCTGCGACAATTGCCGACAATGGGTGGGGGTATGCCAACATTCTGTTGCAAGGGCTTGGGACCACCTATGGCTCTGTACGAGATTTACCTGTATCCGGTTCTATACCTGTTGTATGCGAATTGGTTGCAGATGATACTAGCATTGGTGAGCTTAGCTTGCCTCGGTCTAACCTTTCCATTCACTACGCATTCACCACACCAAGGGGTACTTTGAGTGCTGGCACTATAAACCTTTCTGGTGATGTTATTGTAACGAATGGGGCCAACACTAATATTGATGCACTGACGGTTACTGGGGAATCATCTCAAATTACTAGTTCCTCTGCCAACTTTAACGTTGGTATTTTAAGAGCTACTGGAGCTAATGCCACATTTACTGGTATTGGTGGGCGTTACGGTAGACTCGAATGTGCTGTAGTTTTCTTAACGGGTAGTGATGTAGCAAGGGGTTCTATCACTAATCTTACGTTGGGTGACCGCAATACATTAACCCAGGTTACTGCTCAGACGCTTTTGGTTAATGGTACTCGAAACTATTTGTCTGATGGTTTTAGGGTATCTGGTGTTAGTACTTTGAATGGTATTAACAACGCTGCTAGCAATGCGGTATTTATTGGTGTTGTGACTCTTAAAGATCCTTGGAAGTTTGACAAGGTATATATCAACTCTAACCTGGTTTATACAGGTAATACCTCGTCAAATCTTTATGATGTATCCTTCCAGGATGTTTTTGTAGATGGTGATTTAGTACTATCAGGAGCTTGTCGTATACATGCCCATAACCTACGCGTTATCAATTTGCGTATAGGTACTATGTCTACAGGATTTATTGTCCTAAATAACTGTGTTGTTGCTGGTGGCGTTGAGGGTAACTATGTGGGGAGCTTTAATGTTCCAGCTATCGGCAGCATCACCCAAAACTTTACCACTGGTATCCCTTATATCTATACACCGACAGGCTGGAAATCGTTAACTGTTGCTTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
5175d1078111e71589f24fb8754de8e0651ea0ad7690374a3e91db162877af22
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50