Protein
View in Explore- Genbank accession
- XOF08707.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TFTSPTFTF
- Protein sequence
-
MADYKLSELNSIDTIRSDDLLHVRVKKRPEMLGDEDRRMTYQDFLASFKLERFVQIAGSTMTGDLGIVKLLYGGKVVFNPTGSSEINIGDVLKTFKINANGLKLTIADASRSATVYHTLNKPSPNELGMRTNEENDARYARLAVNNTFRGTQAILSDNEALIIKNITQGAPLYLRGQDADGTNRWYLGNDNRGTHNLVLKNVKSDVSIAILENLVTVNRTLQIAGQVQPSSFANLDARYFTQTVANQRFAQLAGNNTFSGSNIFTNFVVKKNANAITLQNVDTTAALYIQARKSDGTNKWYIGNDGDENIVNIYNYLAKTQISLGNTITMSRTVQIGGQVQPSDWTNIDSRYIPAATLSNLPKLNVSNTFTNVQTIVSNNEGLVLRNLTQGQPLYIRGVDTENVSRWWLGVGGPNSNVVTLNNNYSDTKISLGGTSVMANKSLAITGQVQPSDWSNLDARYYTQSAANARYMLASITDTASEKDGDGVAWNAKTGLYKVTNSTGQSSALVYHLFLGTSSTPSAQLKFSFKNGGMWYRSSRDNYGFEASWSKVYTEAQKPTPSEIGAYTKAETDQKIATAISDSTDLNKIYPVGIVTWFNSNVDPNTALPGLTWTYLNNGVGRTIRIAAANGSDVATTGGSDSVTLAVGNLPSHTHSFSATTSSFDYGTKNTNSTGAHTHSVSGTAASAGQHAHKISQGDNANVSSGRVASSNSRQTHVGWTENDGAHTHSVSGTAASAGGHAHSVGIGAHSHTVSGNTGGTGSGSAFSVTNQFYKLMAWVRTA
- Physico‐chemical
properties -
protein length: 783 AA molecular weight: 84255,24950 Da isoelectric point: 9,02926 aromaticity: 0,08046 hydropathy: -0,37803
Domains
Domains [InterPro]
DC_0032
ATT
1–268
ATT
1–268
G3DSA:6.20.80.10
STR
158–219
STR
158–219
IPR048388
ATT
159–248
ATT
159–248
1
783
Architecture
ATT 1-268 | ATT 273-360 | STR 361-380 | ATT 381-474 | STR 475-720 | RBD 721-783
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
783
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 76 | 76 | 0,8593 |
| Central domain | 77 | 275 | 200 | 0,2043 |
| C-terminal | 276 | 783 | 507 | 0,8138 |
Note: Constraints were applied during segmentation.
Fixed 10 C-terminal predictions appearing before Central domain
Fixed 10 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-76
1-76
Central
77-275
77-275
C-terminal
276-783
276-783
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage EcoM2 [NCBI] |
3390905 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
XOF08707.1
[NCBI]
Genbank nucleotide accession
PQ818761.1
[NCBI]
CDS location
range 79429 -> 81780
strand +
strand +
CDS
ATGGCAGATTACAAGTTGAGTGAATTAAACTCAATCGATACAATCCGTTCAGATGACCTTCTCCATGTCAGGGTTAAAAAGAGACCTGAAATGCTTGGTGATGAAGACCGTCGAATGACCTATCAAGACTTCTTAGCATCTTTTAAACTTGAAAGATTTGTTCAGATTGCTGGTAGCACTATGACGGGTGACTTAGGGATTGTTAAGTTACTTTATGGTGGTAAGGTAGTATTTAACCCAACAGGCTCTTCTGAGATTAATATTGGGGATGTTTTAAAGACTTTTAAAATCAATGCAAATGGCCTTAAACTAACTATTGCAGATGCTTCAAGGTCGGCAACCGTTTATCATACTCTGAATAAGCCAAGTCCTAATGAGCTTGGTATGAGAACTAATGAAGAGAATGATGCAAGATATGCAAGACTTGCTGTAAATAACACCTTTAGAGGCACTCAAGCTATCCTCTCTGACAATGAAGCACTCATTATCAAAAATATCACTCAAGGTGCTCCACTCTATCTTCGTGGTCAAGATGCAGATGGTACTAACAGATGGTATCTAGGTAATGATAATAGGGGTACACATAATCTTGTATTAAAGAATGTAAAGTCCGACGTTTCAATTGCTATTTTAGAGAATTTGGTGACAGTCAACAGGACTCTTCAAATTGCTGGTCAAGTTCAACCTTCAAGTTTTGCTAACTTAGATGCTAGATATTTTACCCAGACAGTAGCTAATCAGAGGTTTGCACAGTTAGCTGGTAATAACACATTTAGTGGCTCTAATATTTTCACTAATTTTGTTGTTAAGAAGAACGCTAATGCTATTACTCTGCAAAATGTAGATACAACTGCTGCTTTGTATATCCAAGCAAGAAAATCAGATGGAACTAATAAGTGGTACATTGGTAATGACGGTGATGAGAACATTGTAAACATCTATAACTATTTAGCAAAAACACAAATCTCATTAGGCAACACCATTACCATGAGTAGAACAGTCCAAATTGGTGGTCAAGTGCAACCTTCTGATTGGACTAACATCGACTCTAGATATATTCCAGCAGCCACTTTGAGTAATCTCCCTAAACTTAATGTCTCTAATACTTTCACAAATGTGCAGACTATTGTATCTAACAATGAGGGTTTGGTATTAAGGAACTTGACACAGGGGCAGCCACTATATATCCGTGGTGTTGATACCGAGAATGTCTCTAGATGGTGGTTAGGTGTAGGTGGCCCAAACTCTAATGTGGTAACACTGAATAACAACTACTCTGACACTAAAATCTCACTTGGTGGTACATCAGTAATGGCTAATAAGAGTTTAGCTATCACTGGACAGGTACAACCTTCTGATTGGTCTAACTTAGATGCTAGGTACTATACCCAATCCGCCGCAAACGCAAGGTATATGCTAGCAAGTATCACTGATACAGCTTCTGAAAAGGATGGTGATGGTGTTGCATGGAATGCAAAAACAGGTCTCTATAAGGTTACTAACTCAACGGGCCAGTCTTCTGCACTTGTGTATCACCTGTTTTTGGGCACTAGTTCTACGCCCTCTGCACAATTAAAGTTTAGCTTTAAAAATGGTGGGATGTGGTATAGGTCATCAAGAGATAATTATGGTTTTGAGGCTAGCTGGTCCAAAGTTTACACGGAAGCACAAAAGCCAACTCCTTCAGAGATTGGTGCATATACTAAAGCAGAGACTGACCAGAAGATTGCAACAGCAATTAGTGACTCTACAGACCTGAATAAAATCTACCCAGTGGGTATTGTAACGTGGTTTAATAGTAATGTTGACCCTAATACAGCACTTCCTGGGTTAACTTGGACGTACCTGAACAATGGTGTTGGTAGGACTATCAGAATCGCAGCAGCAAACGGTTCGGATGTTGCTACAACAGGCGGCTCAGATTCTGTGACGTTAGCTGTTGGTAACTTACCATCACATACCCATAGTTTCTCTGCTACCACTTCATCTTTTGATTATGGTACAAAGAACACTAATAGTACTGGTGCACACACTCACTCAGTTAGTGGTACTGCTGCATCTGCTGGACAACACGCGCACAAGATTTCACAGGGTGATAACGCTAACGTTTCATCAGGTAGAGTCGCGTCTTCAAACTCTAGACAGACCCATGTTGGTTGGACTGAAAATGATGGTGCACACACTCACTCAGTCAGTGGTACTGCTGCATCTGCTGGGGGGCACGCTCACTCTGTAGGTATTGGTGCTCACAGTCACACAGTAAGTGGTAACACTGGTGGTACAGGTTCTGGTTCAGCATTTAGTGTTACTAACCAGTTCTACAAGTTAATGGCTTGGGTAAGAACTGCTTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
99ed6eec460f7c386f0852824dae0cf84b0683c9d98e22b9363a449d389e4a25
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50