Protein
View in Explore- Genbank accession
- XKC20834.1 [GenBank]
- Protein name
- tail fiber
- RBP type
-
TFTSPTSPTSP
- Protein sequence
-
MSTTITNLPETSKVNDSDYLVLDQPDKTVKSTVSNFLTDTGVVLATQLKDTDGATKYPELQMSRWRDEGDPRGWGAVGDGATDDTNAITQLLAAMPDGWIVDGRNLTFKVTTLPDISKFKNAAFVYERIVGQPLTYVSAGFFDGNLTKITDTPFYNAWTQDKTFVYDNVIYAPFMAGERHGVQNLHVAWVKSGDDGQTWSMPEWLTPIHPDYNASSANKVNYHCMSMGVCGNRLYAVIETRYLSNMRLKKAELWSRPMPYYRRPTGGITISSGSTTATIVLEKHGLKVGDAVNFSNSGATGVSGNMTVASVINKDTFTVTLASAATSNIDNTGTTWHFGTRFWDSPWEITELPDVAYSTNADLCVTETHSFTVIDDDNYTFAVGYHNGDVSPRRLGILYFNNAYSDPSSFTRRTINQEYADNAAEPCIKYYDGILYLTTRGTSTSAAGSTLAMSTDLGENWNYLRFPNNVHHTNLPFAKVGNYLYIFGTERSFGEWEGEELDNRYKGTYPRTFMCKINVSSWPTSLSDVQWFNITDQMYQGHIVNSACGVGSVCVKDGWLYYIFGGEDFLSPWSIGDNSKKLWYKHDGHPADLYSYRLKITEHDFVSRDFKYGATPNRTLPVSMGTDGVRHVSAPVTFDNDVQVYSLTVTGLEHDGTQQSAVRIKLDGDYGVVAKNVPIKNPSEQRLILCGGETPYVTDGSLLQLYGSNHTYPNRAVLYAPGGAYTQNNFMPYLDGQVALGGASNRWSEVYASTGTINTSDGTLKTKPTEIEDILLKAWEDIHVISYQWLSAVAEKGDSARIHFGVIAQDVRDILINYGLMDENSTDCKYAFLCYDEYPAMYDSVVTGQKEIPLFDDEGNVVIDEEGNPVTIVEDVVETIEIIPAGSRWGIRADQMFFIEMAYQRKKLKALEERLATLESK
- Physico‐chemical
properties -
protein length: 921 AA molecular weight: 102597,28230 Da isoelectric point: 4,93547 aromaticity: 0,11509 hydropathy: -0,35277
Domains
Domains [InterPro]
DC_0079
ATT
1–39
ATT
1–39
IPR036278
STR
75–606
STR
75–606
IPR024429
ENZ
76–142
ENZ
76–142
IPR001724
Unmapped
144–168
Unmapped
144–168
IPR023366
STR
262–342
STR
262–342
IPR001724
Unmapped
333–356
Unmapped
333–356
1
921
Architecture
ATT 1-39 | ATT 70-141 | STR 142-759 | CHP 760-772 | RBD 773-824 | CHP 825-891 | RBD 892-921
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
921
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 84 | 84 | 0,9805 |
| Central domain | 85 | 420 | 337 | 0,8798 |
| C-terminal | 421 | 921 | 500 | 0,5949 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-84
1-84
Central
85-420
85-420
C-terminal
421-921
421-921
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage MirsaeidiM_Esher1 [NCBI] |
3374286 | Viruses > |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
XKC20834.1
[NCBI]
Genbank nucleotide accession
PQ438048.1
[NCBI]
CDS location
range 57054 -> 59819
strand -
strand -
CDS
ATGTCAACTACAATTACTAATTTACCCGAAACATCAAAAGTTAATGATTCTGATTACCTGGTTTTAGACCAACCTGATAAGACTGTTAAAAGCACAGTTTCCAACTTTCTTACTGACACTGGGGTGGTTTTAGCCACCCAGTTGAAAGATACAGATGGTGCTACCAAGTATCCAGAACTTCAAATGTCACGTTGGAGAGATGAAGGTGATCCTAGAGGATGGGGAGCAGTAGGTGACGGAGCAACAGACGATACTAATGCCATAACACAGCTTCTTGCTGCTATGCCTGATGGATGGATTGTTGATGGGCGTAATCTCACTTTCAAGGTTACAACACTACCAGATATAAGCAAGTTTAAAAACGCCGCTTTTGTTTACGAGCGTATTGTTGGACAACCCCTTACTTACGTATCTGCGGGTTTCTTCGATGGAAATCTGACAAAAATTACGGATACACCATTTTACAATGCTTGGACGCAAGATAAGACGTTTGTTTATGACAATGTTATATATGCACCATTTATGGCTGGCGAACGTCATGGTGTACAAAACCTCCATGTAGCGTGGGTTAAATCAGGAGATGATGGACAAACTTGGTCTATGCCAGAATGGTTAACTCCAATTCATCCTGATTATAATGCCTCTTCAGCAAACAAAGTTAACTATCATTGTATGAGTATGGGTGTATGTGGTAATCGCTTATATGCAGTGATCGAAACCCGTTACTTATCTAACATGCGATTGAAGAAAGCAGAACTTTGGTCACGTCCAATGCCTTATTATAGAAGGCCAACTGGAGGCATAACAATTAGTTCTGGGTCTACTACAGCGACAATTGTTTTAGAAAAGCATGGTCTTAAAGTTGGAGATGCTGTTAACTTTTCCAATTCAGGTGCAACTGGCGTATCTGGAAATATGACTGTTGCATCTGTAATTAACAAGGATACATTTACTGTTACATTAGCGAGTGCTGCCACATCTAATATAGATAATACAGGAACTACTTGGCATTTTGGAACACGTTTCTGGGATAGCCCTTGGGAAATTACAGAATTACCAGATGTTGCCTATTCTACTAATGCAGATTTATGTGTTACAGAAACCCATAGTTTTACAGTTATAGATGATGATAATTACACTTTTGCTGTTGGTTATCACAATGGTGATGTTTCCCCAAGAAGATTAGGTATTTTGTATTTCAATAATGCTTACTCTGACCCAAGTTCTTTTACTCGTAGAACAATTAATCAAGAATATGCTGACAATGCAGCAGAACCCTGCATTAAATATTATGATGGAATTTTATATTTAACTACTAGGGGTACTTCAACTTCTGCTGCTGGTTCTACATTAGCAATGAGTACCGACCTTGGAGAAAACTGGAATTACTTAAGATTCCCTAACAACGTTCATCATACAAACTTACCATTTGCAAAAGTTGGTAACTACCTTTATATCTTTGGTACAGAACGTTCATTCGGAGAATGGGAAGGAGAAGAACTAGATAATAGATATAAAGGCACGTATCCTCGAACGTTTATGTGCAAGATTAATGTATCTTCATGGCCTACATCTTTATCCGATGTTCAATGGTTTAATATCACTGATCAGATGTATCAAGGGCATATTGTTAATTCTGCATGTGGTGTTGGTTCGGTATGTGTTAAAGATGGTTGGTTATATTATATCTTTGGAGGCGAAGATTTCTTATCTCCTTGGTCTATTGGAGATAATAGTAAAAAATTATGGTACAAGCATGATGGTCATCCAGCCGATTTATATAGTTATAGACTAAAGATTACCGAACATGATTTTGTATCACGTGATTTCAAATATGGAGCTACGCCAAACCGTACGTTGCCTGTATCTATGGGTACAGATGGGGTAAGGCATGTCTCAGCCCCTGTAACTTTTGATAATGATGTACAAGTATACTCTTTAACAGTTACTGGCCTTGAGCATGATGGGACGCAACAATCTGCCGTTAGAATAAAATTAGACGGTGATTATGGGGTTGTTGCAAAAAATGTCCCAATAAAAAATCCTTCTGAACAGCGACTAATCCTATGTGGAGGAGAAACTCCTTACGTTACGGATGGATCGCTATTACAACTATATGGTTCAAACCATACGTATCCAAACAGAGCAGTTTTATATGCCCCAGGAGGAGCATATACCCAAAATAATTTCATGCCGTATTTAGATGGACAAGTTGCATTAGGCGGTGCGTCTAACAGATGGTCAGAAGTGTACGCATCTACAGGAACCATTAATACTTCGGATGGAACATTAAAAACTAAACCTACAGAGATTGAAGATATTTTACTGAAAGCATGGGAAGATATTCATGTAATCTCTTACCAATGGCTTAGTGCTGTCGCGGAGAAAGGAGATTCTGCGCGTATTCATTTTGGTGTTATAGCTCAAGATGTAAGAGATATTCTGATTAATTATGGTTTAATGGATGAAAATAGCACTGATTGTAAGTATGCTTTTCTGTGTTATGATGAATACCCTGCTATGTACGATAGTGTTGTTACGGGACAAAAAGAAATCCCTTTATTTGATGATGAAGGGAATGTTGTAATTGATGAAGAAGGTAATCCAGTAACAATCGTAGAAGATGTTGTAGAAACTATCGAAATAATTCCAGCAGGATCGCGATGGGGTATCCGCGCTGACCAAATGTTTTTTATTGAGATGGCTTATCAACGTAAAAAGTTAAAAGCTCTTGAAGAAAGACTTGCAACCCTGGAAAGTAAATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
558a6054c70408e78c38ece0c561f05eeb2de8ab538fd90ab50eedb4d49d8cac
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50