Protein
View in Explore- Genbank accession
- UGO52994.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MGKGGGGKARTPVEDKDTIESSQMISVIDLWSEGQIYGLVDGLKSVLLDNTAVVAKDGSVNIPGVDISYNLGTEDQEYLDGFPQNASEISVGVEVKQSAPVIRTITDPRIDMLRINLYSRALFVITNDGDTKRTDLKMRVETRKGSEPWEVKARIDFIDQKSRNEFSFKAEIWDLPAAPFDVRVVRETSDDQTGDFQQIQNSSFWRSYSQVINQKYRWPLTAYMGLKFDSKSFEGAIPRRNYIVRGMIVKVPTNYDPETRKYNGFWNGQFKAAYTNNPAWIVYDIIKNPRYGLGRRGINIEETEMYKAAQWCDQLVPDGRGGMEPRVTCNCYITEQRNAWDLITDIMSCFRAMPLWNGQQFVPSLDIAKDVVATYNNSNVINGTFEYSASSMEDRHSVIEVRYANKANNYEQDTVQITDDLMIEQYGWNVLKVEAFGTDTESQAYRFGSYLLETERLERKTVSFSTGAEGLRNLPGDVIAIADSRQYGRIIGGRIMSVSEDRKSIELDDEVEIPNNAETLIIVIGDDRKPVELLCTNNPGKAKVLNFSTTCPDSLGRLSPWSLKINNSGLKLWRCVSVKENDDGTYAINCVEHVPEKNEIVDNGVKFNPPEETLYGNNLPPVENISVEAIVENPNANVRVYWDTPRTARQIRYNVRIYRSGNLVTNQNIDDPSLSFMADTAGTYRAEVRCLGSDGKLGDSVDVVFVIAEPSMPSDVSWRASNFTVTLRPIPGGLVTIGEVYEWFIGSTEQEVLAMNNNLGEAFVLNQVGLKPNTEYWFGVRAVNMIGRSKIKTVLTKTAFETESLEGLINVALPKTDYIQDMNKDIEGLGELASLRVVDKNGGRPRVTGVYLNAGDAGNNIASVIDFVADAVSISSPDTLERWVYFXFNQQAIGSWW
- Physico‐chemical
properties -
protein length: 897 AA molecular weight: 100497,80630 Da isoelectric point: 4,86038 aromaticity: 0,09375 hydropathy: -0,38002
Domains
Domains [InterPro]
DC_0323
STR
1–895
STR
1–895
IPR053171
Unmapped
3–791
Unmapped
3–791
IPR055385
ATT
87–213
ATT
87–213
IPR003961
STR
619–789
STR
619–789
IPR036116
STR
634–796
STR
634–796
IPR003961
STR
706–802
STR
706–802
IPR003961
STR
769–790
STR
769–790
1
897
Architecture
STR 1-86 | ATT 87-213 | STR 214-333 | ATT 334-499 | STR 500-711 | ATT 712-802 | STR 803-895 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
897
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 821 | 821 | 0,9080 |
| Central domain | 822 | 886 | 66 | 0,8235 |
| C-terminal | 887 | 897 | 10 | 0,0842 |
Note: Constraints were applied during segmentation.
Fixed 35 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Fixed 35 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-821
1-821
Central
822-886
822-886
C-terminal
887-897
887-897
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Serratia phage vB_SmaS_Niamh [NCBI] |
2902689 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
UGO52994.1
[NCBI]
Genbank nucleotide accession
OL539455.1
[NCBI]
CDS location
range 22467 -> 25160
strand +
strand +
CDS
ATGGGAAAAGGTGGAGGCGGTAAAGCAAGAACGCCCGTCGAAGACAAAGATACCATCGAGTCTAGTCAGATGATATCTGTGATTGACCTTTGGTCAGAAGGTCAGATTTATGGGCTTGTGGATGGGCTTAAAAGCGTGCTGCTTGACAACACGGCAGTGGTGGCAAAGGACGGTTCTGTAAACATTCCTGGGGTTGATATTTCATATAACCTTGGAACCGAAGACCAGGAATATCTAGACGGATTTCCGCAAAACGCTTCGGAAATAAGTGTTGGCGTAGAGGTAAAACAATCAGCGCCAGTAATCAGGACTATTACAGACCCGCGAATCGATATGCTACGCATAAATCTTTATAGTCGCGCACTGTTTGTAATAACGAATGATGGAGACACTAAGCGCACGGATTTAAAAATGCGCGTAGAGACCAGGAAAGGCTCTGAGCCTTGGGAGGTAAAGGCGCGTATTGACTTCATAGACCAGAAATCAAGAAATGAGTTTTCTTTCAAGGCTGAAATATGGGATTTACCGGCTGCGCCATTTGACGTGCGAGTAGTTCGCGAAACGTCAGACGACCAGACCGGTGACTTCCAGCAGATTCAAAATTCATCTTTCTGGCGTTCTTATTCGCAGGTTATTAACCAAAAATATCGATGGCCTTTAACTGCGTATATGGGTCTTAAATTTGACTCCAAATCATTTGAGGGCGCAATACCTCGAAGAAATTATATTGTTCGCGGAATGATTGTTAAGGTTCCTACAAACTACGACCCGGAAACCAGGAAGTATAACGGATTCTGGAACGGTCAGTTTAAGGCGGCCTACACAAATAACCCGGCGTGGATTGTTTACGATATTATCAAAAACCCACGTTACGGCCTTGGTCGTCGCGGAATTAATATCGAAGAAACGGAAATGTACAAGGCCGCGCAATGGTGTGACCAGCTTGTGCCTGATGGGCGTGGTGGAATGGAGCCTAGGGTTACATGCAATTGCTATATCACCGAACAGAGAAATGCGTGGGACTTAATAACCGATATAATGAGCTGCTTCCGAGCGATGCCGTTATGGAACGGTCAGCAATTTGTGCCGTCTCTTGATATTGCGAAAGACGTTGTAGCTACATATAACAATTCAAACGTAATTAACGGCACGTTTGAATATAGCGCTTCGTCTATGGAAGACCGCCACTCAGTTATAGAAGTTCGTTACGCAAATAAAGCGAATAACTATGAACAGGACACTGTTCAAATAACTGACGACTTGATGATAGAGCAATACGGCTGGAACGTGTTAAAGGTTGAGGCTTTTGGTACTGATACCGAATCACAGGCTTACCGCTTCGGCTCTTATTTGCTTGAAACTGAAAGGCTGGAAAGGAAGACCGTTTCCTTCTCAACTGGCGCTGAGGGTTTAAGAAACCTTCCTGGCGACGTAATAGCAATTGCTGATTCGCGCCAATACGGCCGAATTATTGGCGGCAGGATTATGTCTGTTTCGGAAGACAGAAAAAGCATCGAGCTTGATGATGAGGTTGAAATTCCTAACAACGCAGAAACTTTAATTATAGTTATCGGCGATGACAGGAAACCAGTTGAGCTTTTATGCACTAACAATCCTGGCAAGGCGAAGGTTTTGAATTTTTCCACCACTTGCCCCGATAGTTTGGGTCGCTTGTCTCCTTGGTCGCTAAAAATAAATAACAGCGGTCTAAAGCTTTGGCGCTGCGTTAGTGTTAAGGAAAATGACGATGGAACTTATGCCATTAACTGCGTTGAGCATGTGCCGGAGAAAAACGAGATTGTAGATAATGGGGTAAAATTCAATCCGCCTGAAGAAACTCTGTATGGAAATAACTTGCCGCCGGTTGAAAATATCAGCGTAGAAGCCATAGTAGAAAACCCAAACGCAAATGTTAGGGTTTATTGGGATACGCCAAGAACAGCTAGGCAGATTCGATACAATGTTAGAATCTATCGCTCGGGTAATTTGGTTACAAATCAAAATATCGACGACCCATCACTTTCTTTCATGGCAGATACGGCAGGAACTTACCGAGCAGAAGTTCGCTGTTTGGGTTCTGATGGCAAGCTGGGTGATAGCGTGGATGTTGTTTTTGTCATTGCTGAGCCTTCAATGCCTTCCGATGTTTCTTGGAGAGCATCAAACTTCACGGTTACGTTGAGGCCAATTCCTGGCGGCCTGGTTACTATTGGCGAGGTTTACGAGTGGTTTATAGGCTCAACTGAGCAAGAGGTTTTAGCTATGAATAACAACCTTGGCGAAGCTTTCGTTTTAAACCAGGTTGGGCTAAAGCCAAATACTGAATATTGGTTCGGCGTTCGAGCGGTTAATATGATTGGCCGTTCCAAGATAAAAACCGTTCTGACTAAAACCGCTTTCGAAACTGAATCTCTTGAGGGTCTTATTAACGTTGCCTTGCCAAAAACAGACTATATCCAGGACATGAACAAGGACATAGAAGGCCTTGGCGAGCTTGCGTCTCTCAGGGTTGTTGACAAAAACGGCGGAAGGCCTCGCGTAACTGGTGTTTATCTAAACGCCGGTGATGCAGGAAACAACATAGCTTCGGTGATTGATTTTGTCGCTGATGCCGTCTCAATCTCAAGCCCTGACACGCTAGAGCGCTGGGTGTACTTTNGATTCAACCAACAGGCGATTGGTTCTTGGTGGTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
12147059526e1ab6dc1eebc634c5dfd813ed634d13512f142feca566553969bf
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50