Protein
View in Explore- Genbank accession
- QXV71941.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TFTSP
- Protein sequence
-
MSILKKELVIKNKAGNFAEILTDYDLDSFKYEYEINNERSLTFTAYKAVGNEDIFDMLTNENYVIYDGQYFVIKSSAIKYDSQVITNEIIAKHIFMEFQNHYIDKDVEDEELNTEVTEESTPNYTMQQYIEFGFKNNPLGFTYEIVGNSNNRAPVEELGNKNGMEHIVAGVEYFNYIYFADNKKIYFYQPETFYQRANTPIIYKGNSDELTATVVTTDLKTIGLGYGKKKTKSETKNYSPIKPKDLKYSGSFTKESMWNTTEVGASYSKTFTCKWGNETLNWTRKKGSKGGKVDIYLDGAKLDSFNTYSKTSKTDSLVIAKNLDKGEHTFKAVFRGAQSGVDYKKKPAQMYIGTEKTTILNLTAVLKGSDVYYATTTYKSPNYEAFGHIQAPTIYSDSATTVAQVEEQIKEAMNDEPTVELSTNYLGEADDKRYIIEDDIKENSLVRFIHRPLGFNTELKVVKFTKYHPQAQKPNEVEFSNSKQDIISIQSQINLRIKRANSTIANGNWNVNKNVQQDFYSDVMGSVLTDG
- Physico‐chemical
properties -
protein length: 531 AA molecular weight: 60589,04540 Da isoelectric point: 5,55365 aromaticity: 0,12241 hydropathy: -0,63352
Domains
Domains [InterPro]
G3DSA:6.20.110.10
ATT
4–91
ATT
4–91
IPR044051
ENZ
8–93
ENZ
8–93
IPR010572
ENZ
114–493
ENZ
114–493
1
531
Architecture
ATT 4-91 | STR 92-374 | ENZ 375-493 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
531
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 233 | 233 | 0,7238 |
| Central domain | 234 | 520 | 288 | 0,3716 |
| C-terminal | 521 | 531 | 10 | 0,0264 |
Note: Constraints were applied during segmentation.
Fixed 33 C-terminal predictions appearing before Central domain|C-terminal too short, adjusted boundary
Fixed 33 C-terminal predictions appearing before Central domain|C-terminal too short, adjusted boundary
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-233
1-233
Central
234-520
234-520
C-terminal
521-531
521-531
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Staphylococcus phage vB_SarS_BM31 [NCBI] |
2861007 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Staphylococcus arlettae [NCBI] |
29378 | cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QXV71941.1
[NCBI]
Genbank nucleotide accession
MZ488273.1
[NCBI]
CDS location
range 15031 -> 16626
strand +
strand +
CDS
GTGAGTATTTTGAAAAAAGAACTTGTGATAAAAAATAAAGCTGGTAACTTTGCAGAAATACTTACTGACTATGACCTCGATTCATTCAAGTACGAATATGAGATTAATAATGAGCGATCACTTACATTCACAGCATATAAAGCAGTAGGTAATGAAGATATTTTCGATATGTTAACCAATGAAAACTACGTTATTTATGACGGTCAATATTTTGTTATTAAATCAAGTGCTATCAAATATGATAGTCAAGTTATTACAAATGAAATTATAGCTAAACATATATTCATGGAATTTCAGAATCACTACATTGATAAAGACGTGGAAGATGAAGAACTTAATACTGAAGTTACTGAAGAATCTACCCCTAACTACACAATGCAGCAATATATTGAATTTGGATTTAAAAATAATCCACTTGGTTTTACTTATGAGATTGTTGGAAATTCAAACAATCGAGCGCCTGTAGAAGAATTAGGTAACAAAAATGGAATGGAACATATTGTAGCAGGCGTAGAATATTTTAATTATATATATTTTGCCGATAACAAGAAAATTTACTTTTACCAACCCGAAACGTTTTACCAAAGAGCTAACACACCAATTATATACAAAGGTAATTCAGACGAATTAACGGCTACTGTAGTTACCACTGATTTAAAAACAATTGGTTTGGGTTATGGCAAGAAGAAAACCAAAAGTGAAACTAAGAACTATAGTCCAATTAAACCGAAAGATTTGAAATATTCCGGTAGCTTCACTAAAGAAAGTATGTGGAACACGACAGAGGTTGGTGCTAGTTACAGTAAAACATTTACTTGTAAATGGGGTAACGAAACACTTAATTGGACACGTAAAAAAGGTTCTAAAGGTGGAAAAGTAGATATTTATTTAGATGGTGCGAAATTAGATTCATTTAACACGTATAGCAAAACATCTAAAACAGATTCGCTAGTAATAGCTAAGAATCTTGATAAAGGTGAACATACCTTTAAAGCGGTATTTAGAGGTGCACAGTCGGGTGTGGATTATAAGAAAAAACCAGCTCAAATGTATATAGGTACAGAGAAAACGACAATATTAAACCTTACAGCAGTGTTAAAAGGTTCGGATGTTTACTATGCTACCACAACTTACAAAAGCCCTAATTATGAAGCATTTGGCCACATACAAGCACCTACAATATATTCTGATTCTGCTACTACAGTAGCTCAAGTAGAAGAACAAATTAAAGAAGCAATGAATGATGAACCAACTGTGGAATTGTCTACAAACTATTTAGGTGAAGCAGATGACAAACGTTACATCATCGAGGATGACATAAAAGAAAACAGTTTAGTTCGGTTTATTCATCGTCCACTGGGCTTTAATACAGAGTTGAAAGTAGTTAAATTCACTAAATATCATCCTCAAGCACAGAAACCTAACGAAGTAGAATTCAGCAATTCTAAGCAGGATATTATATCGATTCAAAGTCAAATTAATCTAAGAATAAAACGTGCAAATAGTACAATAGCCAACGGAAATTGGAATGTAAACAAGAATGTACAGCAAGATTTTTACAGTGACGTAATGGGGAGTGTGTTAACAGATGGCTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
4c065a1d8affda81fff61189c4264190e98e1eb2df4179cd9ee5c1f38b7b0dd5
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50