Protein
View in Explore- UniProt accession
- U5PW51 [UniProt]
- Protein name
- Tail fiber
- RBP type
-
TFTF
- Protein sequence
-
MAVRKFPIAWIGVYRADRNSYVGGDNIRVGGSADYQSYIGIPSAVRTAITTSRTSPKLRFVMNVTQGAEFDFGAHKETSNKAGGTMPYYNYIGLHPIYGTGWRTTDLTSAFMPAYRSGSRQGIVIYGARNNSGQAYGKTSNSNEAYFEVEGTWNTPPTAPQITAPTSTTVATNSLQVKWNASSDPETPTNQLTYQVQIFNGSTWSATTNLAAGVTSYTYNTSTMPETSSAQVRVRAYDGEDYSAWSNSPKFSIVRNLPPSKPTQMVPNGGRTIDRTESIRFTWKHNDDGVQAGFRIAWRTNNGEAGSWNYVNASGYRQSTNQYFDFAPNTFPAGKIEWRVSTMDQESLTSPWSDIQVFTAGIPSNAPIILTPQPNEIIPSSNITVTWSSINQRRYEVQILNGSNQVYRKSKTTTVKNAPIDFTLENNKTYTIRLRIADTQFDLWSDWTEISIQTKFTPPIKPELSIESDEEGNTIIVSWRNDPPDTSEPVNGVPTSGIVQNVQFFSNVNYLGNVDDGEIRTLYGANAKVVAPSGNIYSFDPESKQVSTGLEGTASTSTVSGAYFMFTGADPSRFSSTVNSDTFNFRVVKFEGGQWLYNDNSQTWKPFELNSDDFIIGNLKRTSTSIAGIEEFNITGDMSTPVTSRVDLYRRRFNSSIEGEWTLIHSGEANSSYTDYTPASDVTYEYYARAWGDNQSFNDSDVEEARITFVHAFLHRSLVQSDFIVMRLSDSRSEDIGRSGKFMSFAGREKPIYEFGYNTDKSVNVSWTVDTNEEYLNTVAFLTRKETFLYRDGLGRRMFCIIDGSISVDDNILSGCDFSISLKEVDFEE
- Physico‐chemical
properties -
protein length: 829 AA molecular weight: 92498,75450 Da isoelectric point: 5,07273 aromaticity: 0,12063 hydropathy: -0,51544
Domains
Domains [InterPro]
IPR013783
STR
145–259
STR
145–259
IPR003961
STR
156–248
STR
156–248
IPR003961
STR
156–260
STR
156–260
IPR013783
STR
158–259
STR
158–259
IPR036116
STR
165–255
STR
165–255
DC_1505
STR
236–610
STR
236–610
1
829
Architecture
STR 145-610 | RBD 611-829
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Bacillus phage Blastoid [NCBI] |
2880540 | Uroviricota > Caudoviricetes > Ehrlichviridae > Andromedavirus blastoid > |
| Host |
Bacillus pumilus [NCBI] |
1408 | cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
AGY46827.1
[NCBI]
Genbank nucleotide accession
KF669648
[NCBI]
CDS location
range 16518 -> 19007
strand +
strand +
CDS
ATGGCAGTAAGAAAATTTCCTATCGCATGGATTGGCGTTTATAGAGCCGACCGTAATAGTTATGTTGGCGGGGATAATATCAGGGTTGGTGGTTCAGCAGACTACCAATCCTATATTGGAATCCCCTCAGCAGTAAGAACCGCAATCACCACGTCAAGAACATCTCCTAAGTTGCGCTTTGTCATGAACGTCACACAGGGTGCCGAGTTTGACTTTGGCGCTCACAAAGAGACATCAAACAAAGCTGGCGGCACTATGCCATATTACAACTATATAGGGTTGCATCCTATTTACGGAACTGGCTGGAGAACAACAGACTTAACGAGTGCATTCATGCCAGCTTATCGCTCAGGATCACGACAAGGCATTGTCATTTACGGAGCCAGAAACAACTCAGGTCAAGCGTATGGAAAAACAAGCAACTCCAATGAGGCATACTTCGAGGTAGAAGGAACGTGGAACACTCCACCGACTGCACCACAGATTACAGCCCCCACAAGTACAACTGTAGCGACTAACTCCTTACAGGTTAAGTGGAATGCTTCTAGCGATCCAGAAACACCGACAAATCAACTAACTTATCAAGTACAAATCTTTAATGGATCAACTTGGAGCGCAACAACAAATTTGGCGGCTGGTGTAACAAGCTACACTTACAATACATCTACAATGCCTGAGACTTCAAGTGCTCAAGTAAGGGTAAGAGCATACGACGGTGAGGATTACTCCGCATGGTCTAACTCTCCTAAGTTTTCCATTGTAAGGAACTTGCCACCAAGTAAACCCACGCAGATGGTTCCCAATGGCGGTCGAACAATTGACCGTACAGAATCAATACGTTTTACTTGGAAGCATAACGACGATGGCGTACAAGCAGGGTTCAGAATTGCTTGGAGAACCAACAATGGTGAAGCTGGCTCGTGGAACTATGTTAACGCTTCTGGCTATAGACAAAGCACCAATCAGTATTTTGATTTTGCGCCCAATACGTTTCCTGCTGGAAAGATTGAATGGCGAGTCAGCACGATGGATCAGGAGTCTCTTACATCTCCTTGGTCAGACATCCAAGTCTTTACGGCTGGTATACCATCAAACGCTCCGATCATTTTAACACCACAGCCAAACGAGATTATCCCATCGTCTAACATAACAGTTACTTGGTCGAGTATCAACCAAAGACGATACGAGGTGCAAATCCTTAACGGATCAAATCAGGTCTACAGAAAGTCAAAGACCACCACAGTAAAAAACGCACCAATTGACTTTACCTTAGAAAACAACAAGACATACACTATCAGACTAAGAATTGCTGATACACAGTTTGACCTCTGGAGTGACTGGACAGAAATATCAATCCAAACAAAATTCACTCCACCAATCAAACCAGAGTTATCAATTGAGTCAGACGAGGAAGGAAACACAATTATAGTTTCTTGGAGAAATGATCCTCCTGATACCTCTGAGCCAGTCAACGGTGTTCCTACTAGTGGTATCGTACAAAACGTTCAGTTCTTTTCAAATGTAAACTATCTCGGTAATGTTGATGATGGAGAGATTCGTACACTATACGGAGCAAATGCCAAGGTTGTTGCACCTTCTGGGAACATCTATTCGTTTGACCCTGAGAGCAAGCAGGTAAGCACAGGTCTTGAAGGTACCGCCTCGACTAGTACAGTTAGCGGAGCATACTTCATGTTTACGGGTGCTGACCCTTCTAGGTTCTCCAGTACGGTTAACTCAGACACATTTAATTTTCGTGTTGTCAAGTTTGAAGGTGGGCAATGGCTCTACAATGACAACAGTCAAACTTGGAAGCCATTTGAGCTAAACAGTGATGACTTCATCATAGGTAACCTTAAAAGAACCTCAACATCCATAGCTGGTATTGAAGAGTTCAACATCACAGGTGACATGTCCACTCCTGTTACTAGCAGGGTCGACCTATATCGAAGACGATTTAATAGTTCAATTGAAGGGGAATGGACGCTGATCCACTCAGGAGAAGCCAACTCGTCTTACACGGATTATACTCCTGCTTCTGATGTCACTTACGAGTATTACGCAAGAGCTTGGGGAGATAATCAGTCTTTCAATGACTCGGATGTAGAAGAAGCTCGTATCACATTTGTTCATGCCTTCCTGCATCGCTCTTTGGTTCAAAGTGATTTTATCGTCATGAGGCTGTCAGATAGTCGGTCAGAGGATATAGGTAGATCTGGAAAGTTTATGAGCTTTGCAGGACGTGAGAAACCTATATATGAGTTTGGTTACAACACAGACAAATCAGTTAATGTATCTTGGACAGTTGACACCAACGAGGAATATTTAAACACAGTGGCTTTCCTAACGAGGAAGGAAACTTTCTTGTACCGAGATGGCTTAGGACGGAGAATGTTCTGCATCATCGACGGAAGCATTAGTGTGGATGACAACATCCTGTCTGGTTGTGACTTTAGTATTTCTCTCAAAGAGGTAGACTTCGAGGAGTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
6ccf89a4dd1f6e1441dd624c03e04949eb03d35f36a051199fd76dc48ca10c6d
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50