Protein
View in Explore- Genbank accession
- YP_009909728.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TFTFTFTSPTF
- Protein sequence
-
MGKGSSKGHTPREAKDNLKSTQLLSVIDAISEGPVEGPVDGLKSVLLNSTPVLDSEGNTNISGVTVVFRAGEQEQTPPEGFESSGSETVLGTEVKYDTPITRTITSANIDRLRFTFGVQALVETTSKGDRNPSEVRLLVQIQRNGGWVTEKDITIKGKTTSQYLASVVVDNLPPRPFNIRMRRMTPDSTTDQLQNKTLWSSYTEIIDVKQCYPNTALVGVQVDSEQFGSQKVSRNYHLRGRILQVPSNYNPQTRQYSGIWDGTFKPAYSNNMAWCLWDMLTHPRYGMGKRLGAADVDKWALYVIGQYCDQSVPDGFGGTEPRITCNAYLTTQRKAWDVLSDFCSAMRCMPVWNGQTLTFVQDRPSDKVWTYNRSNVVMPDDGAPFRYSFSALKDRHNAVEVNWIDPDNGWETATELVEDTQAILRYGRNVTKMDAFGCTSRGQAHRAGLWLIKTELLETQTVDFSVGAEGLRHVPGDVIEICDDDYAGISIGGRVLAVNSQTRTLTLDREITLPSSGTTLISLVDGSGNPVSVEVQSVTDGVKVKVSRVPDGVAGYSVWGLKLPTLRQRLFRCVSIRENDDGTYAITAVQHVPEKEAIVDNGAHFDGDLSGTVNGVTPPAVQHLTAEVTADSGEYQVLARWDTPKVVKGVSFLLRLTVAADDGSERLVSTARTTETTYRFTQLALGNYRLTVRAVNAWGQQGDPASVSFRIAAPAAPSRIELTPGYFQITATPHLAVYDPTVQFEFWFSEKRIADIRQVETTARYLGTALYWIAASINIRPGHDYYFYVRSVNTVGKSAFVEAVGRASDDAEGYLDFFKGKITESHLGKELLEKVDLTEDNASRLDEFSKEWKDANDKWNAMWAVKIEQTKDGKHYVAGIGLSMEDTEEGKLSQFLVAANRIAFIDPANGNETPMFVAQGNQIFMNDVFLKRLTAPTITSGGNPPAFSLTPDGKLTAKNADISGSVNANSGTLNNVTINENCQIKGKLSANQIEGDIVKTVSKSFPRTNSYASGTITVRISDDQKFDRQVMIPPVLFRGGKHENFNSNNQQSYWYSTCRLRVTRNGQEIFNQSTTDAQGVFSSVIDMPAGQGTLTLTFTVSSSGANNWTPTTSISDLLVVVMKKSTAGISIS
- Physico‐chemical
properties -
protein length: 1132 AA molecular weight: 124491,15550 Da isoelectric point: 5,73553 aromaticity: 0,08481 hydropathy: -0,34726
Domains
Domains [InterPro]
IPR053171
Unmapped
1–840
Unmapped
1–840
DC_0014
STR
1–1130
STR
1–1130
IPR055385
ATT
86–207
ATT
86–207
IPR036116
STR
617–719
STR
617–719
IPR003961
STR
618–701
STR
618–701
IPR003961
STR
618–710
STR
618–710
IPR003961
STR
620–715
STR
620–715
IPR013783
STR
650–717
STR
650–717
1
1132
Architecture
STR 1-85 | ATT 86-207 | STR 208-330 | ATT 331-498 | STR 499-715 | ATT 716-818 | STR 819-1132
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1132
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 990 | 990 | 0,8957 |
| Central domain | 991 | 1121 | 132 | 0,2188 |
| C-terminal | 1122 | 1132 | 10 | 0,9877 |
Note: Constraints were applied during segmentation.
Fixed 61 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Fixed 61 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-990
1-990
Central
991-1121
991-1121
C-terminal
1122-1132
1122-1132
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage 2H10 [NCBI] |
2847058 | Uroviricota > Caudoviricetes > Glaedevirus > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
YP_009909728.1
[NCBI]
Genbank nucleotide accession
NC_049950.1
[NCBI]
CDS location
range 16235 -> 19633
strand +
strand +
CDS
ATGGGTAAAGGCAGCAGTAAGGGGCATACCCCGCGCGAAGCGAAGGACAACCTGAAGTCCACGCAGCTGCTGAGTGTGATCGATGCCATCAGCGAAGGGCCGGTTGAAGGTCCGGTGGATGGATTAAAAAGCGTGCTGCTGAACAGTACGCCGGTGCTGGACAGTGAGGGGAATACCAATATATCCGGCGTCACGGTGGTGTTCCGGGCCGGTGAGCAGGAGCAGACACCGCCGGAGGGATTTGAATCCTCCGGCTCCGAGACGGTGCTCGGTACAGAAGTGAAATATGACACGCCGATCACCCGGACCATCACGTCGGCAAACATTGACCGTCTGCGTTTTACTTTCGGCGTGCAGGCACTGGTGGAAACCACCTCAAAGGGGGACAGGAATCCATCGGAAGTCCGCCTGCTGGTTCAGATACAACGTAACGGTGGCTGGGTGACGGAAAAAGACATCACCATTAAGGGTAAAACCACTTCACAGTATCTGGCCTCGGTGGTGGTGGATAACCTGCCGCCGCGCCCGTTTAATATCCGGATGCGCAGGATGACGCCGGACAGCACCACAGACCAGCTGCAGAACAAAACGCTCTGGTCGTCATACACCGAAATTATCGATGTGAAACAGTGCTACCCGAACACGGCACTGGTCGGCGTGCAGGTGGACTCGGAGCAGTTCGGCAGCCAGAAGGTGAGCCGTAATTATCATCTGCGCGGGCGTATTCTGCAGGTGCCGTCGAATTATAACCCGCAGACGCGGCAATACAGCGGTATCTGGGACGGAACGTTTAAACCGGCATACAGCAACAACATGGCCTGGTGTCTGTGGGATATGCTGACCCATCCGCGCTACGGCATGGGGAAACGTCTTGGTGCGGCGGATGTGGATAAATGGGCGCTGTATGTCATCGGCCAGTACTGCGACCAGTCAGTGCCGGACGGCTTTGGCGGCACGGAGCCGCGCATCACCTGTAATGCCTACCTGACCACACAGCGTAAGGCGTGGGATGTTCTCAGCGATTTCTGCTCGGCGATGCGCTGTATGCCGGTATGGAACGGGCAGACGCTGACGTTCGTGCAGGACCGACCGTCGGATAAGGTGTGGACCTATAACCGCAGTAATGTGGTGATGCCGGATGATGGCGCGCCGTTCCGCTACAGCTTCAGCGCCCTGAAGGACCGCCATAATGCCGTTGAGGTGAACTGGATTGACCCGGATAACGGCTGGGAGACGGCGACAGAGCTTGTGGAGGACACGCAGGCCATTCTCCGTTACGGTCGTAACGTCACGAAGATGGATGCCTTTGGCTGTACCAGCCGGGGGCAGGCACACCGCGCCGGGCTGTGGCTGATTAAAACGGAGCTGCTGGAGACGCAGACCGTGGATTTCAGCGTGGGTGCCGAAGGGCTTCGCCATGTGCCGGGTGATGTTATTGAAATCTGCGATGATGACTATGCGGGGATCAGCATCGGCGGGCGCGTGCTGGCGGTGAACAGCCAGACCCGGACGCTGACGCTCGACCGTGAAATCACGCTGCCATCCTCCGGTACCACGCTGATAAGCCTGGTTGACGGAAGTGGCAATCCGGTCAGCGTGGAGGTCCAGTCCGTCACCGACGGCGTGAAGGTAAAAGTGAGCCGTGTTCCTGACGGCGTTGCCGGATACAGCGTATGGGGGCTGAAGTTGCCGACGTTGCGCCAGCGCCTGTTCCGCTGCGTGAGTATCCGTGAGAACGACGACGGCACGTATGCCATCACCGCCGTGCAGCATGTACCCGAAAAAGAAGCCATCGTGGATAACGGGGCGCACTTTGACGGCGACCTGAGCGGCACGGTGAATGGCGTCACGCCGCCCGCGGTGCAGCACCTGACTGCCGAAGTCACCGCAGACAGCGGGGAATATCAGGTGCTGGCGCGCTGGGATACGCCGAAGGTGGTGAAGGGGGTGAGCTTCCTGCTTCGCCTGACCGTGGCAGCGGATGACGGCAGTGAGCGGCTGGTCAGCACGGCCCGGACGACGGAAACCACATACCGCTTCACGCAACTGGCGCTGGGGAACTACAGGCTGACAGTCCGGGCGGTAAATGCGTGGGGACAGCAGGGCGATCCGGCATCGGTATCGTTCCGGATTGCCGCACCGGCAGCGCCGTCTCGGATTGAGCTGACACCGGGCTATTTTCAGATAACCGCCACGCCGCATCTTGCGGTTTATGACCCGACGGTACAGTTTGAGTTCTGGTTCTCGGAAAAACGGATTGCTGATATCAGGCAGGTTGAAACCACAGCCCGCTATCTTGGCACGGCGCTGTACTGGATAGCTGCCAGTATCAATATCAGGCCGGGCCATGATTATTATTTTTACGTTCGCAGTGTGAACACCGTTGGCAAATCGGCATTCGTGGAGGCTGTCGGTCGGGCGAGCGATGATGCGGAAGGTTACCTGGATTTTTTCAAAGGCAAGATAACCGAATCTCATCTCGGCAAGGAGTTGCTGGAAAAAGTCGACCTGACGGAGGATAACGCCAGCAGACTGGATGAGTTTTCGAAAGAGTGGAAGGATGCCAACGATAAATGGAATGCCATGTGGGCTGTCAAAATTGAGCAGACCAAAGACGGCAAACATTATGTCGCGGGTATTGGCCTCAGCATGGAGGATACAGAGGAAGGCAAACTGAGTCAGTTTCTGGTTGCCGCCAATCGTATCGCGTTTATTGACCCGGCAAACGGGAATGAAACGCCGATGTTTGTGGCGCAGGGCAACCAGATATTCATGAACGACGTGTTCCTGAAACGCCTGACGGCCCCCACCATTACCAGCGGCGGCAATCCTCCGGCCTTTTCCCTGACACCGGACGGAAAGCTGACCGCTAAAAATGCGGATATCAGTGGCAGTGTGAATGCGAACTCCGGGACGCTCAACAACGTCACGATTAATGAGAACTGTCAGATTAAGGGGAAACTGTCAGCCAATCAGATTGAAGGCGATATTGTCAAAACGGTCAGCAAGTCTTTCCCCCGCACGAACAGTTATGCCAGTGGCACCATCACGGTAAGAATCAGTGATGATCAGAAATTTGACCGGCAGGTCATGATACCGCCAGTGTTATTCCGCGGTGGTAAGCATGAGAATTTCAACAGTAATAACCAACAGTCATACTGGTATTCAACCTGCCGGTTAAGAGTGACCCGCAATGGTCAGGAGATTTTTAATCAGTCCACGACGGATGCTCAGGGCGTATTTTCCTCAGTTATAGATATGCCTGCCGGACAGGGGACGCTGACACTGACATTCACCGTATCTTCATCAGGAGCGAATAACTGGACACCAACAACCAGTATCAGCGATCTGCTGGTTGTGGTGATGAAGAAATCCACAGCAGGTATCAGTATCAGCTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
47427c855ca543db91d7876eab76a44b2ec1e6e1fd6f8d585b9129ddebb917a1
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50