Protein
View in Explore- Genbank accession
- WPA89768.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TF
- Protein sequence
-
MRKMTPIIILSIFLTLIKLVPAYAIDPTAPPASPTGVTVSGVKDTTAYVAWDPVPYATQYSIYVNGNRWMGTTGPGVELTGLQPNSQYSVYVTAANDLGESGPSSSVSFMTSPPPPTMPNTPVVSRVTDSSASVTWEALPPYQQIKVYRLYVDGQPVADVQPQAGGLQAASLQNLTPGVHSVAVAGVNDYGEGPRSTTAQFNIRSIPAPTGLQLYNHSADTLWLTWDKSEGVASYQVLINGQKIGETEANIFMVKGLQPSQAYQVGLVAIYSDGNVSNTATIQAYTTPAPEEITINSFIGAINPYLNDLMPAFTIVFAIGAAFMVARAARTIFRGGRLRII
- Physico‐chemical
properties -
protein length: 341 AA molecular weight: 36366,89700 Da isoelectric point: 5,39831 aromaticity: 0,09091 hydropathy: 0,06100
Domains
Domains [InterPro]
IPR036116
STR
20–201
STR
20–201
IPR013783
STR
28–108
STR
28–108
IPR050991
Unmapped
29–178
Unmapped
29–178
IPR036116
STR
30–201
STR
30–201
IPR003961
STR
30–114
STR
30–114
IPR003961
STR
31–101
STR
31–101
IPR003961
STR
31–109
STR
31–109
IPR003961
STR
33–108
STR
33–108
1
341
Architecture
STR 20-290 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Moorella phage MCACPph1 [NCBI] |
3090775 | Viruses > |
| Host |
Moorella sp. ACPs [NCBI] |
3062783 | Bacillota > Clostridia > Neomoorellales > Neomoorellaceae > Neomoorella > |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WPA89768.1
[NCBI]
Genbank nucleotide accession
OR602863.1
[NCBI]
CDS location
range 13162 -> 14187
strand +
strand +
CDS
ATGAGAAAAATGACACCGATAATCATTCTATCTATATTTCTAACCCTCATTAAACTGGTCCCTGCCTATGCTATAGACCCGACAGCGCCGCCGGCTTCACCAACCGGGGTAACCGTATCCGGGGTGAAGGATACAACAGCCTATGTAGCCTGGGACCCGGTTCCTTATGCTACGCAGTATAGCATTTATGTGAACGGCAACAGGTGGATGGGAACAACCGGGCCGGGTGTGGAGTTAACCGGCTTGCAGCCCAATAGCCAGTATAGCGTTTATGTCACAGCAGCTAACGATTTAGGCGAAAGCGGTCCATCTTCTTCAGTATCTTTTATGACCTCGCCACCGCCGCCAACCATGCCTAATACCCCGGTAGTGAGCCGGGTAACAGATAGTAGCGCCTCAGTAACCTGGGAAGCCCTGCCGCCATACCAGCAAATTAAGGTTTACCGCTTATATGTGGACGGCCAGCCGGTGGCCGATGTGCAGCCACAGGCCGGGGGCCTCCAGGCTGCCAGCTTGCAGAACCTGACACCAGGGGTCCACTCGGTAGCGGTAGCTGGAGTGAACGACTATGGGGAGGGCCCCCGATCTACAACAGCACAATTCAATATCCGGTCAATACCTGCCCCTACAGGATTACAGCTATATAATCATTCCGCAGATACCCTTTGGTTGACCTGGGATAAGTCAGAAGGGGTAGCCAGCTACCAGGTGCTTATCAACGGCCAGAAAATAGGGGAGACAGAGGCAAACATCTTTATGGTCAAAGGCCTCCAGCCAAGCCAGGCTTATCAGGTGGGTTTGGTGGCGATATATTCGGATGGGAACGTCTCTAATACTGCTACTATCCAGGCTTATACAACGCCAGCGCCAGAAGAGATAACCATAAACTCATTTATTGGCGCTATAAACCCCTATCTAAATGATTTGATGCCTGCTTTTACAATTGTTTTCGCTATTGGCGCCGCCTTTATGGTGGCTAGAGCTGCGAGAACAATTTTTCGAGGGGGGAGGTTGCGGATAATATGA
Genome Context
Genome Context
Tertiary structure
PDB ID
e5667d70300e0777961b42ddc6f5efe9e865bda5c907eee216419917331f51a3
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50