Protein
View in Explore- Genbank accession
- XNS37534.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MATDKVLKGRKGGSSSSRTPTEQPDDLQSVAKAKILVALGEGEFAGQLTGKDIYLDGTALENADGSQNFSGVTWEFRAGTQAQKYIQGIPGTENEISVGTEVSSATAWTRTFTNTQLSAVRLRLKWPSLFKQEDDGDLVGYSVNYAIDLQTDGGTWQTVLNTSVTGKTTSGYERSHRIDLPQAGSTWTIRLRKITSDANSAKIGDTMTLQSFTEVIDAKLRYPNTALLYIEFDSSQFNGSIPQISCEPRGRVIRVPDTYDPETRTYSGTWTGAFKWAWTDNPAWIFYDLVVSDRFGLGHRLTAANIDKWTLYQVAQYCDQMVPDGKGGNGTEPRYTCNVYIQDRNDAYTVLRDFAAIFRGMTYWGGDQIVALADMPRDVDYSYTRANVVGGRFTYSSSTTKSRYTTALVSWSDPGNAYADAMEPVFEQALVARYGFNQLEMTAIGCTRQSEANRKGRWGILTNNKDRVVSFDVGLDGNIPQPGYIIAVADELLSGKVMGGRISAVNGRVIKLDRVADAAAGDRLILNLPSGVSQSRTIQAVNGESVTVTTAYSETPQAEAVWVVESDELYAQQYRVISVSEKDDGTFSITGAWHDPDKYARIDTGAIIDQRPVSVIPPGNQSPPANIVISSFSVVQQNISVETMRVSWDQAQNAIAYEAQWRRNDGNWVNVPRSSTTSFDVPGIYAGRYLVRVRAINAAEISSGWGYSEEKTLTGKVGNPPKPVGFIASENVVFGIELNWGFPANTDDTLKTEIQYSLTGTEDDAMLLADVPYPQRKYQQMGLKAGQIFWYRAQLVDRSGNESGYTEWVRGQASIDVSDITDVILEEIKDSDTFKDLIENAVDSNEKIAGMADDIKQANDELELQAQEIAKNAQDIGEVQTSVNELSSTVGDVSSSLSELEQTVATADTALGQRIDSISVSMDGMTGGVKNSAIAIIQNGLAQVATRKSLSASVAGNSAQLDRIDEVIVNEKEATARSLLSLQTDVNGNKASINSLNQTFSDYQQATATQINGITATVNGHTSAITTNAQAIANVNGDLSAMYNIKVGVSSNGQYYAAGMGIGVENTPSGMQSQVIFLADRFAVTTAAGNSVALPFVIQNGQTFIRASFIQDGTIENAKIGNYIQSNNYVAGSAGWKLDKGGTFEINGVAGGGRMLISSTLIRIYDSNNVLRVRMGLW
- Physico‐chemical
properties -
protein length: 1178 AA molecular weight: 127928,68830 Da isoelectric point: 4,79121 aromaticity: 0,08404 hydropathy: -0,30475
Domains
Domains [InterPro]
DC_0014
STR
1–1178
STR
1–1178
IPR053171
Unmapped
5–880
Unmapped
5–880
IPR055385
ATT
92–218
ATT
92–218
IPR003961
STR
622–702
STR
622–702
IPR003961
STR
623–717
STR
623–717
IPR003961
STR
628–702
STR
628–702
IPR036116
STR
637–702
STR
637–702
1
1178
Architecture
STR 1-91 | ATT 92-218 | STR 219-342 | ATT 343-505 | STR 506-1178
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1178
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 539 | 539 | 0,7897 |
| Central domain | 540 | 1119 | 581 | 0,0352 |
| C-terminal | 1120 | 1178 | 58 | 0,9372 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-539
1-539
Central
540-1119
540-1119
C-terminal
1120-1178
1120-1178
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage LMessi [NCBI] |
3233702 | Viruses > |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
XNS37534.1
[NCBI]
Genbank nucleotide accession
PP925823.1
[NCBI]
CDS location
range 16241 -> 19777
strand -
strand -
CDS
ATGGCTACAGATAAAGTGTTAAAGGGCCGCAAGGGCGGCAGCTCCAGTTCACGAACTCCTACCGAACAGCCTGATGATCTGCAATCTGTAGCGAAGGCAAAAATCCTCGTTGCGCTTGGCGAAGGGGAGTTTGCAGGTCAGCTAACCGGCAAAGATATCTACCTGGACGGAACAGCCCTGGAGAATGCTGACGGCTCCCAAAACTTCAGCGGCGTAACGTGGGAGTTTCGCGCGGGAACGCAGGCGCAAAAATATATTCAGGGTATTCCCGGTACCGAAAACGAAATCAGCGTAGGAACTGAGGTATCAAGCGCTACAGCATGGACGCGCACCTTTACCAATACGCAGCTTTCAGCAGTTCGCCTACGTCTGAAATGGCCCTCGCTTTTCAAACAGGAGGACGACGGCGATCTGGTGGGTTACTCGGTCAATTATGCGATTGACCTGCAGACGGACGGCGGCACATGGCAGACGGTACTCAATACCAGCGTGACCGGCAAAACGACGTCTGGTTATGAGCGCAGCCACCGTATTGATTTACCGCAGGCTGGCAGCACCTGGACAATACGCCTGCGTAAGATTACCTCTGACGCCAACAGCGCGAAGATCGGCGACACGATGACGCTGCAGAGCTTCACCGAGGTGATTGACGCCAAACTGCGCTACCCGAACACCGCGCTGCTCTACATCGAATTTGACTCAAGCCAGTTCAACGGCTCTATTCCTCAAATTTCATGCGAACCGCGCGGCCGCGTTATCCGCGTTCCAGATACCTACGACCCTGAAACTCGCACTTATAGCGGTACATGGACCGGTGCGTTTAAGTGGGCATGGACGGATAACCCTGCGTGGATTTTTTACGACCTGGTTGTTTCTGACCGGTTCGGCCTCGGGCACCGTTTGACCGCTGCAAATATTGATAAATGGACGCTTTATCAGGTTGCTCAGTATTGTGATCAGATGGTACCAGACGGCAAAGGGGGCAACGGTACCGAACCACGTTATACCTGCAACGTGTACATTCAGGACCGGAACGACGCCTACACAGTCCTGCGTGATTTTGCCGCTATCTTCCGTGGCATGACCTACTGGGGCGGGGATCAGATTGTGGCCCTGGCTGACATGCCGCGCGATGTTGATTACAGCTACACGCGCGCTAACGTTGTTGGCGGTCGCTTCACCTATTCGAGCAGCACCACGAAAAGCCGCTACACCACAGCGCTGGTTTCATGGTCAGACCCTGGTAACGCTTATGCCGACGCGATGGAGCCGGTTTTTGAGCAGGCACTGGTGGCGCGATACGGCTTCAATCAGCTGGAAATGACAGCCATCGGCTGCACCAGGCAGTCAGAAGCGAACCGAAAGGGGCGCTGGGGTATTCTCACCAACAACAAGGATCGCGTTGTTTCGTTTGATGTCGGGCTGGACGGCAACATTCCGCAGCCGGGCTACATCATCGCCGTGGCAGACGAGCTGCTATCCGGAAAGGTTATGGGCGGCCGCATCAGCGCCGTTAACGGTCGCGTTATCAAACTTGACCGCGTGGCAGATGCAGCAGCGGGTGATCGCCTTATTCTCAACTTACCATCCGGAGTGTCGCAGAGCAGGACCATTCAGGCCGTAAACGGGGAATCAGTCACAGTAACCACGGCATACAGTGAGACGCCACAGGCCGAAGCTGTTTGGGTGGTTGAATCTGACGAGCTCTATGCGCAGCAGTATCGTGTTATCAGCGTTTCCGAAAAGGATGATGGCACGTTCTCGATTACTGGCGCATGGCACGACCCGGATAAATATGCCCGTATCGATACCGGAGCCATTATCGACCAGCGGCCGGTGAGCGTGATCCCGCCTGGTAACCAGTCGCCGCCTGCGAACATCGTGATCAGCTCGTTTTCCGTGGTTCAGCAGAATATCAGCGTCGAAACGATGCGCGTGAGCTGGGACCAGGCGCAGAACGCTATCGCCTATGAAGCGCAGTGGCGCCGCAACGACGGGAACTGGGTTAACGTGCCGCGCAGCTCCACAACGTCATTCGACGTCCCCGGAATTTATGCCGGGCGCTACCTGGTGCGCGTGCGCGCAATCAATGCCGCAGAAATTTCATCCGGATGGGGCTATTCAGAAGAGAAAACGCTGACGGGTAAAGTGGGCAATCCACCGAAGCCGGTTGGCTTCATCGCTTCTGAAAATGTGGTATTCGGTATCGAACTAAATTGGGGATTCCCGGCGAATACCGACGACACGCTGAAGACGGAAATTCAGTACAGCCTGACCGGTACCGAGGACGATGCGATGCTGCTGGCCGATGTGCCTTACCCTCAGCGTAAATATCAGCAGATGGGCCTTAAGGCTGGGCAGATTTTCTGGTACCGCGCGCAGCTGGTGGACCGCAGCGGCAACGAATCCGGGTACACGGAATGGGTGCGAGGACAGGCCAGCATCGATGTTTCCGATATCACAGATGTGATCCTGGAGGAAATTAAAGACTCCGATACGTTCAAAGACCTGATCGAGAACGCGGTGGACAGCAATGAAAAAATTGCTGGCATGGCTGACGACATCAAGCAGGCCAACGATGAACTTGAGCTGCAGGCGCAGGAAATCGCAAAAAACGCTCAGGACATCGGGGAGGTTCAGACCAGCGTTAATGAGCTTTCGAGCACCGTTGGTGATGTGTCGTCTTCTCTCTCAGAGCTTGAGCAGACCGTTGCGACGGCTGATACCGCGCTGGGCCAGCGAATCGACAGCATTAGCGTGTCTATGGACGGCATGACAGGCGGGGTGAAGAACTCAGCCATTGCCATTATCCAAAACGGGCTGGCGCAGGTGGCCACGCGTAAATCGTTGTCGGCTTCGGTCGCCGGTAACAGTGCGCAGCTGGATCGTATTGATGAGGTAATCGTTAACGAGAAGGAGGCAACGGCGCGCTCTCTGCTGAGCCTGCAGACGGACGTCAACGGCAACAAGGCATCCATCAACAGCCTGAATCAGACGTTCTCCGACTATCAGCAGGCTACGGCCACGCAGATAAACGGCATTACGGCGACCGTTAACGGGCATACCTCAGCCATCACCACTAACGCTCAGGCGATAGCCAACGTTAATGGCGACCTCAGCGCGATGTACAACATCAAGGTTGGTGTCTCCAGCAACGGGCAGTATTACGCCGCGGGGATGGGTATCGGCGTGGAGAATACGCCATCCGGCATGCAGTCGCAGGTTATCTTCCTGGCTGACCGCTTCGCCGTCACCACCGCAGCCGGAAATAGCGTGGCTTTGCCGTTTGTGATCCAGAACGGGCAGACATTCATCCGGGCCAGCTTCATCCAGGACGGCACCATTGAGAACGCCAAAATCGGAAACTATATCCAGTCGAATAACTATGTGGCTGGTTCTGCAGGCTGGAAGCTTGATAAGGGAGGGACGTTCGAAATTAACGGCGTGGCCGGGGGCGGGAGGATGCTGATATCCAGCACTCTCATTCGCATCTACGACAGCAACAACGTGCTGCGCGTCAGAATGGGGTTATGGTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
323c9231e8adac179684d5568a545e007efa341b92a17908e87cb3c2e8a05a4b
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50