Protein
View in Explore- Genbank accession
- XNS37677.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTSPTF
- Protein sequence
-
MATEKVLKGRKGGSSSSRTPTEQPDDLQSVAKAKILVALGEGEFAGQLTGKDIYLDGTALENADGSQNFSGVTWEFRAGTQAQKYIQGIPGTENEISVGTEVSSTTAWTRTFTNTQLSAVRLRLKWPSLFKQENDGDLVGYSINYAIDLQTDGGIWHTVLNTSVTGKTTSGYERSHRIDLPQAGSTWTIRLRKITADANSAKIGDTMTLQSFTEVIDAKLRYPNTALLYIEFDSSQFNGSIPQISCEPRGRVIRVPDNYDPETRTYFGTWTGAFKWAWTDNPAWIFYDLVVSDRFGLGHRLSAANIDKWTLYQVAQYCDQRVPDGKGGSGTEPRYTCNVYIQDRNDAYTVLRDFAAIFRGMTYWGGNQIVALADMPRDVDYSYTRANVIDGRFTYSSSTTKSRYTTALVSWSDPDNAYADAMEPVFEQSLVARYGFNQLEMTAIGCTRQSEANRKGRWGILTNNKDRVVSFDVGLDGNIPQPGYIIAVADELLSGKVMGGRISEVNGRVIRLDRVPDATAGDRLILNLPSGASQSRTIQAVNGESVTVTTTYSETPQPEAVWLVESNELYAQQYRVVSVSDNNNGTFSITAAFHDPDKYARIDTGAIIDQRPISVIPPGNQSAPANIVISSFSVVQQNISVETMRVSWDQAKNAIAYEAQWRRNDGNWVNMPRSSTTSFDVPGIYAGRYLVRVRAINAAEISSGWGYSEEKTLTGKVGNPPKPVGFTATGINWGIRLNWGFPANTGDTLKTEIQYTANSDFSDPLLLSDVPYPSAEYTQLGLKAGQEFWYRAQLVDRTGNESGYTDWIRGMSNDNADDYLGDIADDFLTSADGERLTGDIDTNIEGILQNALANHGTVEHQWAQYGEVRADILVVKTTIAEVDNAMAELSTQVQAQIEDVTASLEDKLTAVVDASGASAIYTLKTGVRINGIMYNAGMSIAVLAQAGQPIVTRVGFNANQFVLMSGSGDTQYSPFAVVNGQVFISSAFIQDGTITNAKIGNFIQSNNYVAGSIGWRLDKSGTLEMNGATSGQGRLTLNNTRMDVYDQNGTLRVRIGQL
- Physico‐chemical
properties -
protein length: 1058 AA molecular weight: 115914,45550 Da isoelectric point: 4,93319 aromaticity: 0,09452 hydropathy: -0,34556
Domains
Domains [InterPro]
DC_0014
STR
1–1058
STR
1–1058
IPR053171
Unmapped
4–845
Unmapped
4–845
IPR055385
ATT
92–218
ATT
92–218
IPR013783
STR
622–714
STR
622–714
IPR003961
STR
623–717
STR
623–717
IPR003961
STR
628–702
STR
628–702
IPR036116
STR
636–799
STR
636–799
1
1058
Architecture
STR 1-91 | ATT 92-218 | STR 219-342 | ATT 343-505 | STR 506-1058
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1058
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 541 | 541 | 0,8093 |
| Central domain | 542 | 1003 | 463 | 0,0331 |
| C-terminal | 1004 | 1058 | 54 | 0,8653 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-541
1-541
Central
542-1003
542-1003
C-terminal
1004-1058
1004-1058
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage SaltyDalty [NCBI] |
3233708 | Viruses > unclassified bacterial viruses > |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
XNS37677.1
[NCBI]
Genbank nucleotide accession
PP925825.1
[NCBI]
CDS location
range 30285 -> 33461
strand -
strand -
CDS
ATGGCTACAGAAAAAGTGTTAAAGGGCCGCAAGGGCGGCAGCTCAAGTTCCCGAACCCCAACCGAACAGCCTGATGATCTGCAATCTGTAGCGAAGGCAAAAATCCTCGTTGCGCTTGGGGAAGGGGAGTTTGCAGGGCAGCTAACCGGCAAAGATATCTACCTGGACGGAACGGCACTTGAGAACGCTGACGGCTCCCAAAACTTCAGCGGCGTAACGTGGGAATTTCGCGCAGGAACGCAGGCGCAAAAATATATTCAGGGCATACCCGGTACCGAAAACGAAATCAGCGTTGGTACCGAAGTTTCCAGCACTACAGCCTGGACGCGCACATTCACCAATACGCAGCTTTCAGCGGTTCGCTTGCGTCTGAAATGGCCGTCACTCTTTAAACAGGAAAACGACGGTGATCTGGTCGGCTACTCAATAAACTATGCTATCGACCTGCAGACTGACGGCGGTATCTGGCATACGGTACTCAATACCAGTGTGACCGGGAAAACGACATCAGGTTACGAGCGCAGCCACCGAATTGATTTACCGCAGGCTGGCAGCACCTGGACAATCAGACTGCGTAAGATTACAGCCGATGCCAATAGTGCGAAGATCGGCGACACGATGACGCTGCAGAGCTTCACTGAGGTGATCGACGCCAAACTGCGCTACCCGAACACAGCATTGCTGTATATTGAGTTTGATTCAAGCCAGTTCAACGGCTCTATCCCGCAGATTTCATGCGAGCCGCGCGGGCGCGTTATTCGCGTTCCTGATAACTACGATCCTGAAACCAGAACATATTTCGGCACATGGACCGGCGCCTTTAAATGGGCATGGACCGATAACCCGGCGTGGATTTTTTACGACCTGGTGGTTTCCGACCGCTTCGGTCTTGGTCACCGGCTAAGCGCGGCAAATATCGATAAATGGACGCTGTATCAGGTGGCTCAGTATTGTGATCAGAGAGTTCCTGACGGAAAGGGTGGCAGCGGTACCGAACCACGGTACACCTGCAACGTGTACATTCAGGACCGGAACGACGCCTACACAGTCCTGCGTGATTTTGCTGCTATCTTCCGGGGCATGACCTACTGGGGCGGCAATCAAATTGTTGCTCTGGCTGACATGCCGCGTGATGTTGATTACAGCTATACGCGCGCAAACGTTATTGACGGTCGATTCACCTATTCGAGCAGTACCACGAAAAGCCGATACACTACCGCGCTGGTATCATGGTCCGATCCAGATAATGCCTACGCCGACGCTATGGAGCCGGTATTTGAGCAGTCGCTGGTTGCGCGGTACGGTTTTAACCAACTGGAAATGACCGCCATCGGCTGCACCAGGCAGTCAGAGGCAAACCGAAAGGGGCGCTGGGGTATTCTCACCAACAACAAGGATCGCGTTGTTTCGTTTGATGTGGGCCTGGACGGAAACATACCACAGCCAGGCTACATCATCGCCGTGGCTGACGAACTGCTGTCCGGAAAGGTAATGGGTGGCCGCATCAGCGAAGTTAACGGTCGCGTTATCAGGCTTGATCGTGTTCCTGATGCGACTGCAGGTGATCGCCTTATTCTGAACCTTCCATCTGGAGCTTCGCAGAGCCGCACCATTCAGGCGGTAAACGGTGAGTCGGTAACTGTCACAACCACGTACAGTGAGACGCCACAGCCCGAAGCAGTTTGGCTGGTGGAATCAAACGAGCTCTACGCGCAACAGTACCGCGTTGTCAGTGTGAGCGATAACAATAATGGTACCTTCTCAATCACTGCGGCATTTCATGACCCGGACAAATACGCCAGAATTGATACCGGCGCGATTATCGACCAGCGACCGATTAGTGTTATTCCGCCGGGAAACCAGTCCGCACCAGCCAACATCGTAATCAGCTCGTTTTCTGTGGTTCAGCAGAATATCAGCGTCGAAACCATGCGCGTAAGCTGGGACCAGGCAAAAAATGCCATCGCCTATGAGGCACAGTGGCGCCGTAACGACGGGAACTGGGTGAACATGCCGCGCAGCTCCACCACGTCATTTGACGTCCCGGGGATTTATGCCGGGCGCTACCTGGTGCGCGTGCGCGCAATTAATGCCGCTGAAATTTCCTCAGGATGGGGATATTCAGAAGAGAAGACACTGACCGGCAAAGTAGGTAATCCGCCTAAGCCAGTAGGATTCACCGCCACGGGCATTAACTGGGGGATTCGTCTTAACTGGGGTTTCCCGGCAAACACCGGCGATACGCTAAAAACGGAAATTCAGTACACTGCCAACAGTGACTTTTCAGATCCACTCTTGCTCTCAGACGTGCCTTATCCATCTGCGGAATACACCCAGCTCGGCCTTAAAGCAGGGCAGGAATTCTGGTACCGCGCGCAGCTGGTCGACAGAACGGGTAACGAGTCCGGGTATACCGACTGGATCAGGGGGATGTCTAACGATAACGCCGATGATTATCTTGGAGATATCGCAGACGATTTCCTAACCTCTGCCGACGGGGAACGCCTCACCGGTGACATCGATACCAACATTGAGGGAATTCTACAGAACGCCCTGGCGAACCACGGAACTGTTGAGCACCAGTGGGCACAATACGGAGAAGTGCGTGCCGATATTCTGGTGGTTAAAACGACGATTGCTGAAGTTGATAATGCAATGGCCGAACTTTCGACGCAGGTGCAGGCGCAGATTGAGGATGTTACCGCTTCCCTGGAAGACAAGCTTACAGCCGTCGTTGATGCCTCTGGCGCTTCGGCTATCTACACCCTCAAAACAGGCGTGAGGATAAACGGCATCATGTATAACGCCGGGATGTCGATTGCCGTTCTGGCGCAGGCAGGGCAGCCGATTGTTACCCGAGTAGGTTTCAACGCTAACCAGTTCGTGCTGATGAGTGGCAGTGGCGATACCCAGTATTCGCCGTTCGCTGTGGTTAATGGACAGGTCTTTATCAGCTCAGCGTTTATTCAGGATGGCACGATCACCAATGCCAAAATCGGCAACTTCATCCAGTCCAATAACTACGTTGCTGGGTCTATCGGATGGAGGCTGGATAAAAGTGGCACACTGGAAATGAATGGTGCCACATCAGGGCAGGGCAGATTAACGCTGAATAATACCCGCATGGATGTTTATGATCAGAATGGAACGCTTCGCGTAAGAATAGGACAATTATGA
Genome Context
Genome Context
Tertiary structure
PDB ID
44c9f9a2076a7b666b3c5782ddc41617ad77a0b5457e3ea6241f2ce914fdb7e4
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50