Protein
View in Explore- Genbank accession
- CAH1096218.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TF
- Protein sequence
-
MNPTIQDPVTDVVVTSESRVDQGINVAIMIVSWAQAKGAVKYQVEWRKDDGSWIKLPVTGNNSVEVPGIYAGQYQARVTAISAFEIASLPVYSTLTELSGKQGLPPKLAFIQATGILFGIKLDWGFPATGALDTAYTEIQVSPDGTSNIAQLGLFAYPTTTHTLQGLQPNLTQFYRGRLIDRIGNIGPWSDWTHATTSADATDVLELLNDQISETQLNQDLKTKIDHIETIDAEIGPLKQDIQNTKDRIAQEVIDRQNAIQQAKDGLSQQIIAGDEGVLEVVNTVKQSSDEGIAAAQESIRVVANDLSLIAEKTDGVYAQLNPPLIGSESDLIGNDQGFAGTWSVQSAMIEGDLALSKRIDTTAVELNNLQAYAQREVQARIEGDKVTVQKIDTYIASNDSALATVRQSAQVAVEQSSANAEAIELINLELDDKASTGQLTQVKSDIKNVDDKVAAQTVRIDGVYAQINPPLIGSESDLIGNEGGYAGVWTEQSARIEGDLAQAKLTEQLSAQMNENNAVFKRQLEANSSAISSTIKVTETLQTKVGENSASIQNVSESVDGIYAQQFTKFDVNGHVSGHGSMNDGTTSTFIFNYDAIQFGTPVGVDGVEPKPLMTLQNTPVTLPNGTVIPRGLYVDNGSFGYINANRIWADSLSAISADLGTIKVKSANIEDQAVTTSKIGNLAVDTLHIKDRAVTLPVIVTKSAQNTTEGYRYTPNHYTMGEFLRVVLTGFQPYSTILITMFGQLYFIPHPNSNAAEGDLTRATNGAMYFKLGDDYLVNYTAANNVEITIPPVKFGSTELGTSFSVLAKADASGQLVLSGYFDMMTFAYANQVTAGCSDLTFYAVELKK
- Physico‐chemical
properties -
protein length: 851 AA molecular weight: 91739,48130 Da isoelectric point: 4,55595 aromaticity: 0,07051 hydropathy: -0,16604
Domains
Domains [InterPro]
DC_1230
STR
1–322
STR
1–322
IPR053171
Unmapped
2–602
Unmapped
2–602
IPR013783
STR
7–93
STR
7–93
IPR036116
STR
120–197
STR
120–197
1
851
Architecture
STR 1-322 | STR 331-373 | RBD 472-745 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Acinetobacter phage MD-2021a [NCBI] |
2899278 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
CAH1096218.1
[NCBI]
Genbank nucleotide accession
CAKLQH020000049.1
[NCBI]
CDS location
range 70 -> 2625
strand +
strand +
CDS
GTGAACCCAACAATTCAGGATCCTGTAACTGATGTCGTTGTTACTAGTGAAAGCCGAGTTGATCAGGGCATCAACGTGGCGATAATGATAGTATCTTGGGCGCAGGCTAAGGGCGCGGTTAAATATCAAGTTGAGTGGCGTAAAGATGACGGCAGCTGGATTAAGCTTCCAGTAACCGGCAATAATTCAGTCGAAGTTCCTGGTATTTATGCGGGGCAGTATCAAGCACGTGTAACGGCAATTTCAGCATTTGAGATTGCTTCTTTACCAGTTTATTCAACTTTGACTGAACTTTCTGGAAAGCAAGGTTTACCGCCAAAATTGGCATTTATCCAAGCGACAGGAATCTTATTTGGTATAAAACTTGATTGGGGCTTTCCTGCAACCGGTGCGCTTGATACAGCTTATACTGAAATTCAAGTTTCACCGGATGGTACCAGCAATATTGCCCAATTAGGCTTATTTGCGTATCCAACGACGACTCATACTCTGCAAGGTTTACAGCCAAATCTGACTCAATTTTATCGGGGGCGGTTGATCGACAGGATTGGAAATATTGGGCCATGGTCGGACTGGACTCATGCGACAACTTCTGCCGATGCTACAGACGTTCTTGAGCTCTTGAATGATCAAATCAGTGAAACTCAGCTCAATCAGGATCTTAAAACCAAGATTGATCATATTGAGACTATTGATGCTGAAATAGGTCCACTTAAGCAAGATATTCAGAATACGAAAGATCGGATTGCACAAGAAGTCATTGATCGTCAAAACGCTATTCAGCAAGCCAAAGATGGTTTATCACAGCAAATCATTGCAGGTGATGAAGGTGTTCTTGAAGTTGTAAATACTGTTAAACAGTCAAGTGATGAGGGAATTGCAGCGGCTCAAGAAAGTATTCGAGTTGTTGCAAATGATCTCTCATTAATTGCTGAAAAAACCGATGGTGTATATGCACAGTTAAACCCACCTTTAATTGGTTCTGAATCAGATTTAATTGGAAATGATCAAGGTTTTGCTGGCACATGGTCTGTTCAATCGGCAATGATCGAAGGAGACTTGGCACTTAGTAAGCGCATTGATACAACGGCAGTTGAGTTAAATAACTTACAAGCTTATGCACAACGAGAGGTCCAAGCTAGAATTGAAGGCGATAAAGTAACAGTTCAAAAGATTGATACGTATATCGCAAGCAATGATAGTGCTCTTGCAACTGTACGCCAGTCGGCACAGGTAGCAGTTGAGCAGTCATCGGCAAATGCTGAGGCAATTGAATTAATTAATCTTGAGCTTGACGATAAAGCTTCAACGGGACAATTGACGCAAGTTAAGTCAGACATTAAGAATGTAGATGACAAAGTTGCCGCCCAAACAGTACGTATTGACGGTGTTTACGCGCAAATCAATCCACCATTGATCGGGTCAGAATCTGACTTAATCGGAAATGAAGGAGGTTATGCAGGGGTATGGACCGAGCAATCTGCTCGTATCGAAGGTGATTTGGCCCAAGCTAAACTTACTGAACAGCTTTCTGCTCAGATGAATGAGAACAATGCCGTATTCAAGCGCCAGCTCGAGGCAAATTCAAGTGCTATTTCTTCAACTATAAAAGTAACGGAAACGTTGCAAACTAAAGTCGGTGAGAATAGTGCGTCTATTCAAAATGTCAGTGAAAGTGTAGATGGCATCTATGCTCAGCAGTTTACTAAGTTCGATGTAAATGGCCATGTTTCTGGTCATGGATCAATGAATGATGGTACGACTTCTACTTTCATATTCAATTATGATGCAATTCAGTTTGGTACGCCTGTCGGTGTTGATGGTGTAGAACCTAAACCATTAATGACCCTGCAAAACACTCCGGTTACTTTGCCAAACGGTACTGTTATTCCGCGTGGTTTGTATGTCGACAATGGTAGTTTTGGATATATCAATGCCAATCGAATCTGGGCTGATAGCTTAAGTGCTATTAGTGCGGATTTGGGAACGATTAAAGTTAAATCTGCAAATATTGAAGATCAAGCAGTTACTACTTCAAAAATTGGAAATTTAGCAGTTGATACTTTGCACATTAAAGATCGGGCAGTAACGCTGCCAGTTATCGTGACTAAGTCTGCTCAAAATACGACAGAAGGGTATAGATATACACCAAACCATTACACAATGGGCGAGTTTTTGCGGGTTGTATTAACAGGCTTTCAGCCATATTCAACCATTCTGATTACTATGTTTGGTCAGTTGTACTTTATTCCACATCCGAATAGTAATGCAGCTGAGGGGGATCTCACTCGTGCAACCAATGGAGCTATGTATTTTAAATTAGGAGATGATTATTTAGTTAATTATACCGCAGCTAACAATGTGGAAATAACGATACCGCCTGTGAAATTTGGATCTACTGAACTTGGCACTTCATTTTCTGTGTTAGCTAAAGCAGATGCATCTGGTCAGCTAGTGCTTAGTGGTTATTTTGATATGATGACTTTTGCTTACGCTAATCAGGTTACTGCAGGCTGCTCTGACTTAACTTTCTATGCTGTGGAGCTAAAAAAATGA
Genome Context
Genome Context
Tertiary structure
PDB ID
6802ce3c06844c6342c3943916a9414011ddef20663fc20027a13e3c582ea013
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50