Genbank accession
CAH1096218.1 [GenBank]
Protein name
central tail fiber J
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MNPTIQDPVTDVVVTSESRVDQGINVAIMIVSWAQAKGAVKYQVEWRKDDGSWIKLPVTGNNSVEVPGIYAGQYQARVTAISAFEIASLPVYSTLTELSGKQGLPPKLAFIQATGILFGIKLDWGFPATGALDTAYTEIQVSPDGTSNIAQLGLFAYPTTTHTLQGLQPNLTQFYRGRLIDRIGNIGPWSDWTHATTSADATDVLELLNDQISETQLNQDLKTKIDHIETIDAEIGPLKQDIQNTKDRIAQEVIDRQNAIQQAKDGLSQQIIAGDEGVLEVVNTVKQSSDEGIAAAQESIRVVANDLSLIAEKTDGVYAQLNPPLIGSESDLIGNDQGFAGTWSVQSAMIEGDLALSKRIDTTAVELNNLQAYAQREVQARIEGDKVTVQKIDTYIASNDSALATVRQSAQVAVEQSSANAEAIELINLELDDKASTGQLTQVKSDIKNVDDKVAAQTVRIDGVYAQINPPLIGSESDLIGNEGGYAGVWTEQSARIEGDLAQAKLTEQLSAQMNENNAVFKRQLEANSSAISSTIKVTETLQTKVGENSASIQNVSESVDGIYAQQFTKFDVNGHVSGHGSMNDGTTSTFIFNYDAIQFGTPVGVDGVEPKPLMTLQNTPVTLPNGTVIPRGLYVDNGSFGYINANRIWADSLSAISADLGTIKVKSANIEDQAVTTSKIGNLAVDTLHIKDRAVTLPVIVTKSAQNTTEGYRYTPNHYTMGEFLRVVLTGFQPYSTILITMFGQLYFIPHPNSNAAEGDLTRATNGAMYFKLGDDYLVNYTAANNVEITIPPVKFGSTELGTSFSVLAKADASGQLVLSGYFDMMTFAYANQVTAGCSDLTFYAVELKK
Physico‐chemical
properties
protein length:851 AA
molecular weight: 91739,48130 Da
isoelectric point:4,55595
aromaticity:0,07051
hydropathy:-0,16604

Domains

Domains [InterPro]
DC_1230
STR
1–322
IPR053171
Unmapped
2–602
IPR013783
STR
7–93
IPR036116
STR
120–197
CAH1096218.1
1 851
Architecture
STR
STR
RBD
STR 1-322 | STR 331-373 | RBD 472-745 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Acinetobacter phage MD-2021a
[NCBI]
2899278 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
CAH1096218.1 [NCBI]
Genbank nucleotide accession
CAKLQH020000049.1 [NCBI]
CDS location
range 70 -> 2625
strand +
CDS
GTGAACCCAACAATTCAGGATCCTGTAACTGATGTCGTTGTTACTAGTGAAAGCCGAGTTGATCAGGGCATCAACGTGGCGATAATGATAGTATCTTGGGCGCAGGCTAAGGGCGCGGTTAAATATCAAGTTGAGTGGCGTAAAGATGACGGCAGCTGGATTAAGCTTCCAGTAACCGGCAATAATTCAGTCGAAGTTCCTGGTATTTATGCGGGGCAGTATCAAGCACGTGTAACGGCAATTTCAGCATTTGAGATTGCTTCTTTACCAGTTTATTCAACTTTGACTGAACTTTCTGGAAAGCAAGGTTTACCGCCAAAATTGGCATTTATCCAAGCGACAGGAATCTTATTTGGTATAAAACTTGATTGGGGCTTTCCTGCAACCGGTGCGCTTGATACAGCTTATACTGAAATTCAAGTTTCACCGGATGGTACCAGCAATATTGCCCAATTAGGCTTATTTGCGTATCCAACGACGACTCATACTCTGCAAGGTTTACAGCCAAATCTGACTCAATTTTATCGGGGGCGGTTGATCGACAGGATTGGAAATATTGGGCCATGGTCGGACTGGACTCATGCGACAACTTCTGCCGATGCTACAGACGTTCTTGAGCTCTTGAATGATCAAATCAGTGAAACTCAGCTCAATCAGGATCTTAAAACCAAGATTGATCATATTGAGACTATTGATGCTGAAATAGGTCCACTTAAGCAAGATATTCAGAATACGAAAGATCGGATTGCACAAGAAGTCATTGATCGTCAAAACGCTATTCAGCAAGCCAAAGATGGTTTATCACAGCAAATCATTGCAGGTGATGAAGGTGTTCTTGAAGTTGTAAATACTGTTAAACAGTCAAGTGATGAGGGAATTGCAGCGGCTCAAGAAAGTATTCGAGTTGTTGCAAATGATCTCTCATTAATTGCTGAAAAAACCGATGGTGTATATGCACAGTTAAACCCACCTTTAATTGGTTCTGAATCAGATTTAATTGGAAATGATCAAGGTTTTGCTGGCACATGGTCTGTTCAATCGGCAATGATCGAAGGAGACTTGGCACTTAGTAAGCGCATTGATACAACGGCAGTTGAGTTAAATAACTTACAAGCTTATGCACAACGAGAGGTCCAAGCTAGAATTGAAGGCGATAAAGTAACAGTTCAAAAGATTGATACGTATATCGCAAGCAATGATAGTGCTCTTGCAACTGTACGCCAGTCGGCACAGGTAGCAGTTGAGCAGTCATCGGCAAATGCTGAGGCAATTGAATTAATTAATCTTGAGCTTGACGATAAAGCTTCAACGGGACAATTGACGCAAGTTAAGTCAGACATTAAGAATGTAGATGACAAAGTTGCCGCCCAAACAGTACGTATTGACGGTGTTTACGCGCAAATCAATCCACCATTGATCGGGTCAGAATCTGACTTAATCGGAAATGAAGGAGGTTATGCAGGGGTATGGACCGAGCAATCTGCTCGTATCGAAGGTGATTTGGCCCAAGCTAAACTTACTGAACAGCTTTCTGCTCAGATGAATGAGAACAATGCCGTATTCAAGCGCCAGCTCGAGGCAAATTCAAGTGCTATTTCTTCAACTATAAAAGTAACGGAAACGTTGCAAACTAAAGTCGGTGAGAATAGTGCGTCTATTCAAAATGTCAGTGAAAGTGTAGATGGCATCTATGCTCAGCAGTTTACTAAGTTCGATGTAAATGGCCATGTTTCTGGTCATGGATCAATGAATGATGGTACGACTTCTACTTTCATATTCAATTATGATGCAATTCAGTTTGGTACGCCTGTCGGTGTTGATGGTGTAGAACCTAAACCATTAATGACCCTGCAAAACACTCCGGTTACTTTGCCAAACGGTACTGTTATTCCGCGTGGTTTGTATGTCGACAATGGTAGTTTTGGATATATCAATGCCAATCGAATCTGGGCTGATAGCTTAAGTGCTATTAGTGCGGATTTGGGAACGATTAAAGTTAAATCTGCAAATATTGAAGATCAAGCAGTTACTACTTCAAAAATTGGAAATTTAGCAGTTGATACTTTGCACATTAAAGATCGGGCAGTAACGCTGCCAGTTATCGTGACTAAGTCTGCTCAAAATACGACAGAAGGGTATAGATATACACCAAACCATTACACAATGGGCGAGTTTTTGCGGGTTGTATTAACAGGCTTTCAGCCATATTCAACCATTCTGATTACTATGTTTGGTCAGTTGTACTTTATTCCACATCCGAATAGTAATGCAGCTGAGGGGGATCTCACTCGTGCAACCAATGGAGCTATGTATTTTAAATTAGGAGATGATTATTTAGTTAATTATACCGCAGCTAACAATGTGGAAATAACGATACCGCCTGTGAAATTTGGATCTACTGAACTTGGCACTTCATTTTCTGTGTTAGCTAAAGCAGATGCATCTGGTCAGCTAGTGCTTAGTGGTTATTTTGATATGATGACTTTTGCTTACGCTAATCAGGTTACTGCAGGCTGCTCTGACTTAACTTTCTATGCTGTGGAGCTAAAAAAATGA

Genome Context

Genome Context

Tertiary structure

PDB ID
6802ce3c06844c6342c3943916a9414011ddef20663fc20027a13e3c582ea013
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,7434
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50