Genbank accession
BAQ02838.1 [GenBank]
Protein name
tail fiber protein
RBP type
TSP
Evidence DepoCatalog
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,86
TSP
Evidence RBPdetect2
Probability 0,91
Protein sequence
MAFKFKGSLSAVDATLKGGVKFDNEKLPDSKNMPEGKFTINEIDNSSTTDLASNTLVTNFGKQDNVAGMLSFNTGDWENNNSAPVKLMMRVVNNSNDSDWVTIFDSTKTTVTWSSIASAGQTVFTVPNLDFKKAIIYINGILQYPGISYQTFGGTVTFSNSLQAGDNVYIVVGEDSDNTTNTQYISTALDNQTTIILPYEKNSNYLFINGVLQYPNSFTIVNNTITLNSSMQQDDNIFVLSNDKIVPNYTAVAIQDQTDFTITGTIIDPVVYINGVLQYDTHYTISGNTLSFVSKLFAGDEVLVFLDSLNLIDNINTEYNSVIDDVNNSNKINIPYFHFSELQVFINGILQNPDNGAYDLNGTEVTLSSPLQEGDDIHVIVYNSPIQDDNIVTKADLSSYASITELNLLKDSLKAEGINLKWQPHLPSIEVAFGLPRRSLKIWKAGNTSTINQYWLYPVDGTVWSGIGTLGNVPSTPFYKLDSNKDVITWTYTATSDNINRIFVPYNFGSINIFINGVLQNIELGHYTYNGQYIDLNGSLNIGDNLVAILGKLILNTNPYLTYETANGQFVSKSDLSSNTGSLMVGTSDGNNLQQTLNNKVNSVLLSSNNGSSIVGTSSGLSVQAEIDNIKKQFTDSKVLISKLIPNSTQDQTALMQSEVNSLTSGMTYITPTGTILITTVVIPTLKGMTFKFDGTIFKLPDGATPLDSDMIRFNSLSYSTVSGLYTDGNRSNIIDTSGTNPWYGRVINWRLGNNSTFVYFQNTTMVNSLYCGSQWGNNISNIVLDGIYADNIGEHLFYISGNGGGNNKNILFKNMMIDSIGVNPNNSIASHACAVVKSSQTIGLNDYFCIDGLTFKQTQTPGYAVIVVVNGDCVHFDIKNFQVGKNVGGIISPLGTCEYMKVSNGYSLDTTSGVPLVYTYPNSSNIVQTYWVAENIIMPNAYSQINSQLFDVYRDCHFGRIDVSNDQSNTVFKDGKTLKYINCKFTLPTTGLQLTYVLRDISFDNCQFDSTITGNSAVVDYIGQNEYTSNTRVSFNNCKFNSTTNYTIGTFNNLVNLSMTNCYGIIKKIYARNSTSINKLKIANTEFDGTTTPVTATSITMKMLSNVINTSTGRDYSFYRNQWSIPAGQTSIGYDLSSTFIGSISAFSVQVTPQGTYSGPTKYWTVVSGTTVTIYVDVAPTTNMTFNIQVSG
Physico‐chemical
properties
protein length:1193 AA
molecular weight: 130878,83340 Da
isoelectric point:4,73295
aromaticity:0,10478
hydropathy:-0,13738

Domains

Domains [InterPro]
DC_0116
ATT
175–250
IPR011050
STR
649–942
BAQ02838.1
1 1193
Architecture
ATT
STR
ATT
STR
ATT 41-333 | STR 334-439 | ATT 440-605 | STR 621-1193
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
BAQ02838.1
1 1193
Domain Start End Length (AA) Confidence
N-terminal 1 671 671 0,9941
Central domain 672 1113 443 0,9908
C-terminal 1114 1193 79 0,9554
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-671
Central
672-1113
C-terminal
1114-1193

Taxonomy

  Name Taxonomy ID Lineage
Phage Klebsiella phage K64-1
[NCBI]
1439894 Uroviricota > Caudoviricetes > Alcyoneusvirus >
Host Klebsiella pneumoniae
[NCBI]
573 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
BAQ02838.1 [NCBI]
Genbank nucleotide accession
AB897757.1 [NCBI]
CDS location
range 328067 -> 331648
strand -
CDS
ATGGCATTTAAATTTAAAGGCTCACTATCAGCGGTTGATGCTACACTTAAAGGTGGTGTGAAATTTGATAATGAAAAATTACCAGATTCTAAAAATATGCCTGAAGGTAAATTCACAATTAATGAAATTGATAATTCAAGTACTACTGATCTTGCTAGTAATACATTAGTGACAAATTTTGGAAAACAAGATAATGTTGCTGGGATGCTATCTTTTAACACAGGTGATTGGGAAAATAATAATTCAGCACCAGTTAAACTTATGATGCGAGTGGTTAATAATAGTAATGATTCTGACTGGGTTACTATATTTGATTCTACTAAAACAACCGTCACATGGAGTTCAATTGCATCAGCCGGACAAACTGTTTTTACTGTTCCTAATTTGGATTTCAAAAAAGCAATAATTTATATTAATGGAATTTTGCAATATCCTGGTATATCATATCAAACATTTGGTGGTACTGTAACATTCTCGAATTCTCTACAAGCTGGTGATAATGTTTATATTGTTGTTGGTGAAGATTCAGATAATACAACTAACACACAATATATTAGTACTGCATTAGATAATCAAACAACTATTATTTTACCATATGAAAAAAATAGTAATTACTTATTCATAAATGGTGTTTTACAATACCCAAATTCATTTACAATAGTAAACAATACTATTACATTGAATTCTTCAATGCAACAAGATGATAATATATTTGTATTAAGTAATGATAAGATTGTGCCTAATTACACAGCAGTAGCAATACAAGACCAAACTGATTTTACTATAACAGGTACAATAATAGATCCAGTTGTATATATTAATGGGGTTTTACAATATGATACACATTATACAATATCAGGAAATACATTATCATTCGTAAGTAAGCTTTTTGCAGGAGATGAAGTATTAGTTTTCTTGGATAGTTTAAATTTAATTGACAATATTAATACCGAGTATAATAGTGTAATTGATGATGTAAATAACAGTAATAAAATAAATATTCCTTATTTCCATTTTAGTGAATTACAGGTTTTTATTAATGGTATTCTACAAAATCCAGATAATGGAGCTTATGATTTAAATGGAACAGAAGTAACATTAAGTTCACCACTACAAGAAGGTGATGATATACACGTTATTGTATATAATTCTCCTATACAAGATGACAATATAGTTACTAAAGCTGATTTAAGTTCTTATGCATCAATTACTGAATTGAACTTATTAAAAGATTCATTAAAAGCTGAGGGTATTAATTTAAAATGGCAACCACATTTACCTAGTATTGAAGTAGCATTTGGATTACCACGAAGATCATTAAAAATTTGGAAAGCAGGTAATACTTCAACAATAAATCAGTACTGGTTATATCCGGTAGATGGTACAGTCTGGTCTGGTATTGGTACATTAGGAAATGTACCTTCTACTCCGTTTTATAAATTGGACTCCAATAAAGATGTTATTACTTGGACATATACCGCAACTAGTGATAATATTAACAGAATTTTTGTTCCATATAATTTTGGAAGTATTAATATTTTTATTAATGGTGTATTACAAAATATCGAATTAGGACATTATACTTATAATGGTCAATACATAGATCTTAATGGTTCGTTGAATATTGGAGATAATTTAGTTGCAATATTAGGAAAATTAATTCTTAATACTAATCCATATTTGACTTATGAAACTGCTAATGGTCAATTTGTTAGTAAATCTGATTTATCATCAAATACTGGTTCATTAATGGTTGGTACATCTGATGGAAACAATTTACAGCAAACTCTTAACAATAAAGTAAATTCAGTACTATTATCATCAAATAATGGATCTAGCATTGTAGGTACTTCAAGTGGTCTAAGTGTTCAAGCAGAAATAGATAATATAAAAAAACAATTTACTGATAGTAAAGTATTGATAAGTAAATTAATACCAAATTCAACACAAGATCAAACAGCACTAATGCAAAGTGAAGTTAATTCATTAACGTCTGGAATGACATATATAACACCAACTGGAACAATTTTAATAACAACAGTAGTAATACCTACATTAAAAGGTATGACTTTTAAATTTGATGGAACTATATTTAAATTACCTGATGGAGCAACTCCATTAGATAGCGATATGATTCGTTTTAACAGTTTAAGTTATTCTACCGTATCAGGATTATATACTGATGGTAATAGAAGTAATATTATTGATACATCAGGAACGAATCCTTGGTATGGTAGAGTGATAAATTGGAGATTGGGAAATAATTCAACGTTTGTATATTTTCAAAATACTACTATGGTTAATTCTTTATATTGTGGAAGTCAATGGGGTAATAATATATCTAATATTGTATTAGATGGAATATATGCAGATAATATAGGTGAACATTTATTTTATATTTCTGGGAATGGTGGTGGAAATAATAAAAATATTTTATTTAAAAATATGATGATTGATTCTATTGGAGTTAATCCAAATAATTCTATTGCTAGTCATGCATGTGCAGTTGTTAAATCATCACAAACAATTGGTCTTAATGATTATTTTTGTATTGATGGATTGACTTTTAAACAAACTCAAACTCCTGGATATGCTGTTATTGTAGTAGTTAATGGTGATTGTGTCCATTTTGATATCAAGAATTTTCAAGTTGGAAAAAATGTAGGTGGTATAATTTCACCACTTGGTACATGTGAATATATGAAAGTGTCAAATGGATATTCACTTGACACTACTAGTGGTGTTCCATTGGTATATACATACCCAAATTCATCTAATATAGTACAAACATATTGGGTTGCTGAAAATATTATAATGCCAAATGCATATTCACAAATAAATTCACAATTGTTTGATGTATATAGAGATTGTCATTTTGGTAGAATAGATGTAAGTAATGATCAATCTAATACTGTGTTTAAAGATGGTAAGACATTAAAATATATTAATTGTAAGTTTACATTACCAACGACTGGATTACAGTTAACATATGTATTGCGTGATATATCATTTGATAATTGTCAATTTGATTCAACTATAACAGGTAATAGTGCGGTTGTTGACTATATTGGTCAAAACGAATATACATCAAATACTAGAGTTAGTTTTAATAATTGTAAATTTAATTCGACAACAAATTATACTATTGGGACATTTAACAATTTAGTTAATTTATCTATGACTAATTGTTATGGCATAATTAAAAAAATATATGCTAGAAATTCAACATCAATTAATAAATTGAAAATAGCTAATACCGAATTTGATGGAACAACGACACCAGTAACTGCAACATCCATAACGATGAAAATGTTATCAAATGTAATTAATACATCTACTGGAAGAGATTATTCTTTTTATAGAAATCAATGGTCAATTCCTGCTGGTCAAACTAGTATTGGATATGATTTATCATCAACTTTTATTGGTTCTATTTCTGCATTTTCTGTTCAAGTAACCCCACAAGGAACATATAGTGGCCCAACAAAATATTGGACGGTTGTTTCTGGAACTACAGTTACTATATATGTTGATGTTGCACCGACTACTAATATGACATTTAATATTCAAGTGTCTGGTTAA

Genome Context

Genome Context

Tertiary structure

1 / 2
PDB ID
Source
Method
Resolution
Oligomeric State