Genbank accession
YAF82666.1 [GenBank]
Protein name
long tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,52
TF
Evidence RBPdetect2
Probability 0,82
Protein sequence
MAGTLINITDAGRAALVALGNTGTAAHRVVEIGLGAAPFAFDKGMKTMPGERKRVTTFGGDNVAPDTVHVVIQDESNDQYSLYAFGLYLDNGVLFGVYVQDTPILEKSPAALMLLATDTVFTTIDAAKLEFGPATFLNPPATTERKGVVELATQAEVDVGDDDTRAITPKTAKRRYAALSGAAFDGRVRVIADVDDRAAQLDVSPKTAGAGKEGKVRLFGTFGDATLPDLSPRLVATLRAGFDVGAWGREYVDVCLNDGTNNDAASDAKQKRVARFTSGGRVLIGDRADDGRTALQVSGGVDASEGVTARAIDAGGAGGQFRAVCNGYGALIRNDGWSVYFLSTPKGVPDGTYNDYRPFSWSLSTGQVIVDGSGAGAVFGGNVNVGRDLVVGQGAGEAHIRLGPLDGYHFASKTAVGWWSPTLGSFHYEFANRTFRVDGRIVWHEGNLDPIDKSKGGTVGGDIAFALGKRLVLDEGSPSAPSLTFANDGASDTGLYHAADGEFGVTCNARAVVRFTPSLAAFEQPVTGPTPPAADRSTRLATTEWVRSVLSTTTIGQIVFEPRTTVRPGFLKANGVLVNRADYPELWAYAQASGALVSDADWMKDRWGCFSTGDGAATFRLPELRGEFIRCWSDARGGVDASRQIGAFQDNQNRSHAHTASTDEAPDHVHTAWTDSQGFHAHGGESSWNGDHAHDMPSAPGIGQGNPGMNSVQQSAGQTKTGVAGGHKHWISGDGSHGHNVGIGGSGRHAHAITVSADGGDESRPRNVALLALIRAY
Physico‐chemical
properties
protein length:777 AA
molecular weight: 81631,47510 Da
isoelectric point:5,72451
aromaticity:0,08108
hydropathy:-0,24723

Domains

Domains [InterPro]
DC_0662
STR
115–727
IPR048390
ATT
294–359
IPR037053
ATT
552–631
YAF82666.1
1 777
Architecture
STR
ATT
STR
ATT
STR
STR 115-293 | ATT 294-359 | STR 360-551 | ATT 552-631 | STR 632-776 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YAF82666.1
1 777
Domain Start End Length (AA) Confidence
N-terminal 1 373 373 0,5249
Central domain 374 572 200 0,1934
C-terminal 573 777 204 0,9782
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-373
Central
374-572
C-terminal
573-777

Taxonomy

  Name Taxonomy ID Lineage
Phage Burkholderia phage vB_HM471a
[NCBI]
3461036 Viruses >
Host Burkholderia pseudomallei
[NCBI]
28450 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Betaproteobacteria > Burkholderiales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YAF82666.1 [NCBI]
Genbank nucleotide accession
PX105067.1 [NCBI]
CDS location
range 14216 -> 16549
strand +
CDS
ATGGCAGGAACCCTCATCAACATCACCGACGCCGGCCGGGCGGCACTCGTCGCCCTCGGCAACACCGGCACGGCCGCGCATCGCGTCGTCGAGATCGGGCTCGGCGCCGCGCCGTTCGCGTTCGACAAGGGCATGAAGACCATGCCGGGCGAGCGCAAGCGCGTGACGACGTTCGGCGGCGACAACGTGGCGCCGGACACGGTACACGTGGTGATCCAGGACGAATCGAACGATCAATACTCGCTCTATGCGTTCGGCCTGTACCTCGACAACGGCGTGTTGTTCGGCGTCTACGTGCAGGACACGCCGATTCTCGAAAAATCGCCCGCCGCCTTGATGCTGCTCGCGACCGATACGGTTTTCACGACGATCGATGCGGCGAAGCTCGAGTTCGGGCCCGCGACGTTCCTGAACCCACCGGCGACGACCGAGCGCAAGGGCGTGGTCGAGCTCGCCACGCAGGCTGAAGTCGACGTCGGCGACGACGACACGCGCGCGATCACGCCGAAGACGGCCAAGCGGCGCTACGCGGCGCTGTCGGGCGCGGCGTTCGACGGTCGCGTGCGCGTGATCGCCGATGTCGACGATCGCGCCGCACAGCTCGACGTGTCGCCGAAGACTGCCGGGGCCGGCAAAGAGGGCAAGGTTCGCCTGTTCGGCACGTTCGGCGACGCGACGCTGCCCGATCTGAGCCCGCGCCTGGTCGCGACGCTGCGCGCGGGATTCGACGTCGGCGCGTGGGGGCGCGAGTACGTCGACGTTTGCCTGAACGACGGCACGAACAACGATGCGGCGAGCGACGCGAAGCAGAAGCGCGTCGCGCGCTTCACGTCGGGCGGCCGCGTGCTGATCGGCGACCGTGCGGACGACGGCCGGACCGCGCTACAGGTGAGCGGCGGCGTCGACGCGTCGGAGGGCGTCACGGCGCGCGCGATCGATGCCGGCGGCGCCGGCGGCCAGTTCCGCGCGGTCTGCAACGGCTACGGCGCGCTCATCCGCAACGACGGATGGAGCGTCTATTTTCTGTCGACGCCCAAGGGAGTTCCGGACGGCACCTACAACGACTACCGGCCGTTTTCGTGGTCGCTGTCGACGGGACAGGTGATCGTCGACGGAAGCGGCGCGGGCGCTGTCTTCGGCGGAAACGTCAACGTCGGTCGCGACCTGGTTGTCGGTCAAGGCGCGGGCGAAGCCCACATTCGCCTCGGCCCGCTCGACGGCTACCACTTCGCGAGCAAGACCGCAGTCGGCTGGTGGTCGCCCACCCTCGGCTCATTCCATTACGAATTTGCGAATCGCACGTTTCGCGTCGACGGACGGATCGTGTGGCACGAAGGCAACCTCGACCCGATCGACAAGAGCAAGGGCGGCACGGTGGGCGGCGACATCGCGTTTGCGCTGGGTAAGCGGCTCGTGTTGGATGAAGGTAGCCCGTCCGCGCCGTCGCTCACGTTCGCCAACGATGGCGCGTCGGATACCGGCCTCTATCACGCGGCCGATGGCGAATTCGGCGTGACATGCAACGCGCGTGCCGTCGTGCGCTTCACGCCGTCGCTCGCGGCATTCGAACAGCCCGTCACCGGACCGACGCCGCCGGCGGCCGATCGGTCGACGCGCCTCGCGACGACGGAATGGGTGCGGTCCGTGCTGTCGACGACGACCATTGGACAGATCGTTTTCGAGCCGCGGACGACCGTGCGGCCGGGTTTCCTCAAGGCGAACGGCGTACTCGTGAACCGCGCCGACTACCCCGAGCTGTGGGCGTATGCACAGGCAAGCGGCGCGCTCGTGTCCGACGCGGACTGGATGAAGGATCGGTGGGGCTGCTTCTCGACGGGCGACGGGGCGGCGACGTTCCGCCTGCCCGAGCTGCGCGGCGAGTTCATTCGATGCTGGTCCGACGCGCGCGGCGGCGTCGACGCGAGTCGGCAGATTGGCGCGTTCCAAGACAACCAAAATCGATCGCACGCACATACGGCTTCGACCGATGAAGCGCCGGACCATGTCCATACGGCGTGGACGGATTCACAGGGATTCCACGCGCACGGCGGCGAAAGTTCCTGGAATGGCGATCACGCGCACGATATGCCGAGTGCCCCAGGTATCGGGCAAGGCAACCCCGGTATGAATTCGGTTCAGCAAAGCGCAGGACAGACCAAAACAGGAGTCGCGGGTGGGCACAAACACTGGATTTCCGGAGACGGCAGCCACGGGCACAACGTTGGCATCGGCGGTTCTGGCCGCCACGCGCACGCGATCACTGTCAGCGCCGACGGCGGCGACGAGTCCCGCCCGCGCAACGTCGCGCTGCTCGCGCTGATTCGCGCCTACTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
547f593659cb3541f250eeeb96358d17fb3759be10f76a9f2f1e5272456cf3e2
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,7876
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50