Genbank accession
QNJ54799.1 [GenBank]
Protein name
long tail fiber distal subunit
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,67
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MAELRSTTAIGGNIVWHGGNLRFDPQGETIRYQGHKIYTEHDTPLPGELGNGGPTSAFTKAESDDRFAPIAVGGYVKKTGDTMSGKLTNTANEIEINGASPRLLLRDNDNSKNWYIMNSTDSFSIRENDVVTTRFRIDATAADFSVDSIDINMKTALRGFDDWLRINDQNEFASGVYYGSSLLRTDGTLQIGNNGSTLSVNGSAFTYEGNNVFTEAYHPNADKWTSARTLTTTLTGDVSGSASMTIDGSANATVTVTATVANDSHTHDGRYYTEAESDARFANVTGDTFTGNVAISKAGARLSFNETLYATENSGINWITGANQNLELIHEISDVDINTDGGNGQALIIRDNGSTASVAGLEVQGEIFAKVNQRVFHDAYHPNADKWTTARTITLGGDLTGSVSIDGTSNVTLNASVPSLSNYPTFAEVGIRADQPNYLATGRTMSGVDTTVDWDTLTQGGFYYKLSQGTNRPSGFTGYWYVQNMTYGSTSNTTQVAYPYGLAGNTGTMAMRTRYSEVWEDWVYMYHTDYHPYADKWTTARSLSLGNELSGSVSIDGSSNVTLNASVDHIDNVLNINRVGESNPSILLNNDTGETRGNIYWNRVDGSLQFRLNGSDGTTAENIISMYSDRTVFTDQIHTSTLLNDANTEQGLLMFSGGTTRLGGSGASAMYFCPLGVNSNASSDFAASLNTSGVMSLNASSSTPLSVHRVEESSVPNVNIRFQGKSTDGNALGEAWYAGSFTNGAGFGIGTNADLSTASNRLFEVGGAGAVVRREGSGATSLTVQGTDPFLLFDQTDIGKSGYIGMDGSGVDSLYVRTPDDSTRRSIYHESNKPTANDVVNNVISLDGLDATKFYPVVFDANNTAGYTCEFTLSVGSGQGSSPYNNNTITGVARGGGWSDHNAYYDLIVQKYVDSETNIHSIWEGTQGFTGVVIYVRGGQSINLRSNSRAQVYTSDYSFGGSVFPAGISNPLGAATNATMFAYFSQSGRYTSSSATRYKLNTGEMNLASGSNHGLFKIETDANYDSIIRMSEDGAAHGGFIHYLGATTNEFKIGTRQSDVDTTALTIPRGTSNVFVGGNLYANGGTVQLASKINLTYDSTRVLTVYNGNNSKSAWFGCRNSSYAHMETNATNGFYSYSKFNFGSDVDVLLNKDLRLGGKRAFRNNEGAWLRLNPYADFSSGIYCGSSLLRTDGQITSGSWSGSNKSARVASNFYDSTWAGNGTAAFSVNNPDTAGAHWAFASFYNGSNIRSGIQILSNSDGRMRFYTNRRANYVEVSSGSLTAQGNVTAYSDARLKENVKVIDNALNKVGELSGYTYDKRKSLDSDEFTRETGVIAQEVQKVLPEAVMESDEDHILSVAYGNMNGLLIEAIKELNEKVDSLQNEVQELKRPWWKKLLRL
Physico‐chemical
properties
protein length:1399 AA
molecular weight: 150958,34430 Da
isoelectric point:5,04630
aromaticity:0,09864
hydropathy:-0,40951

Domains

Domains [InterPro]
DC_1451
STR
294–520
DC_1451
STR
495–974
QNJ54799.1
1 1399
Architecture
ATT
STR
ATT 1-354 | STR 355-1390 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QNJ54799.1
1 1399
Domain Start End Length (AA) Confidence
N-terminal 1 715 715 0,1053
Central domain 716 914 200 0,3316
C-terminal 915 1399 484 0,8398
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-715
Central
716-914
C-terminal
915-1399

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage vB_ValM_R10Z
[NCBI]
2759334 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Vibrio alginolyticus NBRC 15630 = ATCC 17749
[NCBI]
1219076 Bacteria > Proteobacteria > Gammaproteobacteria > Vibrionales > Vibrionaceae > Vibrio

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QNJ54799.1 [NCBI]
Genbank nucleotide accession
MT612988 [NCBI]
CDS location
range 184196 -> 188395
strand +
CDS
ATGGCAGAACTAAGATCAACTACCGCAATTGGTGGTAACATAGTTTGGCACGGAGGGAATCTTCGCTTTGACCCGCAAGGCGAGACAATTCGCTACCAAGGCCACAAAATTTATACAGAACATGATACACCACTACCAGGCGAATTAGGTAACGGTGGGCCGACTTCTGCATTCACGAAAGCTGAATCTGATGATCGTTTTGCTCCGATTGCTGTCGGCGGCTACGTGAAGAAAACCGGCGATACAATGTCAGGTAAATTGACAAACACGGCAAACGAAATTGAGATCAACGGGGCATCGCCACGTCTGTTGTTGCGCGACAACGACAACTCAAAAAACTGGTACATTATGAACTCGACTGATAGTTTCAGTATTCGAGAAAATGATGTAGTCACTACTCGCTTCAGAATTGATGCTACTGCTGCCGACTTTTCTGTTGATAGTATTGATATCAACATGAAAACAGCATTGCGTGGGTTTGATGATTGGTTGAGAATCAATGATCAGAATGAGTTTGCGTCTGGGGTTTATTACGGAAGCTCTCTATTACGTACAGACGGAACGTTGCAAATCGGCAACAATGGTTCAACTCTGAGTGTAAACGGCTCTGCGTTCACGTATGAAGGTAATAACGTCTTCACTGAAGCATATCACCCAAATGCGGACAAATGGACATCTGCACGCACTCTTACAACGACTCTAACGGGCGATGTAAGCGGTTCTGCGTCTATGACTATTGATGGATCGGCTAATGCGACCGTGACTGTTACAGCGACTGTAGCGAACGATTCACACACACATGACGGTAGGTACTACACTGAAGCTGAATCTGATGCGCGATTTGCAAATGTTACAGGCGATACATTTACGGGAAACGTTGCGATCAGCAAAGCAGGTGCGCGTTTAAGCTTCAACGAGACTCTATATGCAACCGAAAACTCAGGTATTAACTGGATTACGGGTGCGAATCAGAATCTGGAATTAATTCATGAGATTAGTGATGTTGACATCAACACTGATGGTGGTAACGGTCAAGCGTTGATCATTCGTGATAATGGTTCAACTGCATCGGTTGCAGGTCTTGAAGTACAAGGTGAAATTTTCGCGAAAGTTAATCAGCGTGTGTTTCACGATGCTTATCACCCAAATGCTGATAAGTGGACTACTGCTCGTACAATCACACTAGGCGGTGATTTAACAGGTTCGGTTTCAATTGATGGTACTTCAAACGTCACGTTGAATGCATCTGTCCCGTCACTATCAAACTATCCGACATTTGCTGAAGTTGGTATACGCGCAGATCAGCCGAATTACTTAGCAACTGGTCGAACAATGTCAGGTGTTGATACTACAGTTGATTGGGATACGTTGACACAAGGTGGTTTCTACTACAAGTTATCACAAGGTACAAATAGACCAAGTGGCTTTACTGGTTACTGGTATGTTCAGAACATGACATATGGTTCAACTTCGAATACTACTCAAGTTGCATACCCTTACGGTCTAGCTGGAAATACCGGTACAATGGCGATGCGTACTCGTTATAGTGAAGTATGGGAAGACTGGGTATACATGTACCATACAGATTACCACCCATATGCAGACAAATGGACAACTGCACGTTCATTATCTCTTGGTAATGAATTGAGTGGTTCGGTGTCTATTGATGGTAGTTCGAATGTTACTCTAAACGCATCGGTTGACCATATCGACAACGTATTGAACATCAATCGCGTTGGCGAATCTAACCCGTCTATTCTGTTGAACAATGATACAGGGGAAACTCGTGGTAACATTTACTGGAATCGCGTTGATGGATCGTTACAATTCAGACTAAACGGATCTGATGGAACTACGGCTGAAAACATAATATCAATGTACTCAGATCGTACAGTGTTTACTGATCAAATTCATACAAGTACATTGTTAAATGATGCAAACACTGAACAAGGATTGTTAATGTTCAGTGGCGGTACTACTCGCTTGGGTGGTAGTGGTGCAAGTGCTATGTATTTCTGTCCGCTTGGTGTTAATTCAAACGCGTCGAGTGATTTTGCAGCATCGCTCAACACGTCTGGTGTAATGTCATTGAATGCATCATCATCGACGCCGCTTTCTGTACATCGAGTTGAAGAGTCTTCAGTCCCGAACGTTAATATTCGATTCCAAGGAAAGAGTACTGACGGAAATGCACTAGGTGAGGCGTGGTATGCAGGTTCGTTCACTAACGGGGCCGGGTTTGGTATTGGTACAAATGCAGACTTATCCACAGCATCGAATCGATTGTTCGAAGTTGGTGGCGCAGGAGCAGTTGTGCGCAGAGAAGGTTCTGGTGCAACGAGTCTGACAGTTCAAGGTACTGACCCGTTCTTGTTGTTTGACCAAACAGATATTGGCAAATCTGGTTACATTGGGATGGACGGTTCGGGTGTTGATTCGCTTTATGTTCGTACCCCGGACGATTCTACAAGACGCAGTATTTACCATGAATCGAATAAACCAACTGCGAATGATGTAGTCAATAACGTAATCAGTCTAGATGGTTTAGATGCTACTAAGTTCTATCCAGTTGTTTTTGATGCAAACAATACTGCTGGTTATACGTGTGAATTTACACTGTCTGTTGGTTCAGGACAAGGCAGCTCACCATATAACAACAACACTATAACTGGTGTTGCACGTGGCGGCGGTTGGTCAGATCACAATGCATATTATGACTTGATTGTGCAGAAGTATGTTGATTCAGAAACAAACATACATTCAATATGGGAAGGGACTCAGGGATTCACGGGTGTTGTTATCTACGTTCGCGGTGGTCAGAGTATAAATCTGCGTAGTAACTCTCGCGCTCAAGTGTATACTTCAGACTACTCATTCGGTGGGTCGGTTTTCCCTGCGGGGATTTCAAATCCATTGGGTGCTGCAACTAATGCTACTATGTTTGCGTACTTCTCACAGTCTGGTAGATATACATCAAGTTCAGCGACTCGTTACAAGCTGAATACAGGGGAGATGAATTTAGCGTCTGGTTCAAATCACGGTTTGTTTAAAATTGAAACTGATGCGAACTACGATTCTATAATTCGAATGTCAGAAGATGGGGCTGCTCATGGTGGGTTTATTCACTATCTAGGGGCTACGACCAATGAATTTAAAATTGGTACACGTCAGAGTGATGTAGATACTACTGCACTGACAATCCCTCGTGGTACTTCTAATGTGTTCGTTGGCGGGAATCTGTATGCTAACGGTGGTACAGTTCAGTTGGCATCGAAGATTAACTTGACTTATGATTCGACTAGAGTGTTAACTGTTTACAACGGTAATAATAGTAAATCTGCATGGTTCGGTTGTCGTAATTCGTCATATGCTCACATGGAGACTAATGCAACTAATGGGTTCTATTCATACAGTAAATTCAACTTCGGCTCGGATGTTGATGTATTATTAAACAAAGACCTTCGATTAGGTGGAAAGAGGGCTTTCAGGAACAATGAAGGCGCGTGGTTGAGATTGAACCCATATGCTGATTTCAGCTCTGGTATTTATTGTGGTAGTTCATTGCTACGTACAGATGGTCAAATCACTTCAGGTTCGTGGTCTGGCTCGAATAAATCAGCTAGAGTTGCTAGTAACTTTTACGACTCTACGTGGGCGGGTAACGGTACTGCTGCATTCAGTGTAAACAACCCAGATACGGCTGGTGCTCACTGGGCATTTGCTTCTTTCTACAACGGTAGTAACATTCGTTCGGGTATTCAGATTCTATCGAACTCTGATGGTCGTATGCGATTCTATACTAACCGTCGTGCGAATTACGTTGAAGTGAGTAGTGGTAGCTTGACTGCTCAGGGTAACGTTACAGCTTACTCAGATGCACGTTTGAAAGAGAATGTCAAGGTTATTGACAATGCACTCAATAAAGTAGGTGAATTAAGCGGGTATACATATGATAAGCGCAAATCATTAGACTCAGATGAGTTTACTCGTGAAACTGGTGTAATCGCGCAAGAAGTGCAAAAAGTGCTGCCAGAAGCTGTGATGGAAAGTGACGAAGATCATATTCTATCAGTAGCGTATGGTAACATGAACGGTCTTTTGATTGAAGCTATTAAAGAGCTTAATGAGAAAGTCGATTCACTTCAGAACGAAGTACAAGAACTTAAACGCCCGTGGTGGAAGAAGTTGCTTCGTTTATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
438fea257c7027663b3ce18651e6b397c9083f1bcbbb87723aafedb5ea76ad5e
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4757
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50