Genbank accession
QQG33998.1 [GenBank]
Protein name
hinge long tail fiber proximal connector
RBP type
TSP
Evidence RBPdetect
Probability 0,88
Protein sequence
MAELVISSISNGGIKSNKLSENFSGLNQIKISPKTNTEKKILAINGFSINPVEVDGLECVSINNDLSVGMRDVFNFKNSTDVNRFEGWMSSVTSGIILMISHGENATTTTINNYFKKIGSIGWNNHWDPTTGTQNTRYAAIYDCGLKKIMVEQYGVSSAIKVSLEVVFDTFADIGVVGYGNSIVSDQKEYMNSKTTTPEINMYLNKVLLSELIVNQGETLRFSLDTYRDDLAAAAGESVRFYYIGYNGTTSVTSGYVSSLDTSGQWDSVYNDFVVPNGIDRIMVYATSWPIKSQYVGTTGVRSVSIFRKKPNVQKDGKATIGQWGFITEDAVETGGDIVGSIKEKNVTAFEYGNLEPVSFPQFLYNDGKYIKDPFLVVGRKFAYSISMVYTDTNVSANRIGSGSDDTIFIGMTTQSDPLGMGHTVTYAGKTIRSNGIVSCNKEYLYKLEVDSPNIKFYVNGVLIGTEVIEDLDKRTFQEIRVGSEMNGYIITSEYEDYLIPNNSRYYEYSQSEKLNFIKGSSPSSGIYYSGSDIVPDAGGGWLYCGVGSQLIPAGMKAGSKAWVTIVENNGAVLNTGIELNKRYEVIAERQSAVNLQPRHLFFFRLDGKNWITSGNMTNLKFDVDCYTDPDINSEKPVIEWVKNKKYTYNFNGGTCLEIPPLYSLNKNGYITLNFTLNLTDFNMYLFDGRSTNTQELQGGWIYLTKTRTLNISGQYFSIVQLDGKPYTGGVLAPYVPHSLVLELKVGSVIRTIGGRYNKTECWNGNIWDITMVGDNDARTYINNPESRLNYYSTGIEDQNGSKVLVYDTVDLSKWKMSDELNQPIQVLSNNRFKFIKDVSEGGMTFNLNLPPRGRFRIEYDIDCPRPLYLKDVYGTTVGVGSIMKSLPTGRYKGVLYQNHTESTHDSGLYVCVPNARNGDIVTIRSLVVYTTKTDAMGTDVATSNYFFQEFEEPQMIGNTMSSWVPNLANNNYLNILPAWMPQKESWRLRFLGDNFTVGYYLDNTDKTHGIFVTLLGTTLQFVVKNRGTTISNITVNHGFVAGKEFDVDIQYNFPNLSIKTNGVVNNSTYNHVDGISSNMCLRNNASVVRQVDMIESSNMVSSSRVYKLADNGYVIPSNNIIQNSLTFRKKLRSVLLKTGGGVVGWDSSIGDVAGNGRLKDDVYIYDNKISKIVSGGSSYSMIIEFEGKITPYTELEIQLNIDGIVQTKYAAIGSGNYVIAKDPDVDKWIEPSSQYKVIDIRPNGEVGLKFQNTLWKIV
Physico‐chemical
properties
protein length:1259 AA
molecular weight: 140280,53610 Da
isoelectric point:5,64482
aromaticity:0,11041
hydropathy:-0,27077

Domains

Domains [InterPro]

No domain annotations available.

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QQG33998.1
1 1259
Domain Start End Length (AA) Confidence
N-terminal 1 165 165 0,5453
Central domain 166 434 270 0,6535
C-terminal 435 1259 824 0,2031
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-165
Central
166-434
C-terminal
435-1259

Taxonomy

  Name Taxonomy ID Lineage
Phage Aeromonas phage ZPAH1
[NCBI]
2796500 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Aeromonas hydrophila
[NCBI]
644 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Aeromonadales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QQG33998.1 [NCBI]
Genbank nucleotide accession
MW272540 [NCBI]
CDS location
range 110896 -> 114675
strand -
CDS
ATGGCCGAACTTGTTATATCAAGTATTTCGAATGGTGGGATTAAGTCTAATAAACTTTCCGAAAATTTCTCTGGTCTTAATCAGATAAAAATTTCACCAAAAACGAATACAGAAAAAAAGATATTAGCTATTAACGGATTTTCTATTAACCCTGTTGAGGTTGATGGCCTCGAATGCGTTAGTATAAATAACGATCTCAGCGTTGGTATGCGAGACGTTTTTAATTTTAAAAACAGTACAGATGTGAATAGATTCGAAGGTTGGATGTCTTCGGTTACATCTGGAATTATTTTGATGATATCACATGGTGAAAATGCAACAACTACCACAATAAACAACTACTTTAAGAAAATCGGTAGTATTGGGTGGAATAATCATTGGGACCCAACAACCGGAACACAAAATACCAGATATGCAGCTATATATGACTGTGGTCTGAAAAAGATTATGGTTGAACAATATGGCGTTAGTTCTGCTATTAAAGTATCTCTTGAAGTCGTTTTTGATACATTTGCAGATATCGGTGTAGTTGGATATGGTAATTCTATTGTATCTGACCAAAAAGAATATATGAATTCCAAAACTACAACACCAGAAATAAACATGTATCTGAATAAAGTTTTGCTTTCCGAACTGATAGTTAATCAGGGTGAGACATTAAGATTCAGTTTAGATACATATAGAGATGATCTTGCCGCTGCGGCAGGGGAATCTGTTAGATTTTATTACATTGGATATAACGGGACTACATCCGTTACATCCGGATATGTAAGCTCTTTAGATACATCTGGTCAATGGGATTCTGTATACAATGATTTTGTTGTCCCTAATGGAATAGATCGTATCATGGTCTATGCAACATCGTGGCCTATCAAATCGCAATACGTGGGAACTACTGGGGTTAGATCTGTTTCTATTTTTAGAAAAAAACCTAATGTACAAAAAGATGGTAAAGCGACAATAGGTCAGTGGGGTTTCATCACAGAGGATGCTGTAGAGACTGGTGGTGATATAGTAGGTAGCATTAAAGAGAAGAACGTCACCGCTTTTGAGTATGGGAATTTGGAACCTGTTAGTTTTCCTCAATTTTTATATAACGACGGAAAATATATAAAAGACCCATTTCTTGTTGTTGGTAGAAAGTTTGCATATTCCATTTCAATGGTATATACCGACACCAACGTATCAGCAAATAGGATTGGTTCTGGCTCTGATGACACAATATTTATTGGTATGACAACACAATCAGACCCTCTTGGTATGGGGCATACAGTGACTTATGCAGGAAAAACAATTAGATCAAATGGTATCGTCTCTTGCAACAAAGAATATCTGTATAAATTGGAAGTAGATAGCCCAAATATCAAATTCTATGTAAATGGTGTTCTTATAGGTACTGAAGTAATTGAAGATCTAGATAAAAGAACTTTCCAAGAAATTAGAGTTGGTTCTGAAATGAATGGTTATATTATCACATCAGAATATGAAGATTATCTAATTCCTAATAACTCTAGATATTATGAGTATTCACAATCAGAGAAACTTAATTTCATCAAAGGATCTAGCCCATCTAGTGGTATCTATTATTCTGGTTCGGATATAGTACCTGATGCGGGTGGTGGTTGGTTATATTGTGGTGTGGGAAGTCAACTAATACCTGCTGGGATGAAAGCCGGATCTAAAGCTTGGGTTACAATAGTAGAAAACAACGGTGCAGTCTTGAATACTGGTATCGAGTTGAATAAAAGATACGAAGTAATAGCAGAGAGACAATCTGCTGTAAATCTACAACCGAGACACCTTTTCTTCTTTAGACTAGATGGTAAAAACTGGATTACCTCCGGTAATATGACAAACCTCAAATTCGACGTTGATTGTTATACGGACCCAGATATAAATAGCGAAAAACCAGTTATTGAATGGGTGAAGAACAAAAAATATACATATAATTTCAATGGTGGTACTTGTTTAGAAATTCCCCCACTATATTCCTTAAACAAAAATGGATATATAACTCTGAACTTCACTCTTAATTTAACAGATTTCAACATGTATTTGTTTGACGGAAGAAGTACAAATACCCAAGAGTTGCAAGGTGGTTGGATATATCTCACAAAAACAAGAACATTGAATATATCAGGTCAATATTTTTCTATTGTGCAGCTGGATGGAAAACCGTATACTGGGGGTGTGTTGGCTCCGTATGTTCCTCACAGTCTTGTTTTGGAATTAAAAGTTGGTTCTGTTATTAGAACTATTGGTGGAAGATATAATAAAACCGAGTGTTGGAATGGTAATATATGGGATATTACCATGGTTGGTGATAACGATGCTAGAACATATATAAACAACCCAGAATCTAGATTGAACTACTATTCAACTGGGATAGAAGATCAAAACGGTTCTAAGGTATTGGTATATGATACAGTTGATCTATCAAAATGGAAAATGTCAGATGAATTAAACCAGCCTATTCAGGTTTTAAGTAACAACCGATTTAAATTTATCAAAGACGTTTCCGAAGGTGGGATGACATTCAATTTAAATTTACCGCCAAGGGGTAGATTCCGTATAGAATATGATATAGATTGTCCACGACCACTATATTTAAAGGATGTATATGGTACAACCGTTGGTGTTGGTAGTATTATGAAATCCCTTCCGACTGGAAGATATAAGGGTGTATTGTATCAAAACCACACAGAATCGACTCATGATTCAGGTCTGTATGTATGTGTGCCAAATGCCAGAAACGGTGATATCGTAACAATACGTAGTTTGGTAGTGTATACAACAAAGACCGATGCGATGGGGACTGACGTTGCTACATCTAACTATTTCTTCCAAGAATTTGAAGAACCTCAAATGATTGGTAATACTATGAGTTCTTGGGTTCCAAATTTAGCGAATAACAACTATCTAAATATCTTACCTGCATGGATGCCACAAAAAGAATCGTGGAGATTAAGATTTTTGGGTGATAACTTTACTGTTGGTTATTATTTGGATAATACAGATAAAACCCATGGAATATTCGTTACCCTATTAGGAACAACATTACAATTCGTTGTAAAAAATCGCGGAACTACAATTAGTAACATTACTGTAAACCATGGTTTTGTTGCTGGTAAAGAATTTGATGTTGATATTCAATATAATTTTCCTAACCTATCTATTAAAACAAATGGTGTTGTTAATAACTCTACATATAATCACGTTGATGGTATATCATCAAATATGTGTTTGAGAAATAACGCATCTGTTGTTAGACAAGTTGATATGATTGAAAGTTCTAATATGGTTTCAAGTTCGCGTGTATATAAACTAGCTGATAATGGTTATGTCATACCATCCAACAATATTATACAGAACAGCTTAACTTTCCGTAAGAAATTGCGATCCGTTTTATTGAAAACTGGTGGTGGCGTAGTTGGTTGGGATTCTTCAATTGGTGATGTGGCTGGAAACGGCAGACTCAAAGATGACGTTTATATCTACGATAATAAAATCTCCAAAATTGTAAGTGGTGGTTCTTCTTATAGTATGATCATCGAATTTGAAGGGAAAATAACTCCTTACACCGAATTGGAAATACAACTAAATATTGATGGTATTGTTCAAACTAAATATGCTGCAATTGGATCTGGTAACTATGTTATAGCTAAAGACCCAGATGTGGATAAATGGATTGAACCATCAAGTCAATATAAAGTCATAGATATAAGACCAAACGGTGAAGTGGGTTTGAAATTCCAAAACACCTTATGGAAGATAGTATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
7f231363db5a0da29ab2dd5ef0270722912e90f71a7ed0959f65ec2c1dc64e17
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4826
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50