Genbank accession
QZI92889.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,82
Protein sequence
MAEPAKIDLTTVKRGDTYIVDFYFSDTDGTKDISAVTIDAQARREMDGALWFDLKPVKVDASNGHFRIHLTHDETRDITESPPGSFSGIFDIQFSWQGANEVYVSTIVAGSISISKDVTQPTKLMTSGSSPMVPPSSQEVNVYLSLNPGSPNYSDVVTAEQLTPVQYDLSASLGLANVNAINEAGESAKIAKAAAAEAVAAKNEARQSATLATMQATKATNEADRAKSEADKAKQVSGLDTVDQAVDMAMAEFAGMMSETERNAILRMNEAKYDASGMVHMGRTAKPAASTAIVNEGIYSWVAATNENNLRMGRSPSGSTNQYGTSKSLWPVVHIAGVVSNILDTRSTYAFAFELPPAPDGTDIYDSTGDCRGSGKASLNLKTDIDPKYGNVPTGSEAQILREAVSRAFEGEIRNGDFRESARFWSTTGAVTIDTTGAQFTADGNDLRLRGNLPLLKENDDIELEFVSDTAGSLNIYIYGIGSDDQNINYQAVEGVNRIVSKGADRTGNYGTDATVMFRNSSGTFGGKLSNISIRKVTEGVVTHPVDGIFIESYDEELTGRVEIMENIQSLSTTFGTTSVPTVLSTRKLSYFQQYDGQFPEVAINPDFINDRYRCVVWTDLTEPQKREIAAYMGEKLFMGVNGFPVNTRNRARTIRGLGNGDWNSTDVTLSGGNYALAYSDKAFINAQGKKDVGLTPSGGWTTDTYFTPKAGSQDNPEARTGVFSPRTSSNLAYKDRCFMYLVATVPRANQGAYHEKLNPWGTAVFRNNSVTDGSSWYNPWYNKWSIALGIHSTEDCFNKLNTDGSTGINGGDIASGRSGHPDGIYFDGIEAGGLNGVIDWRLGAVANDSPEEAAKVEAKVENGTYRGLEKLVWTDGFVDTTTSQTHPSGVYLSSATIPTVSSSHNGEQTLIINGIAKRGIFYWYSSTCIFYPHDGVGASVGQTVKAVLSRETNLSVSGEFSTQMVIGDPANILLTDALKDGWLGTWCPVIPDGTSKFIPLTRENVGGDPASVYTSDNGVTWSSGTRSNFDSVTNGDTVGFGVTEVQIWSYKAFAKQTKPTTVKPILNATKGLLGVTVTQSHDKAVLAEAVAGIILKSGASGIVTEQSQSVKYLVDGTIKRLKTLTSDMVAPTNSSQAIKIAVYQISNNGQTSLAIIANTMTHNGTSWGELEEIKIPSSGSGTFPDGNNITQQAFCTELSIPTGWTSNIARVGTQVPGVDL
Physico‐chemical
properties
protein length:1221 AA
molecular weight: 131055,03110 Da
isoelectric point:4,98679
aromaticity:0,08272
hydropathy:-0,30639

Domains

Domains [InterPro]
DC_1387
STR
74–1221
Coil
Unmapped
216–236
QZI92889.1
1 1221
Architecture
STR
STR 74-1221
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QZI92889.1
1 1221
Domain Start End Length (AA) Confidence
N-terminal 1 346 346 0,9052
Central domain 347 1080 735 0,8692
C-terminal 1081 1221 140 0,8287
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-346
Central
347-1080
C-terminal
1081-1221

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage 51E28.1
[NCBI]
2859334 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Vibrio crassostreae
[NCBI]
246167 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Vibrionales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QZI92889.1 [NCBI]
Genbank nucleotide accession
MW824421 [NCBI]
CDS location
range 31386 -> 35051
strand +
CDS
ATGGCTGAACCTGCCAAAATAGACCTCACTACGGTGAAGCGTGGCGATACGTATATCGTCGACTTTTACTTTTCCGATACGGATGGAACGAAGGACATATCAGCGGTAACGATTGACGCTCAAGCACGTCGAGAGATGGACGGTGCTTTGTGGTTCGATCTGAAGCCTGTGAAGGTTGATGCGTCCAATGGACACTTCCGTATTCACCTTACTCATGATGAGACTCGTGATATTACCGAGTCACCTCCTGGTTCTTTCTCAGGCATCTTCGATATTCAGTTTAGTTGGCAAGGCGCTAACGAAGTTTACGTATCTACTATTGTGGCCGGCTCCATCTCAATCTCTAAAGATGTGACGCAGCCAACGAAGTTGATGACCTCTGGTTCATCGCCAATGGTGCCACCTTCAAGCCAAGAAGTGAACGTGTACCTTAGCTTGAACCCGGGATCTCCTAACTATAGTGACGTGGTAACTGCTGAACAATTGACGCCTGTCCAATATGATTTGTCAGCTTCTTTAGGTCTGGCGAACGTTAATGCGATCAATGAAGCGGGTGAGTCTGCAAAAATCGCTAAAGCGGCTGCGGCTGAAGCTGTTGCAGCTAAAAACGAAGCTCGTCAGTCGGCTACGCTTGCCACTATGCAAGCAACCAAGGCCACGAACGAAGCTGACCGTGCTAAGTCTGAAGCGGATAAGGCTAAACAGGTTAGTGGGCTTGACACAGTAGACCAAGCTGTGGACATGGCTATGGCTGAGTTCGCAGGCATGATGAGTGAGACTGAGCGTAACGCTATTCTGCGTATGAACGAAGCTAAGTATGATGCGAGTGGCATGGTTCATATGGGTAGAACTGCCAAGCCAGCAGCATCAACGGCGATAGTGAATGAAGGTATTTACTCTTGGGTTGCTGCAACTAACGAAAATAACCTGCGAATGGGGCGCTCACCTTCAGGCAGTACCAACCAGTACGGTACATCTAAGAGCTTGTGGCCTGTTGTTCATATTGCAGGCGTAGTGTCTAACATTTTAGATACACGCAGTACCTACGCATTTGCTTTCGAACTCCCACCCGCCCCAGACGGCACAGACATCTATGACTCAACAGGTGATTGCCGTGGAAGTGGTAAAGCTTCACTAAACTTAAAAACCGATATCGATCCTAAATACGGTAACGTCCCTACGGGTTCAGAAGCGCAAATCTTACGTGAGGCTGTTAGTCGTGCTTTTGAGGGTGAGATTAGGAATGGAGACTTTCGTGAGTCAGCTAGATTCTGGTCGACCACTGGTGCAGTGACTATTGATACAACAGGCGCGCAATTCACTGCAGATGGTAACGACTTACGACTTAGAGGCAATCTGCCACTGCTAAAAGAAAATGATGATATTGAACTTGAGTTTGTAAGTGATACGGCAGGCTCCTTAAATATTTATATTTACGGGATTGGTTCTGACGATCAAAACATAAATTATCAAGCTGTTGAAGGCGTAAATCGTATTGTATCTAAAGGTGCTGATAGAACGGGTAACTACGGAACAGACGCTACGGTTATGTTCAGGAATAGTAGCGGCACTTTCGGTGGAAAACTATCTAACATTTCAATTCGCAAAGTCACTGAAGGAGTCGTAACCCACCCAGTAGACGGCATCTTCATTGAAAGCTACGACGAAGAGTTAACAGGCCGTGTTGAGATAATGGAGAACATTCAATCCCTCTCAACTACGTTCGGTACGACTAGCGTCCCTACTGTGTTGTCTACTCGTAAACTTTCATACTTCCAACAGTATGACGGACAGTTCCCTGAAGTTGCCATTAACCCAGACTTCATCAATGACCGCTATCGTTGTGTGGTGTGGACCGACTTAACGGAACCACAGAAGCGCGAGATTGCCGCTTACATGGGCGAGAAGTTGTTCATGGGTGTGAATGGTTTCCCTGTTAATACCCGTAACCGTGCGCGTACTATTCGTGGCTTGGGTAATGGTGATTGGAATAGTACCGATGTGACACTATCGGGTGGCAACTACGCTCTAGCATACTCAGACAAAGCATTCATAAACGCACAAGGGAAAAAAGATGTGGGATTAACACCGTCAGGTGGGTGGACGACCGATACTTACTTTACGCCAAAAGCGGGATCTCAGGACAACCCTGAAGCGCGTACAGGCGTGTTTTCCCCAAGAACAAGCTCAAACCTAGCATATAAAGATCGTTGCTTTATGTATTTAGTGGCTACCGTACCTAGAGCGAATCAAGGGGCTTACCATGAAAAGTTGAATCCGTGGGGTACAGCGGTATTTCGTAATAATTCTGTCACTGATGGTTCAAGTTGGTATAACCCGTGGTACAACAAGTGGTCAATAGCTCTCGGTATTCACTCCACAGAGGACTGCTTTAATAAACTTAACACAGATGGCTCGACGGGAATAAATGGTGGTGATATTGCTAGCGGTAGGTCGGGACATCCAGACGGTATCTATTTCGATGGTATCGAAGCAGGTGGTTTGAATGGCGTTATTGATTGGCGTCTGGGTGCTGTAGCTAATGATTCACCAGAAGAAGCCGCTAAGGTAGAAGCTAAGGTGGAGAATGGTACTTATCGCGGGTTGGAGAAGTTGGTTTGGACTGATGGGTTTGTTGACACTACAACATCACAGACGCACCCTAGTGGGGTTTACTTATCTTCGGCAACCATACCAACCGTTTCATCAAGTCATAATGGTGAACAGACACTTATCATTAATGGTATTGCAAAGAGAGGAATCTTTTACTGGTACAGTTCAACGTGTATATTTTACCCGCATGATGGCGTAGGTGCTTCCGTAGGGCAAACAGTGAAGGCAGTGCTTAGTCGAGAAACCAACCTATCAGTCTCAGGTGAGTTCAGTACTCAAATGGTTATTGGCGACCCTGCCAATATCCTTCTAACTGATGCGCTTAAAGATGGTTGGTTGGGCACTTGGTGTCCTGTTATTCCTGATGGTACGTCGAAATTTATCCCACTCACTCGTGAGAATGTTGGAGGCGACCCAGCCTCTGTGTATACCTCAGACAATGGGGTAACATGGAGTTCAGGCACTCGCAGTAATTTTGACAGCGTTACGAATGGGGACACTGTTGGCTTTGGTGTGACAGAAGTGCAGATATGGAGTTACAAAGCATTCGCCAAGCAAACCAAGCCAACTACGGTCAAACCTATACTAAACGCTACCAAAGGTTTGCTAGGTGTGACGGTGACGCAAAGCCACGACAAAGCGGTGTTAGCTGAAGCGGTTGCTGGTATTATCCTTAAATCGGGCGCAAGCGGAATCGTGACGGAGCAATCACAATCGGTTAAGTATTTAGTTGACGGTACAATCAAACGACTTAAGACTCTAACCTCAGACATGGTGGCACCGACTAACAGCTCTCAAGCTATCAAGATTGCTGTATACCAAATCAGTAACAACGGCCAAACGTCTCTAGCTATCATTGCAAACACAATGACGCATAACGGCACTAGTTGGGGTGAGTTGGAAGAGATTAAAATCCCTTCAAGCGGGTCTGGTACTTTCCCAGACGGCAACAACATCACGCAACAAGCTTTCTGTACTGAGCTGTCGATTCCTACTGGTTGGACTTCCAATATAGCGAGAGTCGGAACGCAAGTACCAGGCGTTGACCTATAG

Genome Context

Genome Context

Tertiary structure

PDB ID
0ea75ba3437d2e328651c0d69f9d417aaaba4ce51b33e96d3bf99b24a8e2718f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,3479
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50