Genbank accession
AOQ26709.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence RBPdetect2
Probability 0,68
Protein sequence
MTLKVVDPINITEAVLTASDIPEPDASVGEVEWQDPSVLGRFGNLPDVQYTVVLGSDGFLYSFGRAGAVVKIDPDTSTMTTFGSYNVGRVYAAVLAGDGNIYAVGSGSAVLKLEISTQTLSTFGSYAGTCESATLAPDGDIYCVSTNGFVLKIDVSAQTTSQFGSYGAGYKTSSLGGDGNIYCAGSQGDVLKIDVTEQTVSTFGSVTGKYYGSAQGVDGNVYCIGYSGNVLKINVSNQSVSTFGSCVGAFESAALDANGRIKCVASSSTTASGDILEIDTASESVYRFGSYTDNFFSIALAPNGKMFAVGNDVGSSTGIIEILDTYSPGDRVALESEHLVYQCLSVTYQNPKVGATEDSTATWIVVGPTNKWAMFDGLQNTKTSSSTDFTITLNPITYVNTLAMFGFSGVESVRIEVDNSLDVNIYDKTYSMSDFSAIYDHYTYVFYQIASLDDFIATDLPPLPNTTIRVTFSGSNMTIGELVTGFAIDIGQLVAESTKSDRFRYREQEYNEFGYPTGEAPIVVELNTYDVLVPKLNNQAIQKLLDTLTGENTLWVGDIGGGQSLVTYGLFERSPIPYSMPNHINYQITVRASV
Physico‐chemical
properties
protein length:594 AA
molecular weight: 63426,77690 Da
isoelectric point:4,23663
aromaticity:0,10606
hydropathy:0,01616

Domains

Domains [InterPro]
IPR015943
STR
46–333
SSF63829
STR
51–279
AOQ26709.1
1 594
Architecture
ATT
STR
ATT 1-50 | STR 51-594
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AOQ26709.1
1 594
Domain Start End Length (AA) Confidence
N-terminal 1 124 124 0,6885
Central domain 125 325 202 0,4116
C-terminal 326 594 268 0,1089
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-124
Central
125-325
C-terminal
326-594

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage 2E1
[NCBI]
1873904 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Vibrio anguillarum
[NCBI]
55601 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Vibrionales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AOQ26709.1 [NCBI]
Genbank nucleotide accession
KX507045 [NCBI]
CDS location
range 26608 -> 28392
strand -
CDS
ATGACGTTAAAAGTAGTCGATCCAATTAACATTACGGAGGCGGTGTTAACTGCCTCTGACATACCGGAGCCGGACGCTAGCGTCGGTGAAGTTGAATGGCAAGACCCTAGCGTTTTGGGTAGGTTTGGCAATCTTCCAGATGTGCAATACACGGTAGTATTGGGTAGTGATGGGTTTTTGTATTCATTCGGAAGAGCTGGCGCGGTTGTTAAAATTGATCCGGACACTAGCACAATGACAACCTTCGGAAGTTACAATGTAGGCAGGGTTTATGCTGCTGTACTTGCTGGTGATGGAAATATCTACGCAGTCGGCAGTGGCAGCGCTGTGCTGAAGCTAGAGATATCAACACAAACCTTGTCAACATTTGGTAGTTACGCAGGGACTTGTGAATCTGCGACTCTAGCACCGGACGGTGATATCTATTGCGTTTCAACTAATGGGTTTGTACTAAAAATAGATGTTAGCGCTCAAACTACCTCCCAATTTGGCTCTTACGGCGCTGGATATAAAACATCATCACTTGGCGGTGATGGAAACATTTACTGCGCTGGCTCTCAGGGCGACGTACTTAAAATAGATGTAACAGAGCAAACAGTTTCAACATTTGGAAGTGTGACAGGTAAGTATTACGGTTCAGCACAAGGCGTTGACGGTAATGTTTATTGCATCGGATATTCTGGCAATGTTCTAAAAATAAACGTATCAAATCAATCTGTATCAACATTTGGATCTTGTGTCGGCGCATTTGAATCTGCCGCGCTAGATGCTAACGGTAGAATCAAATGTGTAGCATCATCCAGCACTACAGCAAGTGGCGACATTTTAGAAATAGACACAGCATCTGAAAGCGTGTACAGATTTGGTAGTTATACTGATAACTTTTTCTCTATAGCACTCGCGCCAAACGGGAAAATGTTTGCGGTTGGTAATGACGTTGGAAGCTCAACGGGAATTATTGAGATTCTGGACACTTACTCACCAGGTGACAGGGTTGCCCTTGAGTCTGAGCATTTGGTTTACCAGTGCTTGAGTGTTACATATCAAAACCCAAAAGTAGGTGCGACAGAGGATTCCACAGCAACGTGGATTGTAGTTGGGCCAACAAATAAATGGGCTATGTTTGATGGGTTGCAAAACACTAAAACATCAAGCTCAACAGATTTTACAATAACACTTAACCCAATTACTTATGTTAACACCTTGGCTATGTTTGGCTTTAGTGGTGTGGAGTCGGTGAGGATTGAGGTTGATAATAGTCTTGATGTGAATATTTACGATAAAACATATTCAATGTCTGACTTCTCGGCAATCTATGACCACTACACTTATGTGTTTTATCAGATTGCGAGTCTAGACGACTTTATAGCTACCGATTTACCACCGCTACCAAACACAACAATCAGAGTTACATTCTCAGGCTCGAACATGACAATAGGTGAGCTAGTTACTGGATTTGCAATTGATATAGGTCAACTAGTCGCTGAGAGCACTAAATCGGACAGGTTTAGATACAGAGAGCAAGAATATAACGAGTTCGGATATCCTACTGGCGAGGCTCCAATAGTTGTAGAGCTAAATACATACGATGTGCTAGTGCCGAAACTAAATAACCAAGCAATCCAAAAGCTACTAGACACATTAACCGGAGAGAACACGCTCTGGGTTGGTGATATCGGCGGCGGTCAAAGCTTAGTTACATACGGACTCTTTGAGCGTAGCCCTATCCCTTATTCAATGCCAAATCACATTAACTATCAAATCACTGTACGCGCATCTGTGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
ee7a3663359cf211f8d47519190d63e984456179f4303bc8bc01398cd0ab9421
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8612
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequences of bacteriophages S4-7 and 2E-1, infecting the marine pathogen Vibrio anguillarum Rorbo,N., Castillo,D. and Middelboe,M. — — GenBank