Genbank accession
AIM40728.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MSLELEVWQAPIVDDEGNIQAGAQITVWDADTNESSTIYDDLDRSPKNNPFTVGSDGLARFYAEPGRYRIQAQSGSDIAVADDVDLSQKAHRLDLESAGIEQALSLRQDLENQGLPQALVLRSDLSSEDADKGGVLVRRNVIAVDSIADLLALPAEARRADLRVDVKGYHAGTDVGGGQFYWDNLSEDDADDGITFEVPGVAFGRWKRLYKKTYSLFDFGCRGDGKIDDSGKGTGIGTDDTDRVQLALNSCKELEGLGGDAVFKITKPLSGGVCKNLSDCTFDYSEGQTGGIESGLLYFEGVQSEEINCDPVFEGGTSILVSDASDFIANQFIFITSNDLWDLDDDMAAMGEMHEVESISGNEIAIKEPILYPMSDNVRVTRLSFNSGIVLSRVRAVGNSLQPQSVLRGFDFRWCSDVIVDNCDLRFFNDRGVSFRRCRNVEVKSSKIGDCLRDGTAYGVVVGQGTYSVKVNHNEIYNCRHGFDVGDVFGVSRYIDVSHNHMYDMRQHALSTHTASDFTNFNHNICTMRRGPLALGAIIRSINSKINDNTFVNPDGANQPAISVVPNPIFSGYTEINRNTIWSGVNGIGIRYINIQPKTDSLVEISGNNIECDGVRGVEARVTFDAEIDVLKIQNNKINGSLDGILIRTDGGESSSSIRKSECTGNSLITDKTGGRAIRVLVQSEGSVGLCRVQSNTASGGFTRGLEQLITQSGGAVLKTFATDNDFSEVVTPSNAIILDSDFSIVRDNINSSMV
Physico‐chemical
properties
protein length:755 AA
molecular weight: 82082,20510 Da
isoelectric point:4,61694
aromaticity:0,07285
hydropathy:-0,26715

Domains

Domains [InterPro]
DC_0282
STR
49–753
IPR012334
STR
214–565
IPR011050
STR
232–611
AIM40728.1
1 755
Architecture
STR
STR 49-753 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AIM40728.1
1 755
Domain Start End Length (AA) Confidence
N-terminal 1 241 241 0,9906
Central domain 242 744 504 0,9895
C-terminal 745 755 10 0,2825
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-241
Central
242-744
C-terminal
745-755

Taxonomy

  Name Taxonomy ID Lineage
Phage Idiomarinaceae phage 1N2-2
[NCBI]
1536592 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Idiomarinaceae bacterium N2-2
[NCBI]
1510939 Bacteria > Proteobacteria > Gammaproteobacteria > Alteromonadales > Idiomarinaceae >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AIM40728.1 [NCBI]
Genbank nucleotide accession
KJ847052.1 [NCBI]
CDS location
range 18178 -> 20445
strand +
CDS
ATGAGTTTAGAACTTGAAGTGTGGCAAGCCCCGATTGTAGATGACGAGGGCAACATTCAGGCAGGCGCGCAGATTACCGTATGGGATGCTGACACTAACGAGTCGTCAACGATTTACGATGACCTTGACCGCTCCCCAAAAAATAACCCGTTTACGGTAGGCTCAGACGGTTTGGCGCGGTTCTACGCTGAGCCTGGGCGGTATCGCATTCAAGCGCAGTCGGGTAGTGACATCGCCGTAGCTGATGATGTGGATTTAAGCCAGAAAGCGCACCGCTTGGACTTGGAAAGTGCGGGAATTGAGCAGGCGCTTTCATTGCGCCAAGACTTGGAAAACCAAGGCCTGCCACAGGCGCTTGTCTTGCGTTCAGACCTTTCAAGTGAAGATGCCGACAAAGGCGGCGTCCTAGTTCGCCGCAACGTCATCGCGGTTGATAGCATCGCTGACCTTTTGGCGCTACCTGCCGAGGCTCGTCGGGCTGATTTGCGGGTTGATGTTAAGGGTTATCACGCTGGAACCGATGTTGGAGGTGGGCAGTTTTATTGGGATAATTTAAGTGAAGATGACGCAGACGATGGGATCACTTTCGAGGTGCCTGGTGTTGCATTTGGGCGCTGGAAGCGACTATATAAAAAAACTTACTCTTTATTTGATTTCGGGTGTCGCGGCGATGGGAAAATAGATGATTCAGGTAAAGGAACAGGCATAGGAACAGATGACACAGACAGGGTTCAATTAGCTCTAAATTCATGTAAAGAGCTTGAGGGTTTAGGCGGTGACGCAGTATTTAAAATAACTAAGCCTCTATCTGGCGGGGTTTGCAAGAATTTATCCGACTGCACATTTGATTATTCAGAGGGGCAGACAGGTGGTATTGAGTCGGGCCTGCTGTACTTTGAGGGCGTCCAATCAGAAGAAATAAACTGCGACCCAGTTTTCGAAGGGGGAACTTCAATATTAGTTTCTGATGCTTCGGACTTTATTGCGAATCAATTTATTTTTATCACCTCCAATGACCTATGGGATTTAGACGATGATATGGCGGCGATGGGGGAAATGCACGAGGTTGAATCTATTTCTGGTAATGAAATAGCGATTAAAGAGCCTATCCTATACCCGATGAGTGACAACGTTCGCGTTACACGATTAAGCTTTAACTCTGGTATTGTGTTGAGTCGTGTTAGAGCGGTTGGTAACTCTTTGCAGCCGCAGTCGGTTTTAAGGGGATTTGACTTTCGATGGTGTTCGGATGTTATAGTGGATAATTGCGACCTAAGATTTTTTAACGACAGAGGCGTGTCGTTTAGGCGGTGCAGAAATGTAGAGGTAAAAAGTAGCAAAATAGGTGACTGCCTGAGAGATGGCACTGCTTACGGCGTTGTTGTCGGTCAGGGCACTTACAGCGTCAAGGTTAATCATAACGAAATATACAACTGCCGTCACGGTTTTGATGTGGGGGATGTTTTTGGCGTTTCTAGATATATTGACGTTAGTCACAATCATATGTATGACATGAGGCAGCACGCCCTTAGCACTCACACAGCATCAGATTTCACAAACTTCAATCACAATATATGCACAATGAGAAGGGGGCCTCTTGCGCTAGGAGCGATCATTCGCAGCATTAATTCGAAGATAAACGACAACACGTTCGTTAATCCCGATGGAGCGAACCAGCCTGCTATATCAGTAGTGCCAAACCCGATTTTTTCAGGGTATACCGAAATAAATAGAAATACCATTTGGAGCGGGGTAAACGGAATTGGAATCAGGTATATTAATATACAACCTAAAACCGACTCTCTTGTCGAGATTAGCGGTAATAATATTGAGTGCGACGGCGTTAGAGGTGTTGAGGCTCGGGTTACTTTCGATGCTGAAATAGATGTATTGAAGATTCAGAATAACAAAATCAACGGAAGCCTGGATGGGATTTTAATCAGGACAGATGGCGGGGAGTCCTCATCAAGCATAAGAAAGTCTGAATGCACAGGCAATTCGCTTATCACTGATAAAACCGGAGGTAGAGCGATAAGAGTTCTTGTTCAATCTGAGGGCTCCGTTGGATTGTGTAGGGTTCAATCAAATACGGCAAGCGGGGGTTTTACGCGGGGTCTTGAGCAGCTAATCACGCAGTCCGGAGGGGCAGTTTTAAAAACTTTTGCAACAGATAATGACTTTAGCGAAGTTGTCACGCCATCAAATGCGATAATACTTGATTCTGACTTTAGCATTGTTAGGGATAACATAAACTCTAGCATGGTGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
a27e9d00f6f2243c09ffc33bbe5008c6e6b324999828067b509811e07e1ab64d
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8709
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
The complete genome of Idiomarinaceae bacterium bacteriophage 1N2-2 isolated from alkaline hypersaline soda lake Lake Nakuru in Kenya Lobo,N., Moulton,K.D., Witbeck,W., Lobo,C.G., Rothschild,L.J., Mwaura,F. and Duboise,S.M. 2013-08 GenBank