Genbank accession
AGH31831.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence RBPdetect2
Probability 0,79
Protein sequence
MAQPPVADLPVAPVRGNDQATFNQRGRDFLSALEPWRVAVNDLTAWTEGEATIIGQVKSDVKTLQSEAEALRDDTQTIKETADSEIGAIVDESQSLVDNTALTNNFVGQWSNQSGSLAVGKSVLHNGVYWIAVVDIADVTASEPAASNGDWAVASERPTSGGDIGDIVFSPLDLEATGSYLLADGRVFLQSARPELFAIYGIGQKPVPTSDVTAAPTLSADGLSVDFDPGDQFMVVLQQNAPYRQIFETTSGSFGSVTSPTPNGSEPDASFAVDDVDGTFLAVVEGSGNVLLLEYNGSDFVLADSSNTMSSPSRVTFDATATYIAVADLDPDYLGIYKRSGSTISKLANPSTLPGNSANDVAFSSDATYLVVAEGFPRHITIYKRSGDTFTKLSAPAQPPDSTQQACAFSPDDELLVTGGGGSETLIVYERSGDTFTKISAVTDYPSLATSLAWRSDGKYLVVGSAQSPHLAIYERDEINNLTKIPDPETVPSGAVNAVALGNSDDLLAVAHDGGDGLIVYEPVYPFDPQTEFRIPNVPNLTQTTINGWAPPQVRPYIRSGV
Physico‐chemical
properties
protein length:562 AA
molecular weight: 59454,80190 Da
isoelectric point:4,15109
aromaticity:0,08007
hydropathy:-0,15160

Domains

Domains [InterPro]
Coil
Unmapped
54–81
SSF75011
STR
244–523
SSF75011
STR
244–520
IPR019405
STR
310–489
AGH31831.1
1 562
Architecture
STR
STR 217-523 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AGH31831.1
1 562
Domain Start End Length (AA) Confidence
N-terminal 1 437 437 0,6009
Central domain 438 551 115 0,4504
C-terminal 552 562 10 0,3647
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-437
Central
438-551
C-terminal
552-562

Taxonomy

  Name Taxonomy ID Lineage
Phage Salicola phage CGphi29
[NCBI]
754067 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Salicola
[NCBI]
332339 Bacteria > Proteobacteria > Gammaproteobacteria > Oceanospirillales > Halomonadaceae >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AGH31831.1 [NCBI]
Genbank nucleotide accession
HQ634153 [NCBI]
CDS location
range 27137 -> 28825
strand +
CDS
ATGGCTCAACCACCAGTAGCAGACCTCCCAGTTGCGCCGGTAAGGGGCAATGATCAGGCGACCTTTAATCAAAGAGGGCGCGACTTTCTTTCGGCTCTTGAGCCCTGGCGAGTTGCCGTTAATGACCTCACCGCGTGGACAGAAGGTGAAGCCACGATCATCGGGCAAGTCAAGTCCGATGTGAAAACTCTGCAATCCGAAGCCGAGGCTCTGCGAGATGACACGCAAACGATCAAAGAAACTGCCGATAGCGAAATCGGCGCGATTGTAGACGAGTCGCAATCACTTGTTGATAACACGGCACTGACAAACAACTTTGTCGGCCAATGGAGCAATCAAAGCGGAAGCCTGGCTGTCGGCAAGAGTGTGCTACATAACGGCGTCTACTGGATTGCTGTTGTCGATATTGCCGACGTTACCGCGAGCGAGCCAGCGGCTAGTAATGGTGATTGGGCTGTTGCGTCTGAGCGCCCGACCAGTGGCGGGGATATTGGTGATATTGTTTTTTCACCGCTGGACCTGGAGGCCACGGGTAGCTATTTGTTGGCGGACGGCCGCGTGTTCCTGCAGTCAGCCCGCCCCGAGCTGTTCGCAATCTACGGCATTGGCCAAAAGCCGGTGCCGACGTCTGATGTTACCGCCGCGCCTACGCTCTCTGCTGACGGACTCTCGGTTGACTTTGATCCTGGCGACCAGTTCATGGTCGTGCTTCAGCAGAACGCCCCTTATCGCCAAATTTTTGAGACGACAAGCGGGTCATTTGGGTCGGTCACCTCCCCGACGCCGAACGGCTCAGAGCCTGATGCCTCATTTGCCGTTGATGATGTCGATGGCACTTTTTTGGCAGTTGTGGAGGGGTCTGGCAACGTCCTCTTGCTTGAGTACAACGGCTCTGATTTCGTCCTTGCCGACTCGTCAAACACGATGAGTTCCCCGAGCCGTGTCACATTTGACGCCACGGCGACATACATCGCTGTAGCAGACCTAGACCCTGACTATCTCGGAATCTATAAGCGCAGCGGGTCGACCATCAGCAAGCTCGCAAACCCCTCAACTTTGCCGGGCAATTCAGCAAACGATGTCGCGTTTTCCTCCGATGCCACCTATCTCGTGGTCGCAGAGGGATTCCCTCGACACATCACGATCTATAAGCGCAGCGGGGACACGTTCACAAAGCTATCTGCCCCTGCCCAGCCTCCAGATTCGACGCAGCAAGCGTGTGCGTTCAGCCCTGATGACGAATTGCTTGTGACTGGCGGTGGCGGCTCTGAGACGCTTATCGTTTACGAGCGCTCCGGGGACACGTTCACCAAGATATCGGCGGTCACTGATTATCCGTCACTGGCCACGAGCCTTGCATGGAGGTCAGACGGTAAATACTTGGTCGTAGGATCCGCACAAAGCCCTCATCTTGCGATCTATGAGCGTGACGAAATCAATAACCTGACCAAGATCCCGGATCCTGAGACGGTTCCATCCGGGGCTGTTAATGCCGTCGCCCTTGGGAATTCTGATGATCTGCTTGCGGTCGCGCATGATGGCGGTGACGGCTTGATCGTCTACGAGCCGGTCTACCCGTTCGACCCGCAGACCGAGTTCCGAATCCCGAACGTGCCCAATCTGACCCAGACAACAATCAACGGCTGGGCACCGCCTCAAGTGCGCCCCTATATCCGGTCAGGAGTGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
83ea92fd1a6690aaee924929e093b5e65a3369445ed7698e58605f6d544fc20f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8221
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
The Genome Sequence of Salicola phage CGphi29 Henn,M.R., Dillon,J., Levin,J., Malboeuf,C., Casali,M., Russ,C., Lennon,N., Chapman,S.B., Erlich,R., Young,S.K., Yandava,C., Zeng,Q., Alvarado,L., Anderson,S., Berlin,A., Chen,Z., Freedman,E., Gellesch,M., Goldberg,J., Green,L., Griggs,A., Gujja,S., Heilman,E.R., Heiman,D., Hollinger,A., Howarth,C., Larson,L., Mehta,T., Pearson,M., Roberts,A., Ryan,E., Saif,S., Shea,T., Shenoy,N., Sisk,P., Stolte,C., Sykes,S., White,J., Haas,B., Nusbaum,C. and Birren,B. 2011-09-23 GenBank