Genbank accession
QGH74829.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence RBPdetect
Probability 0,56
Protein sequence
MASSVGRIALGVVGAIIGAPFGLSAVGFAIGSAIGGAIFAPEGPNVEGPRLGDTTVSASSLGKVIPEHYGVTRTSGNVIWSAGLKEIKKEESNGGGGKGGGGGGGTTTTYEYYASFATALGRGPAKEVRKIWADGKLIYDGTGDSETDNSKYTWRLRKGAADEGIDPLIAESIHRRLAGMADVNKGNQEQAVYTTINDLITQAQAGTDGRSQLYATGLAQLKAEAETGLEDGGVPDYGFTPAYRGIAMLVFDDMKLEDFGNRIPNITVEVVWEGATSGNGADGGDEVDPTGVDVTQIASTAVPEGLMAVDPFGKKLFTHAGNTVRRFSAEGRNEDRQKAVSADGAPPEDWTETVWDPNEGRDGDYVLVPAAADYGWTINKFLCALPSGNVLAAGSRKKEGWADNFDEVVPTVFALSGAGIEPIGPTGSGKYANAEFGTMVNIPGNYPNWLQVREADRGDSGTVQTDGATGDHFAVVAGTTISAARLHEGVVTDETSITAPSSANILFFQNNGPMVSGGVGGNGDADFYLSKWSSNALWIGRYRLTNHAIKNGNGQNYVLQITNTDSVAIPNPFGSSITAISAMIRNPGTDEVFLLVSLSNGQSGIIEFTENLDKGYHQSIPAAAPAPDSGLSRSDVTNGTLAFADGTDIIEIAMIDGSHKVYSDILSNSASNKAQAYFAEIAGLFLWEGGQPRIYTVGTIGGSSRDHDIAATLPEVIRSICDRAGMASDEFDVSGVSDHPVRGYTIARQSSGRQALENLMQAFFVDGIETDWKVVFKDRSTDSVRTIDEDELGEVSSPTGKVNWLESRTPEYELPAEINLNFSDPVRDYQTSTAHKRRIANPIPSMYSHTVKNVELPLVMKEHEAQSTAERLLYLSWMSRDSAKSVLNWTHADLDPGDVITVRFKDGRIVTDRVAKATLGANFEIETETVRSGDPVYDPAPQTIIPTGSIPTVNSPIPVSSEMFVFDIPLLFDYHETGRAVARHYTAVGSESDNWTSATIFKSIDGASYLAGDTVALDVTWGSVLGTLQRPRALWTTDRDNKLRIAVAKDKGNLVSVTREEILNGANRALVYNRDTGIGEIIQFQNVSIEDNGATFVLSDLTRGCRGTEYAADKHTAGEVFILLNETDIQVSTTELELLGSTAYFKAVSAGQIITGVSPQSRRFVGRSLMPYAPSRVRRADSGGDLVISWNRRTRVGGGWDMLNNIETVPLSEDFESYELYLLPSVANALDNFSPTDPTSYLEKRGVNATSSTFTAAELSAHGLTLDDDIYVCVYQLSGQVGRGFPALGKLAP
Physico‐chemical
properties
protein length:1293 AA
molecular weight: 138121,79910 Da
isoelectric point:4,76063
aromaticity:0,08043
hydropathy:-0,24292

Domains

Domains [InterPro]
IPR032876
ATT
748–904
DC_2254
STR
777–1019
QGH74829.1
1 1293
Architecture
ATT
STR
ATT
STR
RBD
ATT 1-324 | STR 432-747 | ATT 748-904 | STR 905-1019 | RBD 1020-1293
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QGH74829.1
1 1293
Domain Start End Length (AA) Confidence
N-terminal 1 129 129 0,7739
Central domain 130 476 348 0,5578
C-terminal 477 1293 816 0,2294
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-129
Central
130-476
C-terminal
477-1293

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacteriophage DSS3_MAL1
[NCBI]
2664194 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QGH74829.1 [NCBI]
Genbank nucleotide accession
MN602268 [NCBI]
CDS location
range 44383 -> 48264
strand +
CDS
ATGGCATCTAGTGTAGGACGCATCGCCCTCGGGGTCGTCGGTGCCATCATTGGTGCGCCGTTCGGCCTGTCTGCGGTCGGCTTTGCTATCGGCTCTGCCATTGGCGGGGCCATCTTCGCCCCTGAGGGACCCAACGTCGAAGGCCCGCGCCTCGGCGACACGACGGTGTCTGCGTCGAGTTTGGGCAAGGTCATTCCGGAACACTACGGGGTGACCCGTACGTCCGGTAACGTGATCTGGTCTGCAGGGCTGAAGGAGATCAAGAAGGAAGAAAGCAACGGCGGCGGCGGCAAGGGCGGCGGTGGTGGTGGAGGCACGACCACCACCTATGAATACTACGCCTCTTTCGCGACGGCCCTCGGGCGCGGGCCTGCCAAGGAAGTCCGCAAGATTTGGGCGGACGGCAAGCTCATCTACGACGGCACGGGGGACAGCGAGACCGACAACAGTAAGTACACGTGGCGTCTCCGCAAGGGGGCGGCGGATGAAGGTATTGACCCGCTGATCGCAGAGTCCATCCATCGCCGCCTCGCAGGCATGGCCGACGTGAACAAGGGCAATCAGGAACAGGCAGTCTACACCACGATCAATGACCTGATCACGCAGGCGCAGGCAGGAACGGACGGGCGTAGCCAGCTCTACGCTACCGGACTGGCACAGCTCAAGGCAGAAGCGGAAACCGGCCTCGAAGATGGAGGGGTGCCGGACTACGGTTTCACGCCTGCATACCGGGGCATCGCGATGCTCGTGTTCGACGACATGAAGCTGGAAGACTTCGGAAACCGCATCCCTAACATCACCGTGGAGGTTGTTTGGGAAGGAGCGACGTCCGGGAATGGCGCAGATGGTGGGGACGAGGTGGACCCGACTGGCGTGGATGTCACCCAGATCGCGAGCACGGCGGTTCCGGAAGGACTCATGGCGGTAGACCCGTTCGGGAAGAAGCTCTTCACCCACGCTGGTAATACTGTACGCCGCTTCTCTGCAGAGGGCCGTAACGAGGACCGCCAGAAGGCCGTTTCTGCGGACGGGGCACCGCCTGAAGACTGGACGGAAACCGTATGGGACCCGAACGAGGGGCGCGACGGGGATTACGTTTTGGTGCCCGCCGCGGCGGACTATGGGTGGACCATTAACAAGTTCCTTTGCGCCCTTCCCAGCGGCAACGTGCTCGCTGCAGGCTCTCGCAAGAAGGAAGGGTGGGCGGACAACTTCGATGAGGTGGTCCCTACTGTGTTTGCTCTTTCGGGGGCCGGGATCGAGCCTATCGGACCTACGGGAAGTGGGAAGTACGCAAACGCCGAGTTCGGTACGATGGTGAACATCCCCGGCAACTACCCGAACTGGCTTCAGGTTCGGGAAGCGGATCGGGGAGACTCAGGCACCGTACAGACTGACGGAGCTACCGGGGATCACTTTGCGGTTGTTGCGGGTACGACCATTTCTGCGGCGCGTCTGCATGAAGGCGTCGTCACTGACGAGACCTCCATCACCGCACCGTCATCCGCTAATATTCTGTTTTTCCAGAATAACGGTCCCATGGTTTCTGGGGGCGTTGGAGGGAACGGGGACGCTGACTTCTACCTGTCCAAGTGGTCCAGCAACGCGCTTTGGATCGGACGCTACCGCCTGACCAACCACGCGATCAAGAACGGCAACGGACAGAACTACGTTCTGCAGATCACCAACACGGACAGCGTTGCCATTCCCAATCCGTTTGGGTCCTCCATCACGGCTATCTCCGCAATGATCCGTAACCCCGGCACGGATGAGGTGTTCCTTCTGGTGAGCCTGTCTAACGGCCAGTCGGGTATCATTGAATTCACGGAGAACCTTGATAAGGGGTACCACCAGTCGATCCCGGCAGCAGCTCCTGCGCCGGACAGCGGCCTGTCACGCTCGGATGTCACTAACGGCACTCTGGCGTTTGCGGACGGCACCGACATCATCGAAATCGCGATGATTGACGGTAGCCACAAGGTGTATTCGGACATCCTCTCTAACTCTGCCAGCAACAAGGCGCAGGCTTACTTTGCCGAGATCGCAGGCCTGTTCCTGTGGGAGGGAGGACAGCCGCGTATTTACACTGTCGGCACCATTGGGGGATCGAGCCGCGATCACGACATCGCAGCGACTCTCCCTGAGGTGATCCGGAGCATCTGTGACCGCGCTGGCATGGCGTCGGATGAATTCGATGTATCCGGCGTATCCGACCACCCGGTACGCGGGTATACGATTGCACGTCAGTCGTCGGGGCGGCAGGCCTTGGAAAACCTCATGCAGGCCTTCTTTGTGGACGGCATCGAGACGGATTGGAAGGTGGTGTTCAAGGATCGCAGCACGGACTCCGTCCGGACCATCGACGAGGATGAGCTGGGGGAAGTAAGCAGCCCGACTGGTAAGGTGAACTGGCTGGAAAGCCGCACCCCTGAGTACGAGCTTCCTGCTGAAATCAACCTCAACTTTTCGGACCCTGTCCGGGATTATCAGACCAGCACGGCACATAAGCGCCGCATCGCGAACCCCATCCCCTCTATGTATTCCCACACGGTGAAGAACGTAGAACTCCCTCTTGTTATGAAGGAGCACGAGGCCCAGTCTACTGCAGAGCGGCTGCTCTACCTGAGCTGGATGAGCCGCGATTCCGCAAAGTCTGTGCTGAACTGGACGCACGCGGACCTCGATCCGGGAGATGTGATCACTGTCCGGTTCAAGGACGGGCGCATCGTCACGGACCGGGTTGCCAAGGCAACCCTCGGGGCGAACTTTGAAATCGAAACGGAGACGGTACGCTCTGGGGACCCGGTCTATGACCCGGCACCGCAGACGATTATTCCCACTGGCTCCATCCCGACCGTCAATAGCCCGATCCCGGTGTCCAGCGAGATGTTCGTTTTCGACATCCCGCTCCTGTTCGACTACCACGAGACGGGGCGCGCTGTCGCGCGCCACTACACTGCGGTTGGGTCGGAATCTGATAATTGGACCTCCGCGACGATCTTCAAGTCGATTGACGGGGCGTCGTACCTCGCCGGAGACACGGTGGCGCTTGACGTGACTTGGGGTAGTGTCCTTGGAACGCTGCAGCGCCCGCGGGCGCTCTGGACCACGGACCGGGACAACAAGCTTCGCATCGCTGTTGCCAAGGACAAGGGAAACCTCGTGTCCGTCACCCGTGAGGAAATCCTCAACGGAGCCAACCGCGCACTGGTCTACAACCGGGATACGGGGATTGGGGAGATCATCCAGTTCCAGAATGTTTCCATTGAGGACAACGGGGCGACTTTCGTTCTCTCCGATCTGACGCGCGGATGCCGCGGAACTGAATACGCGGCAGATAAGCACACCGCCGGGGAAGTGTTCATCCTTCTCAATGAGACGGATATTCAGGTGTCCACCACCGAGCTGGAGCTGCTTGGAAGCACCGCCTACTTCAAGGCGGTTTCGGCGGGGCAGATTATCACGGGCGTTAGCCCGCAGTCGCGCCGGTTCGTTGGGCGTTCCCTCATGCCCTACGCTCCTTCTCGTGTGCGCCGCGCCGACTCCGGAGGGGACCTCGTGATCAGTTGGAACCGCCGCACCCGTGTTGGGGGTGGATGGGACATGCTCAACAACATCGAGACGGTACCGCTCAGCGAGGATTTCGAGTCCTACGAGCTTTACCTTCTCCCCTCGGTCGCGAACGCGTTGGACAATTTCTCTCCGACCGACCCGACCAGCTACCTTGAGAAGCGGGGGGTCAACGCGACTTCCTCGACCTTCACGGCAGCGGAACTGAGTGCCCACGGCCTCACGCTCGACGATGACATCTATGTGTGCGTCTACCAGCTCAGCGGGCAGGTAGGGCGTGGGTTCCCTGCGCTCGGAAAGCTTGCCCCGTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
db9f3389dc49653c6972114ac210f44569dc8f6602ce0911addd83eb71a36a27
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,8022
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Isolation and characterisation of a new family of globally distributed lytic roseophage, the Naomivirus Rihtman,B., Puxty,R.J., Hapeshi,A., Zhan,Y., Michinevski,S., Waterfield,N.R., Chen,F., Millard,A.D., Scanlan,D.J. and Chen,Y. 2021-07 GenBank