Genbank accession
QGJ87579.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,79
TSP
Evidence RBPdetect2
Probability 0,94
Protein sequence
MPTITYTLDDGFGTPGKKLKLKWQPATIRTHDGALVVGGPPKEVFSTVGTSTTIEGIASGMWAISNFGVAGGHRTAYIDVDEVGGDVTALIEAAVALPQNAPVTDVIAAAKAAAEVAVGGLDVLTQEDADAAYAPVWKASTVYALGAKVVSPLTGDVIRRLTAGTSRESFDTTEQALWLAAYGTVTRTVAAVDTPMPFRARADYLCDGTADLATIQQALDALPDDNAVSGEIVLLAGNYSDATNATLSVGSPSSATLNPRKVLRFERGARINVSGRTGRKAVVKVESPDCQIINPNIAGNAAFGNGTGISIGGDVATLGGFWGKVANRVLIYEPILSNLETGLEFASIDGGPGVGGSTGDCKVHGGYIFQCKTGIRAAGYTNTMYAPTLANNNKAIWVEARRSEAQLRVHDPAIVGWNEVGILVEGGFGSVFSNTWMEQNPASASTATEAIRLGQSGTVRANATKFTGTTHVQLVNEQYAIKYVGAIGTEVEELVLSTSGAVPSVAVARNEMQSTSKNNRIRRYTFGPNAIPSHTSLSIDAAAWGELFIDRVSGLVGADGFSTRRNPSTRASSTPVARKLTDSSKTSDATMGSDTELTVNLNPGTVYALDGIIFFDAGQTGDFKMALSVSGTNSTISWVGVGPASSHTNAVGVSSVTTQRATSGFVMTWGGAAAGTVIGVPIKGVVSVTELATITMTWAQAVADATPTILKAGSYLELTPIS
Physico‐chemical
properties
protein length:722 AA
molecular weight: 74771,14980 Da
isoelectric point:5,39603
aromaticity:0,06648
hydropathy:0,05180

Domains

Domains [InterPro]
DC_0959
STR
55–575
IPR011050
STR
207–441
QGJ87579.1
1 722
Architecture
STR
STR 55-575 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QGJ87579.1
1 722
Domain Start End Length (AA) Confidence
N-terminal 1 211 211 0,9904
Central domain 212 557 347 0,9897
C-terminal 558 722 164 0,9846
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-211
Central
212-557
C-terminal
558-722

Taxonomy

  Name Taxonomy ID Lineage
Phage Gordonia phage Faith5x5
[NCBI]
2656535 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QGJ87579.1 [NCBI]
Genbank nucleotide accession
MN585966 [NCBI]
CDS location
range 20945 -> 23113
strand +
CDS
ATGCCCACGATCACGTACACGCTCGACGACGGGTTCGGCACACCCGGGAAGAAGCTGAAGCTGAAGTGGCAGCCAGCGACGATCCGCACACATGACGGCGCGTTGGTCGTCGGTGGCCCACCGAAGGAAGTGTTCTCGACGGTCGGCACCTCAACGACGATCGAGGGTATCGCTTCCGGGATGTGGGCGATCAGCAACTTCGGTGTGGCGGGTGGTCATCGGACGGCGTACATCGATGTTGATGAGGTGGGCGGGGATGTGACCGCGCTCATCGAGGCCGCGGTCGCCCTCCCACAGAACGCGCCCGTCACCGACGTCATCGCGGCGGCGAAGGCCGCGGCAGAGGTCGCGGTCGGCGGGCTCGACGTGCTCACCCAAGAGGACGCCGACGCGGCTTATGCCCCGGTCTGGAAGGCGTCCACTGTGTACGCCCTCGGCGCGAAGGTGGTGTCGCCGTTGACGGGCGACGTCATCCGCAGGCTGACTGCGGGCACCTCGCGCGAGAGCTTCGACACCACCGAACAGGCGCTGTGGCTCGCCGCCTACGGCACGGTCACACGGACCGTTGCGGCCGTCGACACCCCGATGCCGTTCCGCGCCCGGGCGGACTACCTCTGCGACGGCACTGCTGACCTCGCAACCATCCAGCAGGCACTCGACGCCCTGCCCGATGACAACGCCGTGTCTGGCGAAATCGTGCTGCTCGCAGGCAACTACTCCGACGCAACCAACGCCACCCTGTCGGTCGGCTCCCCGTCGTCGGCCACGCTCAACCCCCGCAAGGTGCTGCGCTTCGAGCGCGGCGCCCGCATCAACGTCAGCGGGCGGACCGGACGCAAAGCCGTCGTCAAGGTCGAATCCCCCGACTGCCAGATCATCAACCCGAACATCGCGGGCAACGCTGCCTTCGGCAACGGGACGGGCATCTCCATCGGTGGAGACGTTGCCACGCTCGGCGGGTTCTGGGGCAAGGTCGCCAATCGTGTGCTCATCTACGAGCCGATTCTGTCCAACCTGGAGACCGGTCTGGAGTTCGCCAGCATCGACGGCGGACCAGGCGTCGGAGGGTCAACCGGGGACTGCAAGGTTCACGGCGGCTACATCTTCCAGTGCAAGACCGGCATCCGGGCGGCCGGCTACACCAACACGATGTACGCCCCGACATTGGCGAACAACAACAAGGCGATCTGGGTAGAAGCTCGGCGATCTGAAGCCCAGCTCCGCGTGCATGATCCTGCGATCGTCGGCTGGAACGAGGTCGGCATCCTCGTTGAGGGTGGTTTCGGCTCGGTGTTCTCGAACACCTGGATGGAGCAAAACCCGGCCTCGGCGAGCACCGCGACCGAAGCCATCCGGCTCGGGCAGTCGGGAACCGTTCGCGCCAACGCAACGAAGTTCACCGGCACCACACACGTGCAGCTCGTGAACGAGCAGTACGCGATCAAGTACGTCGGCGCGATCGGCACCGAGGTCGAGGAACTCGTGCTCTCGACGAGCGGGGCGGTCCCGTCGGTCGCCGTGGCACGCAACGAGATGCAGTCAACCAGCAAGAACAACCGCATCCGGCGCTACACCTTCGGACCGAACGCGATCCCCAGCCACACCTCACTCTCGATCGACGCGGCCGCGTGGGGTGAGCTGTTCATCGACCGCGTGTCCGGACTGGTCGGCGCGGACGGCTTCAGCACCCGACGCAACCCCTCCACCCGCGCATCATCGACGCCGGTCGCCCGAAAGCTGACTGACTCGTCGAAGACGTCCGACGCCACGATGGGTTCCGACACCGAGCTGACTGTGAACCTCAACCCAGGCACCGTCTACGCACTCGACGGGATCATCTTCTTCGACGCTGGCCAGACGGGTGACTTCAAGATGGCCCTGTCGGTGTCGGGCACCAACTCGACGATCTCGTGGGTGGGCGTCGGTCCGGCGTCCTCGCACACCAACGCGGTGGGGGTGTCGAGTGTGACGACGCAGCGCGCGACGTCGGGGTTCGTGATGACGTGGGGCGGGGCCGCGGCCGGCACGGTGATCGGCGTGCCGATCAAGGGTGTCGTCTCGGTTACTGAGTTGGCGACCATCACGATGACGTGGGCTCAGGCCGTCGCGGACGCGACTCCGACAATCCTCAAGGCTGGCTCGTACCTCGAACTCACCCCGATCAGTTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
965693cb27163252010ff4ba1807565ffa02427fefe428af146ca74c18001443
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7938
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50