Genbank accession
QBQ72844.1 [GenBank]
Protein name
putative tail structural protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TF
Evidence RBPdetect
Probability 0,63
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MGFRDQNNKVAPIDDGGNFDTDTSVNSVTSTSEAAANALLAASHAEDALAAKIAAELAETNAETAETNAETAETNASTSATNAATSETNASTSETNAAASASAAASSAADAQSSEDDAEVSETNAANSAAAALVSENNASTSETNAAASAVTATTQAGISTTKAGEASVSAAAALVSENNASTSETNAATSETNAATSESNAAASAVSAETAKTNAETAETNAATSETNAAASAVTATTQAGIATTKAGEALTSANNAEAAKVAAAASQVASSNSQVAAASSAASAAAVFDQFDDTYLGSKASEPTVDNDGNALVVGALFYNSSTQGMFIWTGTEWVAASAAGGASLNNFSYTATAGQTTFTGSDENTNNLSYTVDNIIVTLNGVVLEGGGTDYTATDGSSIVLTSGAALSDEVNIVAFKTFTTADMVSSANGGAFQGNVDFNSGIDVTGNITVTGTVDGVDVAAFKASYDALDLDGDYVNSTGDTMTGNLSFGDNDKAIFGAGSDLQIYHDPANGSIVKDNGVGRLLLDSENGTGISLTSGGIAKTMISATKDSDVKLYNNGAPKLATTSTGVDITGTLTSDGLLVEGEVAGQGASIEAHATVTEFGDALLIARSDNASNNLHAGVKIQGSNNPFYIYQTNGANTNKLRFNYNAMSDAGGQMTIDNNGDLSLYDSTGTTPKFFWDASAERLGIGTSSPATSFDVRGVASTYGLNVAGGGAATGYIGEITNNSGAAGSRDGLKVETLLSDSTTKILTAASNSVDRFVVTGSGNVGIGTSSPSAKIDASGTYRMQLRTDDAVPELRSITTNGAAFKELGFNGLDLRFFTSSSERMRIDSSGNVGIGTSSPSQKLTVGFADNGTDGISFRSSTYANLAKILVQNETSTQNGNLQFHTRSGGSVNEAMRIDSNGRVAIGGTTVTDVNMLNIQGSGASSNIGVVLNDTNTSKVYGIQNGGSALKFFDYTASTERMRIDSSGNLGIGRTPSYRLDVDSTGMSASGRFNRYTDGSLRTLLIFRSSSNGSDVGAVYINNNSTSYNTSSDYRLKTDAQPMTGASARVQALNPVNFEWIADGTRVDGFLAHEAQEVVPEAVSGTKDAMMDEEYEVTPAVLDDDGNVVTEAVMGTRSVPDYQGIDQSKLVPLLTAALQEALTKIDALETRITALEG
Physico‐chemical
properties
protein length:1166 AA
molecular weight: 118486,56830 Da
isoelectric point:4,21702
aromaticity:0,05575
hydropathy:-0,20532

Domains

Domains [InterPro]
Coil
Unmapped
55–75
IPR030392
CHP
1041–1092
QBQ72844.1
1 1166
Architecture
STR
STR
STR
RBD
STR 8-118 | STR 150-770 | STR 785-966 | RBD 967-1166
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QBQ72844.1
1 1166
Domain Start End Length (AA) Confidence
N-terminal 1 491 491 0,9843
Central domain 492 701 211 0,2265
C-terminal 702 1166 464 0,9012
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-491
Central
492-701
C-terminal
702-1166

Taxonomy

  Name Taxonomy ID Lineage
Phage Roseobacter phage CRP-7
[NCBI]
2559286 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Rhodobacteraceae bacterium
[NCBI]
1904441 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Alphaproteobacteria > Rhodobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QBQ72844.1 [NCBI]
Genbank nucleotide accession
MK613349 [NCBI]
CDS location
range 41599 -> 45099
strand -
CDS
ATGGGATTTAGAGACCAGAACAACAAAGTCGCCCCCATCGATGATGGTGGTAATTTTGATACTGATACCAGTGTAAACTCTGTTACTTCTACCAGTGAAGCTGCTGCAAATGCCTTGCTTGCTGCAAGCCATGCGGAAGACGCTCTTGCCGCCAAAATAGCTGCAGAGTTAGCAGAAACAAATGCTGAGACAGCTGAAACAAATGCTGAAACAGCTGAGACAAATGCAAGTACAAGCGCAACTAATGCCGCTACATCAGAAACAAATGCTTCTACTTCGGAAACAAATGCGGCTGCAAGTGCTTCTGCCGCTGCTTCTTCGGCAGCAGATGCTCAGTCTTCTGAGGATGACGCTGAAGTATCAGAAACAAATGCAGCTAACTCTGCGGCTGCTGCTCTTGTTAGTGAAAATAATGCAAGCACTTCGGAAACTAACGCAGCTGCAAGCGCAGTAACTGCAACTACTCAAGCAGGAATTTCAACAACCAAAGCAGGGGAAGCTTCTGTAAGTGCAGCTGCTGCTCTTGTTAGTGAAAATAATGCAAGCACTTCAGAAACAAATGCGGCTACAAGTGAAACTAATGCAGCTACATCCGAATCCAATGCGGCGGCAAGTGCTGTATCTGCGGAAACTGCAAAGACAAACGCAGAAACTGCGGAAACAAACGCAGCCACCTCTGAAACTAACGCAGCCGCAAGTGCTGTTACTGCTACCACACAAGCAGGTATTGCAACCACCAAAGCAGGAGAAGCATTAACAAGCGCAAACAATGCGGAGGCAGCTAAAGTCGCTGCTGCTGCATCTCAGGTTGCTTCGAGTAACTCTCAGGTAGCGGCTGCTTCCAGCGCTGCATCTGCTGCTGCTGTATTTGACCAGTTTGATGATACCTACTTGGGCAGTAAAGCTTCTGAACCAACCGTAGATAATGATGGTAACGCTCTTGTAGTCGGTGCTCTCTTTTATAACTCCTCTACACAAGGTATGTTTATTTGGACAGGCACTGAATGGGTTGCTGCTTCTGCAGCCGGGGGTGCTTCTCTTAACAACTTTAGTTATACTGCTACTGCAGGCCAAACTACCTTCACTGGTTCAGACGAAAATACTAATAATCTTTCGTACACTGTAGATAACATTATTGTTACTTTAAACGGTGTTGTACTGGAAGGTGGTGGAACAGATTATACTGCCACTGACGGTAGTTCAATTGTACTAACTTCCGGAGCAGCTCTCAGCGATGAAGTCAACATTGTTGCATTCAAAACATTTACTACTGCGGATATGGTATCTTCTGCTAATGGCGGTGCATTTCAAGGCAACGTGGATTTTAACTCAGGCATAGATGTAACCGGAAATATTACAGTTACAGGTACTGTTGATGGTGTTGATGTTGCAGCCTTTAAAGCTTCCTATGACGCCTTAGACTTAGACGGTGATTACGTAAATTCTACTGGCGATACTATGACTGGCAACTTGTCCTTCGGAGATAACGACAAAGCCATCTTCGGCGCTGGGTCTGATTTACAGATTTATCATGATCCTGCAAATGGCAGTATTGTAAAAGACAATGGGGTCGGTCGCTTATTGCTTGATAGTGAAAACGGCACAGGCATATCTTTAACCTCTGGTGGTATTGCTAAGACAATGATTAGCGCCACTAAAGATAGTGACGTAAAACTTTACAACAACGGCGCACCCAAACTCGCCACCACCAGCACAGGCGTAGACATCACGGGTACTTTGACCAGCGATGGGCTTTTAGTTGAAGGAGAAGTAGCAGGTCAAGGGGCTTCTATAGAAGCACATGCAACAGTTACGGAGTTTGGCGATGCTCTGTTGATTGCAAGGTCTGACAATGCAAGTAATAATCTTCATGCAGGCGTAAAGATTCAAGGTAGCAACAATCCTTTTTACATTTATCAGACTAACGGTGCGAACACTAATAAGTTAAGATTTAATTATAATGCGATGTCTGATGCAGGTGGTCAAATGACTATCGACAACAACGGCGACCTGTCGCTGTACGATTCCACAGGCACGACACCAAAGTTCTTCTGGGATGCGAGTGCGGAACGGTTGGGCATTGGGACGAGTTCGCCAGCAACTAGCTTTGATGTACGAGGTGTTGCGAGTACCTATGGCTTGAATGTCGCTGGCGGTGGAGCGGCTACTGGCTATATAGGGGAAATCACAAACAATAGTGGAGCTGCTGGAAGTCGTGATGGACTTAAAGTAGAAACATTATTATCCGACAGCACCACTAAAATCCTTACAGCCGCATCTAATAGTGTAGATAGGTTTGTGGTTACAGGCAGCGGTAATGTTGGGATTGGCACGAGTTCGCCTAGTGCAAAGATAGATGCTTCTGGAACGTATCGTATGCAGTTGCGCACTGATGACGCAGTCCCAGAGTTACGTTCTATAACAACAAACGGTGCAGCGTTTAAGGAACTGGGATTCAACGGGCTAGACCTTAGATTTTTTACCTCTAGCTCAGAACGCATGCGCATCGACAGCAGCGGTAATGTCGGGATTGGCACGAGTTCGCCTAGTCAAAAGCTAACAGTAGGTTTTGCCGATAATGGTACGGATGGTATTTCATTTAGAAGTTCTACCTATGCAAATCTAGCTAAGATTTTGGTTCAAAACGAGACGTCTACTCAAAACGGAAACCTGCAATTTCATACACGTTCAGGCGGTAGTGTAAATGAAGCCATGCGCATCGACAGCAATGGCCGTGTCGCAATTGGCGGCACTACAGTTACTGACGTAAACATGTTAAACATTCAAGGCTCTGGTGCGTCTAGCAATATTGGCGTGGTCTTAAACGACACAAATACTTCTAAAGTATACGGCATACAGAACGGCGGCTCGGCCTTAAAGTTCTTTGATTATACAGCTTCCACAGAACGTATGCGCATCGACAGCAGCGGTAATCTCGGGATTGGCAGGACACCTTCCTATAGATTAGATGTTGATAGCACTGGAATGTCAGCGTCAGGACGATTTAACCGATACACAGATGGGTCTCTAAGAACCTTGCTGATTTTCAGAAGTTCATCTAACGGGTCAGATGTTGGCGCAGTTTACATAAACAATAATTCAACTTCATACAACACATCCTCAGACTACCGCCTAAAGACTGACGCACAGCCAATGACAGGTGCATCTGCCCGTGTCCAAGCACTAAACCCAGTGAACTTTGAGTGGATTGCAGACGGTACTCGTGTCGATGGTTTCCTTGCACATGAGGCACAAGAGGTTGTCCCAGAGGCTGTCTCAGGCACCAAAGATGCCATGATGGACGAAGAGTACGAAGTTACTCCAGCGGTTCTTGATGACGATGGCAATGTTGTAACTGAAGCTGTCATGGGTACTCGCAGTGTTCCTGACTACCAAGGTATTGACCAAAGCAAGCTAGTACCTCTGCTGACTGCAGCGCTGCAAGAGGCACTAACCAAAATTGATGCCCTTGAAACTCGCATCACAGCCCTAGAAGGATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
ebe438d08fb0abdfb60fff1c96362ce2fda438eb9491eae9f59d390b84b4648c
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,3110
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Diverse, abundant and novel viruses infecting the marine abundant Roseobacter RCA lineage Zhang,Z.F., Chen,F., Chu,X., Zhang,H., Luo,H.W., Zhai,Z.Q., Yang,M.Y. and Zhao,Y.L. 2019 GenBank