Genbank accession
AZV00409.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect2
Probability 0,80
Protein sequence
MALLDDINRLLRDHTGYTGDGQGSNGPLPVGDRSTARYTPNMRDLRELMKTIAQTLGDPGALQDILANSGKVFANRAEAVSFGQDRLPAALGRIITLEGNYLVVRGQGQTEDDPLFEIAPRWGVLVRIPNRDLVESISNLGDVLSLQTDTEASTGQLVMATIPAGQAHMTLYAGQQLRFRWPFSNTGPDPVINIDGAEFLIRARNGGELSAGDLPGGQRLLGYVYFNTPETKIIRLSESVRATDINGLKGSLEAGSIIPLVNIGGDGTVITADLAAAAVNAGVTVTGSLSVRYIPAATNANDAETDVTLFVSGDEPRILRSADGTRLPAEFFVVGRAYTLDRRGTIWRVATGSVDRMELNGKADLANSGKTFSSRAAAVALGQENLPSILGPIITQEGNFLVFRGPGQNTDDPLFETAPRWGVIVRAPAGTLLGIGAIPLINISGTGDAIAAELSIPEARISDRTSVEYIPVDTNTGAVKLTIDGDIERDVFSPDGTVLPPGYFKPGRSYTLTRRGASAWRVRSGTVDDRDLATALAAKADLANSGRIFSTRAAAVAAGQAALPGSLGQIFTGAGRALQVRGPGSTNDPLFDTWPYWGIAQVQNTSWAVANAGIPRLNTIASSSGPYLARFSAGVANYISAGDLTDNSKVEFIPNRDSPAAPSILIEGDTERSIFSSTGQILPQGAMKAGKAYLLTRRGEFWRLLVDDSSDVPPDVATRLTALEAGLPAERLAREAADQAEADARQVDVAGLQHEVSDLRSDVDALVTGVRPVGDWDAASGAFPSDRPDASPVQAGDQWSVTGGGVVDGVNFAPGDLLTALVDGGGATYAGSWSRRVGTATQADQVVTTTPGVSVQNWIDRYVKRTSLEWNLSEYLDDEDYYYAGLANSADQDEARVTAAVQLFHDEFMDWWSTSPGRHGLVRYRPITLAVNDEVFSEYFAQSLWDMSNLFDDSRVEFDCSGVKFQIKNWSARAAVRTSGFWAAEGIVEPVPKAVWRWEQSSSRQLSPQIRGRMYITGEMNPNMDVIGMKTMSLNAANLDRVYINNLCNYGKFTENFFNSTVNEMDILRCGYQPTDFGGDGFMSASVRFSNVGNIIEATEPVFESGHAGLSFALAGAGPARGGLRQVHWSPVDEVLDAHHVRLVKVPAANVTGQVGSFEAIRGSIEAGSALLELSRPISRSLVGRYITVFRCGQQGAPSDFGTLTARVTSHVGDQVILSHAAQLTVHGAAVSVACGLYQGRSSDFMLTNRGQNNDVTYHNLRLVGGEISHSACAILVDNNGVDFGPGSKVHGSPPVANNFGGNFMAIGYDVAETVNLDHCLIEHGGHSPRFGRHVLTGGNIQVDVSGGVAGDFLIGTESAEVYNDIHDNPTVAQFYYSAIRHRGYVADQQLIRYGANGRPGQVLGGASSRSARRNPDALAFPNRVAGNGGPTSQRPSPPFLFEKFFDTDLGVEITWTGSAWVDALGNAV
Physico‐chemical
properties
protein length:1469 AA
molecular weight: 156754,07600 Da
isoelectric point:5,05278
aromaticity:0,07897
hydropathy:-0,15854

Domains

Domains [InterPro]
DC_0847
STR
7–252
DC_0847
STR
532–722
AZV00409.1
1 1469
Architecture
STR
STR
STR
STR 7-252 | STR 359-722 | STR 825-1469
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AZV00409.1
1 1469
Domain Start End Length (AA) Confidence
N-terminal 1 878 878 0,9962
Central domain 879 1405 528 0,9684
C-terminal 1406 1469 63 0,9220
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-878
Central
879-1405
C-terminal
1406-1469

Taxonomy

  Name Taxonomy ID Lineage
Phage Paracoccus phage vB_PthS_Pthi1
[NCBI]
2500570 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Paracoccus thiocyanatus
[NCBI]
34006 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Alphaproteobacteria > Rhodobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AZV00409.1 [NCBI]
Genbank nucleotide accession
MK291444.1 [NCBI]
CDS location
range 29515 -> 33924
strand +
CDS
ATGGCTCTGCTTGACGACATCAACCGCCTGCTGCGCGACCACACCGGCTATACCGGCGACGGGCAGGGCAGCAATGGACCGCTGCCGGTCGGGGACAGGTCCACTGCGCGCTACACGCCGAATATGCGCGATCTGCGCGAGTTGATGAAGACCATCGCCCAAACCCTGGGCGATCCCGGCGCGCTCCAGGACATCCTTGCCAATAGCGGCAAGGTTTTCGCAAACCGCGCCGAGGCGGTGAGCTTTGGCCAGGACCGTCTGCCCGCGGCGCTGGGGCGCATCATCACACTCGAGGGCAACTACCTGGTTGTGCGCGGCCAGGGTCAGACCGAGGATGATCCGCTGTTCGAAATCGCGCCGCGCTGGGGCGTCCTCGTTCGCATACCCAACAGGGATCTGGTCGAGTCGATCAGCAACCTCGGTGATGTCCTCTCCCTGCAGACCGACACCGAGGCCAGCACGGGGCAGTTGGTCATGGCGACCATCCCGGCCGGACAGGCTCATATGACCCTGTACGCGGGCCAGCAGCTTCGGTTCCGCTGGCCGTTCTCGAACACCGGGCCGGATCCCGTCATCAACATCGATGGCGCCGAGTTCCTGATCCGGGCGCGCAATGGGGGGGAATTGTCCGCTGGCGATCTTCCAGGCGGCCAGCGCTTGCTGGGCTATGTCTATTTCAACACGCCGGAAACCAAGATCATCCGCCTGTCGGAATCTGTCCGGGCGACCGACATCAATGGCCTCAAGGGCTCGCTGGAGGCCGGGTCGATCATCCCGCTCGTCAACATCGGGGGCGACGGCACCGTGATCACCGCCGACCTAGCTGCGGCGGCAGTCAATGCCGGCGTCACGGTCACCGGCAGCCTGTCGGTGCGATACATCCCGGCCGCGACCAACGCCAACGATGCCGAGACCGATGTGACGCTGTTCGTGTCGGGCGACGAGCCGCGGATCCTGCGTTCCGCCGACGGCACGCGGCTTCCCGCAGAGTTCTTTGTCGTCGGCCGGGCCTATACCCTCGACCGGCGCGGGACGATCTGGCGCGTGGCCACGGGCAGCGTTGACCGTATGGAATTGAACGGCAAAGCGGACCTCGCCAACTCGGGCAAAACCTTTAGCTCCCGTGCGGCTGCGGTCGCATTGGGACAGGAGAATCTGCCGAGCATTCTGGGACCGATTATCACTCAAGAGGGAAATTTTCTGGTGTTTCGTGGACCGGGACAGAACACCGATGATCCGCTCTTTGAAACTGCACCTCGGTGGGGCGTGATCGTGCGCGCGCCGGCCGGCACTTTGCTGGGCATAGGCGCGATTCCACTGATCAACATCAGCGGCACGGGCGACGCGATTGCCGCGGAACTTTCCATCCCAGAGGCCCGGATTTCCGACAGAACTTCGGTCGAATACATCCCTGTCGATACAAACACGGGTGCGGTCAAGCTCACCATCGACGGCGACATCGAGCGAGATGTGTTCAGCCCGGACGGGACGGTTCTGCCCCCAGGATACTTCAAGCCGGGCCGGTCCTATACCCTGACGCGCCGTGGCGCGAGCGCATGGCGCGTCCGCAGCGGTACAGTGGATGATCGAGATCTAGCGACCGCACTGGCCGCCAAGGCCGATCTGGCGAACAGCGGCCGAATATTCTCTACCCGAGCTGCTGCTGTCGCGGCTGGTCAGGCCGCTTTGCCGGGGTCGTTGGGCCAAATTTTCACCGGTGCCGGCCGGGCCCTCCAGGTGCGCGGCCCAGGGTCAACTAACGACCCGCTGTTCGATACGTGGCCTTATTGGGGTATCGCACAGGTCCAGAACACCTCCTGGGCGGTGGCGAATGCGGGGATACCGCGACTGAACACAATAGCGTCGAGTTCCGGTCCCTATCTGGCCCGGTTTAGCGCTGGAGTGGCGAACTACATCTCGGCTGGCGACCTCACCGACAACAGCAAGGTCGAGTTCATTCCGAACAGAGACAGCCCGGCGGCCCCCTCGATCTTGATTGAGGGTGATACTGAGAGGTCCATTTTTTCCAGCACCGGCCAGATTCTGCCCCAGGGGGCGATGAAGGCAGGAAAGGCATATCTCCTGACCCGCAGGGGCGAATTCTGGCGCCTGCTGGTTGACGATTCCTCCGATGTGCCGCCTGATGTTGCAACGCGGCTGACAGCCTTGGAGGCCGGTCTGCCGGCAGAGAGGCTTGCTCGAGAGGCCGCGGATCAGGCGGAGGCCGATGCCCGGCAGGTTGACGTTGCAGGGCTTCAGCACGAGGTTTCTGACCTGCGTAGTGATGTCGATGCTCTCGTGACCGGTGTCCGACCGGTGGGGGATTGGGACGCGGCGTCGGGCGCCTTCCCATCCGATCGGCCTGACGCTAGCCCGGTACAGGCCGGTGACCAATGGTCAGTAACCGGTGGCGGCGTTGTCGATGGCGTCAATTTCGCGCCAGGCGACCTGCTGACCGCGCTGGTGGATGGAGGCGGAGCAACCTACGCTGGTTCTTGGAGCCGCCGTGTTGGCACGGCGACACAGGCCGATCAGGTGGTCACGACCACGCCCGGGGTTTCTGTTCAAAACTGGATCGACCGCTACGTAAAACGCACGTCTTTGGAGTGGAATCTGTCCGAATATCTGGATGACGAGGACTATTATTACGCCGGCCTGGCGAACTCTGCCGATCAGGATGAGGCTCGAGTCACGGCGGCGGTGCAGTTGTTTCATGACGAGTTCATGGACTGGTGGTCCACGTCTCCGGGGCGACATGGTTTGGTGCGTTACAGACCAATCACGCTGGCCGTCAATGATGAGGTGTTCAGCGAGTACTTCGCGCAGAGCCTTTGGGACATGAGCAACTTGTTCGATGACAGTCGGGTTGAGTTCGATTGCTCGGGCGTCAAATTCCAGATCAAGAACTGGAGCGCACGTGCGGCGGTCAGAACGTCCGGTTTCTGGGCCGCCGAGGGGATCGTTGAACCTGTTCCGAAGGCCGTTTGGCGGTGGGAGCAATCTTCCTCGCGCCAGCTTTCTCCCCAGATCAGGGGGCGCATGTATATCACGGGGGAAATGAACCCGAATATGGATGTGATTGGCATGAAAACCATGTCCCTAAACGCGGCAAATCTGGATCGAGTCTATATCAATAACCTGTGCAATTATGGAAAGTTCACCGAGAACTTCTTTAATTCCACGGTTAACGAGATGGATATTCTGCGTTGCGGATACCAGCCTACTGATTTTGGTGGCGACGGCTTCATGTCTGCATCGGTTCGATTTTCCAATGTCGGAAATATCATTGAGGCTACCGAGCCGGTGTTTGAAAGCGGCCATGCTGGCCTGTCGTTCGCGCTTGCGGGCGCGGGCCCTGCTCGCGGCGGATTGCGCCAGGTCCACTGGTCGCCGGTGGACGAAGTACTTGACGCGCACCATGTCAGGCTGGTCAAGGTTCCAGCCGCCAATGTAACCGGTCAGGTCGGCAGTTTCGAAGCGATCCGGGGCTCAATTGAGGCCGGGTCGGCCCTACTGGAACTTTCCAGACCGATCTCGCGGAGCCTGGTGGGGCGATATATCACCGTGTTCCGCTGTGGGCAGCAGGGCGCGCCGTCTGATTTCGGAACCCTGACCGCGCGGGTGACCTCCCATGTTGGCGATCAGGTCATCCTGTCCCATGCGGCGCAGCTGACCGTCCATGGTGCTGCGGTCTCAGTTGCGTGTGGACTGTATCAAGGACGCTCGTCTGATTTCATGCTGACGAACAGGGGGCAAAACAATGATGTAACTTACCATAATCTCAGGCTGGTCGGCGGCGAGATTTCGCATTCAGCATGCGCAATACTCGTGGACAACAATGGCGTGGATTTTGGTCCAGGGTCCAAGGTCCACGGGTCGCCGCCGGTCGCGAATAACTTCGGCGGGAACTTCATGGCCATCGGTTATGACGTGGCGGAAACGGTGAACCTCGATCACTGCTTGATCGAGCATGGCGGGCATTCACCGCGTTTTGGTCGGCATGTCCTGACCGGCGGTAACATCCAAGTCGATGTGAGCGGAGGCGTGGCTGGCGATTTCCTAATCGGTACGGAGAGTGCGGAGGTTTACAACGACATTCACGACAATCCGACAGTGGCGCAGTTCTACTACTCGGCCATCCGCCATCGCGGCTATGTCGCCGATCAGCAGCTCATCCGCTACGGTGCGAACGGCCGGCCGGGACAGGTTCTGGGCGGGGCCAGTTCTCGGTCAGCGCGACGAAATCCCGACGCACTAGCGTTCCCCAACCGGGTTGCCGGGAATGGAGGCCCAACCTCTCAAAGGCCGAGCCCGCCGTTTCTCTTCGAGAAGTTCTTCGACACCGACCTCGGCGTCGAGATCACCTGGACGGGCTCGGCGTGGGTGGATGCCCTGGGGAACGCGGTGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
98b2d99d9b7c5a59665d792c28427071dae2021b8189672b2b9ced9bd2ce9e5c
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5591
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Insight into the virome of Paracoccus spp. (Alphaproteobacteria) Decewicz,P., Dziewit,L., Golec,P., Kozlowska,P., Bartosik,D. and Radlinska,M. 2019-05-27 — GenBank