Genbank accession
QZI87779.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,95
Protein sequence
MAVAMIGPKFYAWDRNGKPLAFGKLYTYQARTNTPKPTYQSEDQVVENTNPVILNGEGYANIYLDGSYKMVLKDSDDNEIWSSDPVTSNQANEWISCFVAEYVSPSAFKIAGNQTDTYKQGRKVRIDNNASEYDYAKILTSSYASGFTSVSVEPALVSTGINSVCASVVSPDSSFNKNDIGGLSSYEANNVNELILGLTIGGETIEHVEGQKWSTGGTHWKIVSTSGIPLDGGLLFAIPLNGIKVEDFGLLTSNDASDNTSAWDEMIQKIVQIKRSTVMFGGGDYLSDEMFAEDINITIKGDGRGSTRLINKGSGSVFKLIRSSGEFTKKLKLIGLSFGEDTTESVHTSSGSHAVHVDNYNDCQFEDVQINQAGGSGIYCTDIFVQSFENIQGGHCGNNSSMSPSDRGVIEYERVSTGNSIRISDSYISNSTLTNGVRINNAQSISILNTTLESCLDLISIGRLGNTSRNVTIDTCYFENPIVSCGNFISIFGLSLRNLYCNLVGPRSDVNWRNFRFEECDRVKLNNCSLNEPGDPSNPNYKAALEFVTGTSLSYKGQVVIEECSSMQTVCVDSTTAGRSAQNIIINRCGLDIVELRGLEKPHTNLLTNTDLTTWANTGALPIYTRDFYDGGVEYVISGDNSNTLNTSVSGTFNIGDDLVFSAYMSGKCRLRLRGRRVSDGGFEDIAIIDKIGSETGKNEGGDISRRAYANGVCLDNYDLINVQVRPTSGYDVGVAYVQVDRALTPTAIA
Physico‐chemical
properties
protein length:750 AA
molecular weight: 81493,63830 Da
isoelectric point:4,79252
aromaticity:0,08533
hydropathy:-0,27107

Domains

Domains [InterPro]
IPR011050
STR
240–522
IPR011050
STR
241–522
QZI87779.1
1 750
Architecture
STR
RBD
STR 240-522 | RBD 523-750
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QZI87779.1
1 750
Domain Start End Length (AA) Confidence
N-terminal 1 257 257 0,7664
Central domain 258 598 342 0,9871
C-terminal 599 750 151 0,9878
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-257
Central
258-598
C-terminal
599-750

Taxonomy

  Name Taxonomy ID Lineage
Phage Vibrio phage 41E34.2
[NCBI]
2859328 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Vibrio crassostreae
[NCBI]
246167 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Vibrionales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QZI87779.1 [NCBI]
Genbank nucleotide accession
MW824394.1 [NCBI]
CDS location
range 19727 -> 21979
strand +
CDS
ATGGCAGTCGCAATGATAGGTCCTAAGTTTTACGCTTGGGACCGCAACGGCAAACCTTTGGCCTTCGGTAAGCTTTACACTTATCAGGCTCGCACAAATACACCAAAACCAACATACCAATCTGAAGATCAGGTTGTTGAAAATACCAACCCTGTGATCTTGAATGGCGAGGGTTATGCCAATATTTACCTTGACGGATCCTACAAGATGGTTTTGAAGGATTCCGATGATAATGAGATATGGTCCTCTGACCCAGTAACATCAAACCAGGCTAACGAGTGGATATCTTGCTTTGTTGCCGAATACGTTAGTCCTTCAGCTTTTAAGATTGCCGGGAATCAAACGGACACATATAAACAAGGAAGAAAGGTAAGAATAGATAATAACGCCTCTGAATATGATTACGCGAAAATATTAACCTCTTCCTATGCCTCTGGATTTACAAGCGTTTCCGTTGAACCAGCCTTAGTATCAACTGGCATAAATTCAGTTTGTGCCTCTGTAGTGAGTCCAGACTCATCATTTAATAAAAATGACATTGGCGGCCTCTCTTCATATGAGGCAAATAACGTGAATGAACTTATATTAGGTTTGACAATAGGCGGAGAAACAATTGAACACGTCGAAGGGCAAAAATGGTCTACTGGAGGAACTCACTGGAAAATTGTTTCAACATCAGGAATACCTTTGGATGGTGGGTTATTATTTGCTATCCCGTTGAACGGTATAAAGGTTGAGGATTTTGGATTGTTAACATCAAATGACGCAAGTGATAACACTTCTGCGTGGGATGAAATGATACAAAAAATAGTTCAAATAAAACGTTCTACTGTAATGTTTGGTGGTGGTGATTATCTGTCAGACGAGATGTTTGCAGAAGATATAAACATAACTATTAAAGGTGATGGTAGAGGTTCAACAAGATTAATCAACAAAGGTAGTGGGTCTGTGTTTAAGCTTATTAGAAGCTCTGGCGAGTTTACTAAGAAGCTAAAACTTATCGGTCTATCTTTTGGAGAGGATACAACAGAGTCCGTTCATACATCTTCAGGATCTCATGCTGTTCATGTTGATAACTACAACGATTGTCAGTTTGAGGATGTTCAAATAAATCAAGCTGGCGGATCTGGGATATATTGCACAGATATATTTGTGCAATCATTTGAAAACATACAAGGTGGCCACTGTGGAAATAACTCATCAATGTCACCTTCAGATCGAGGTGTCATTGAATATGAAAGAGTTTCCACTGGTAATAGCATAAGAATATCAGATTCTTACATTTCAAATTCCACATTAACAAATGGAGTTAGAATAAATAACGCTCAAAGTATATCTATTCTAAATACAACTCTTGAAAGTTGTCTTGACTTGATTAGCATCGGTCGTCTTGGAAATACATCAAGAAATGTAACAATTGATACTTGTTACTTTGAAAACCCGATAGTTTCTTGTGGTAACTTTATTTCAATTTTTGGCCTATCTCTTAGAAATCTTTATTGCAACTTGGTTGGCCCAAGGTCTGATGTTAATTGGAGAAACTTTAGATTCGAAGAGTGCGACAGAGTAAAACTTAACAACTGCTCTCTTAATGAGCCAGGAGACCCGTCAAACCCTAATTACAAGGCGGCTTTAGAGTTCGTAACTGGAACAAGTTTGTCATATAAAGGTCAGGTTGTTATTGAAGAATGCTCAAGTATGCAAACTGTTTGTGTGGATAGTACAACTGCTGGTAGATCAGCTCAAAATATAATTATTAACCGATGCGGGTTAGATATAGTAGAGCTTAGAGGACTTGAAAAGCCTCACACTAACTTGCTAACAAACACAGATCTAACAACATGGGCTAACACTGGCGCATTGCCAATATACACAAGGGATTTTTATGACGGAGGTGTTGAATATGTAATTAGTGGTGATAACTCAAACACATTAAATACCTCTGTGTCTGGTACATTTAATATAGGTGACGACTTGGTGTTTAGTGCTTATATGTCAGGCAAGTGCAGATTGAGACTAAGAGGAAGAAGAGTTTCTGACGGAGGTTTTGAGGATATTGCAATAATTGATAAGATCGGTTCAGAAACTGGTAAAAATGAAGGTGGTGACATATCAAGAAGAGCATATGCAAATGGGGTTTGCTTAGATAATTACGACTTAATAAACGTACAGGTTAGACCAACAAGTGGTTATGATGTTGGCGTTGCATACGTTCAAGTTGATAGAGCGTTAACGCCAACAGCTATAGCTTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
cbc0a90386e4971c971251f95f6c7a0aa0dba2fb1e572bf36c6787b5a1faed24
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7963
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50