Genbank accession
YP_009593496.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,78
TF
Evidence RBPdetect2
Probability 0,89
Protein sequence
MPVVGAAITTSFAAETSTAVGSFIINTVASMALSAVSQALRGKPRQAGIRSDVTLAGEETPGSLVFGKYATGGFMATAPMTRGSAGGMPNGFLTFVIELADMPIGGLDGIWIGDEKAEILPPVAGSLYPDHNALGGRFSGKAWFRFFNGRTTAYAGLTDHTDQPRPWQEDMIGRGLPFVVMRFRYDREVFQGLPQCLFEVTGIPLYDPRKDSTVGGSGAHRWGQLDTYEPSENPGVQVYNILRGIYYNGAHIWGGRASADDLPLNNWVAAMNACDQLVDGQPRWRASFEAKIGPEHFGGDEPAAVIEEILRGCSGSLAEFGGVYRIRIGGVGMPVMAFTDEDIIISQGQSFEPFRGLDQVYNTVQAQYPEPVAKWASKEAPRRQNAGFLAEDGDAYVASLNLPATPYPAQVQRVMRAYMMDGRRQRQHNITLPPEFAAVEVLDAVAWTSPRNGYINKVFEVTARDDNPRTLLQGFGLRERDPNDYNWTPDMALPSSAASPTTPEPAPRVVLGFDVSGVAIRDANGVQRRPAIRMTWNGDQPDARAIRFQIRPQGQTELAAEGSVHAIADGELIVSEGILANTTYQVRARLVTTRATLWTGWLSVTTPDIRLTPLDLRMDEIAAEVIADAEALEIWIKGDDPVLIGLREDVDAARADVGAARDDIAAEAARLEALAMTNLNVAKAYTDTGLVNESAARVSGDQALAAQIQTLTAALTSDNLLDNPLFGSGLDGWTASGFVTAQDRDPASSNPIFANAPTPRFVQVVPPSSGTRMLRQQFPVEFAANEVIQWRVKAGTRASGRTATVRVNWYNDTGTQIGGNVDTTLTLVVDEWRTFSGQHTPPSGAVEMRWQLVVPSGTSDPTFFADTAVTKVDQSTIARITSLEVAVANNEAAATLFRNTAESRLDANEAAITTEATTRATQDAALSSQINTVSAVANRARTFWQPTAPNNPQIGDIWYDSENNRRPRRWGGTQWNFVDDTRIAQNASAIATESIARADADSALASQINTARTFWQPTAPNNPQIGDIWYDSENNRRPRRWGGTQWNFVDDTRIAQNASAITNESHRARERR
Physico‐chemical
properties
protein length:1072 AA
molecular weight: 116539,65530 Da
isoelectric point:5,02402
aromaticity:0,08302
hydropathy:-0,31334

Domains

Domains [InterPro]
DC_0187
STR
1–1068
G3DSA:2.60.120.260
STR
716–872
YP_009593496.1
1 1072
Architecture
STR
STR 1-1068 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Paracoccus phage Shpa
[NCBI]
1647282 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_009593496.1 [NCBI]
Genbank nucleotide accession
NC_041868.1 [NCBI]
CDS location
range 12822 -> 16040
strand +
CDS
ATGCCTGTTGTCGGCGCAGCTATTACGACCAGCTTTGCCGCTGAGACCAGCACGGCAGTCGGATCGTTCATCATCAACACCGTCGCCAGCATGGCGCTGTCGGCTGTGTCGCAGGCGCTGCGGGGCAAGCCGCGTCAGGCGGGCATTCGATCCGACGTGACGCTGGCCGGAGAGGAAACCCCCGGTTCGCTGGTCTTCGGGAAATACGCCACTGGCGGCTTCATGGCGACTGCGCCCATGACGCGCGGATCGGCGGGCGGAATGCCCAACGGTTTCCTCACCTTCGTGATTGAACTGGCGGATATGCCCATCGGCGGGCTGGATGGCATCTGGATCGGTGACGAGAAGGCCGAGATCCTGCCGCCGGTCGCTGGCAGCCTGTATCCCGATCACAACGCCCTGGGCGGGCGGTTCAGCGGCAAGGCGTGGTTCAGGTTCTTCAATGGGCGCACGACCGCTTATGCCGGGCTGACGGACCACACCGACCAGCCCCGCCCGTGGCAGGAGGACATGATCGGGCGCGGACTGCCCTTCGTCGTGATGCGGTTCCGCTATGACCGGGAGGTGTTCCAGGGCCTGCCGCAATGCCTTTTCGAGGTGACGGGCATCCCGCTTTATGACCCGCGTAAGGACAGCACGGTCGGCGGGTCCGGGGCGCATCGGTGGGGGCAGTTGGACACCTACGAGCCGAGCGAAAACCCCGGCGTGCAGGTCTATAATATCCTGCGCGGCATCTACTACAACGGCGCGCATATCTGGGGCGGTCGGGCATCGGCTGACGACCTGCCGCTGAACAACTGGGTCGCGGCGATGAACGCGTGCGACCAGTTAGTGGACGGACAGCCTCGGTGGCGGGCCAGCTTTGAGGCCAAGATCGGTCCGGAGCATTTCGGCGGCGATGAACCGGCGGCAGTGATCGAGGAAATCCTGCGCGGCTGTTCCGGTTCGCTGGCCGAGTTCGGCGGGGTCTACCGCATCCGCATCGGTGGCGTCGGGATGCCTGTCATGGCGTTCACCGACGAGGACATCATCATCAGCCAGGGTCAGTCGTTCGAGCCTTTCCGGGGTCTGGATCAGGTCTATAATACCGTGCAGGCGCAGTATCCCGAGCCTGTGGCGAAATGGGCCAGCAAGGAGGCCCCGCGCCGCCAGAACGCCGGGTTCCTGGCCGAGGATGGGGATGCCTATGTCGCCAGCCTGAACCTGCCCGCGACCCCCTATCCGGCGCAGGTGCAGCGGGTGATGCGCGCCTACATGATGGACGGGCGCCGCCAGCGGCAGCACAACATCACCTTGCCGCCCGAGTTCGCAGCGGTCGAGGTGCTGGACGCCGTGGCATGGACGAGCCCGCGCAACGGCTACATCAACAAAGTGTTCGAGGTCACGGCGCGGGACGATAACCCCCGCACGCTGCTGCAAGGCTTCGGCCTGCGTGAGCGCGACCCGAACGATTACAACTGGACGCCGGACATGGCGCTGCCGTCGAGCGCGGCCAGCCCGACGACGCCCGAGCCTGCGCCCCGCGTGGTCCTGGGTTTCGACGTGTCCGGGGTGGCGATCCGGGACGCGAACGGGGTTCAGCGGCGCCCGGCGATCCGCATGACGTGGAACGGCGACCAGCCTGACGCGCGGGCGATCCGGTTCCAGATCAGGCCGCAGGGGCAGACGGAACTGGCAGCGGAGGGTTCCGTTCACGCCATCGCGGACGGCGAATTGATCGTGTCCGAGGGCATCCTTGCCAATACGACCTATCAGGTCCGGGCGCGGCTGGTCACGACGCGGGCGACCCTCTGGACTGGCTGGCTGTCGGTCACGACCCCGGACATTCGCCTGACCCCGCTTGATCTTCGCATGGATGAAATCGCGGCTGAGGTCATCGCAGACGCCGAGGCGTTGGAAATCTGGATCAAAGGCGACGACCCGGTCCTGATCGGCCTGCGCGAGGACGTGGACGCCGCGCGGGCTGACGTGGGCGCGGCGCGCGATGACATTGCAGCCGAGGCAGCGCGCCTTGAGGCCTTGGCGATGACGAACCTCAACGTCGCCAAAGCCTACACCGACACGGGCCTCGTGAATGAGAGCGCGGCTCGGGTGTCTGGCGATCAGGCGCTTGCGGCTCAGATCCAGACGCTGACGGCTGCATTGACGAGCGACAACCTGCTGGACAACCCCTTGTTTGGCAGCGGCCTGGACGGCTGGACCGCGAGCGGCTTTGTCACGGCGCAGGATCGTGACCCTGCATCGTCCAACCCGATCTTTGCCAACGCGCCGACGCCGCGCTTTGTGCAAGTCGTTCCGCCGTCGAGCGGGACGCGGATGCTTCGCCAGCAGTTCCCGGTCGAGTTCGCGGCGAACGAGGTCATCCAGTGGCGCGTGAAGGCCGGGACGCGGGCCAGCGGGCGCACCGCGACAGTCCGCGTCAACTGGTATAACGACACCGGCACCCAGATCGGCGGGAACGTGGATACGACCTTGACGCTGGTCGTGGATGAATGGCGCACATTCTCGGGCCAGCACACGCCACCCTCTGGTGCTGTGGAAATGCGCTGGCAACTGGTCGTCCCGTCTGGCACGTCTGACCCGACGTTCTTCGCGGACACCGCTGTGACCAAGGTCGATCAATCCACCATTGCCCGGATCACCTCGCTTGAGGTGGCTGTAGCGAACAATGAGGCGGCGGCTACCCTGTTCCGCAACACGGCGGAGAGCCGCCTTGACGCCAACGAGGCAGCGATCACGACCGAGGCCACGACGCGGGCCACGCAGGACGCCGCGCTGTCGTCGCAGATCAATACCGTCTCGGCGGTGGCGAACAGGGCGCGGACCTTCTGGCAGCCGACTGCGCCTAACAACCCGCAGATTGGCGATATCTGGTATGACAGCGAGAACAACCGCCGCCCGAGGCGGTGGGGCGGCACCCAGTGGAATTTCGTCGATGACACGCGGATCGCTCAGAACGCATCCGCCATTGCGACCGAGAGCATCGCCCGCGCAGACGCCGATAGCGCGCTTGCCAGCCAGATCAATACGGCGCGGACCTTCTGGCAGCCGACTGCGCCTAACAACCCGCAGATTGGCGATATCTGGTATGACAGCGAGAACAACCGCCGCCCGAGGCGGTGGGGCGGCACCCAGTGGAATTTCGTCGATGACACGCGCATTGCCCAGAACGCATCCGCAATCACGAACGAGAGCCATCGCGCGCGCGAACGCCGATAG

Genome Context

Genome Context

Tertiary structure

PDB ID
7dbc5a97cab84572fa69e8316713c0678fdbb69ccec4b1e283c774baf63b2d34
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7921
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Isolation and characterization of bacteriophages from East Africa Rift Valley soda lakes van Zyl,L.J., Nemavhulani,S., Cowan,D.A. and Trindade,M.I. 2016-12 GenBank