Genbank accession
QZA71087.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,84
TF
Evidence RBPdetect2
Probability 0,95
Protein sequence
MAENTPLPISGLDPAVALGGDELIPAVQGGKTVKVLVSALKGQKGDQGDQGGQGVKGDTGAKGDKGDKGDKGDTGTAGTNGNDGASITAKGNIDLITNLPTTSTKGDAYFVQEDGHLYVSNGTAFVDQGKIRGENGAKGDKGDKGDTGAKGDTGAKGTDGTNGTNGADGADGIGLNPKGEVAADTDLPTTGNELGDTYIVNGSDLYVWAVDKTGGNATPAWKKLGTVKGAKGDKGDKGDKGDTGAKGDTGAAGAKGDAGAKGDKGDIGNTGPAGLGITVISGLDDESQLPDPADYSKGDTFIIKGHYWTLYEGAFSDMGNMTGPEGKSIYDLWLEDGNEGTLQEFFDSQKGADGIGLQIRGSFGSTNDLPTSGQINGDAYIINQQMYVWDGTQWSVVGQVGPKGDKGDTGAKGDTGAKGDKGDQGATGAKGDTGAKGDKGDKGDQGDQGDMGAGVVILGKLDSTDDLPTTGELGQGYLINGSFWGWTGSAYEDLGVIQGPKGDQGVKGDTGAKGDTGDKGDQGASISPRGTVADEADLASVATPVAGWLYNVTGGTSAGHQFIYNGTTWIDQGDARGVKGDTGAKGDTGAKGDTGAKGDKGDAGAAGAKGDAGAKGDKGDKGDTGAGLEVKGTAADVGSLPSDAVQGDVYLVPVNGDNHFVIRNNGTWEDVGPLRGAKGDTGAKGDTGTKGDTGTKGDKGDTGAGVKAKGTVADQASLPSTGNAAGDMYYVAGHTFIYSGSAWVDMGSNVGPKGDTGAKGDTGATGAKGDTGLTGAKGDQGIQGLTGATGADGNSVVIRGHVDAVGNLPTTGNVKGSVYTVTDDMIIYSWDGTQWVAAGSIRGQQGDVGPAGAKGDIGAGIKILGKKDTEGDLPATGNTAGDGYMIGTNFYAWDGAEWVNVGPIQGPKGDTGARGLTGAKGDQGDKGNKGDKGDAGTKWIVFARDPNSADGVVGDYFLNSSSQAFYQKTSTTTWSQLGTLGGGNVFDANFDGKAKVRKDGQWIDLVIVFDKYDLAVLDVTGTTLDISKNNCFRFSGTTDKSITFSGMPTSARAEPIVLIVTGKGANFTWGNTILWSRGESVALGDNLTIITLLWTGTQFIGQVSMSA
Physico‐chemical
properties
protein length:1107 AA
molecular weight: 111148,70590 Da
isoelectric point:4,55675
aromaticity:0,06323
hydropathy:-0,51599

Domains

Domains [InterPro]
IPR008160
STR
398–452
DC_1340
STR
422–515
QZA71087.1
1 1107
Architecture
STR
RBD
STR 10-794 | RBD 795-1107
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Erwinia phage AH06
[NCBI]
2869570 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QZA71087.1 [NCBI]
Genbank nucleotide accession
MZ501268.1 [NCBI]
CDS location
range 256740 -> 260063
strand -
CDS
ATGGCCGAAAATACTCCACTTCCTATTAGCGGTCTCGATCCAGCAGTAGCGTTGGGCGGTGACGAGCTAATCCCTGCAGTCCAGGGTGGGAAAACGGTTAAAGTCCTTGTCAGTGCTCTGAAAGGCCAGAAGGGTGATCAGGGCGATCAAGGTGGCCAGGGCGTTAAAGGCGATACTGGCGCCAAAGGCGACAAGGGAGACAAAGGAGATAAGGGCGATACCGGAACTGCCGGCACGAACGGTAACGACGGTGCGAGTATTACTGCAAAAGGTAATATCGACCTTATCACTAATCTTCCTACCACTTCCACTAAAGGTGATGCGTACTTCGTTCAGGAAGATGGCCACCTGTATGTGTCTAACGGCACAGCCTTTGTTGACCAAGGTAAGATCCGTGGTGAGAACGGAGCCAAGGGCGACAAAGGGGATAAAGGTGATACAGGTGCCAAGGGCGACACTGGAGCAAAAGGTACCGACGGTACTAACGGCACCAATGGCGCTGATGGTGCCGATGGCATTGGTCTTAACCCGAAAGGCGAAGTTGCTGCTGACACCGACCTCCCAACTACCGGTAATGAGTTAGGCGATACTTATATCGTTAACGGTAGCGACCTGTATGTTTGGGCGGTAGATAAGACTGGCGGTAACGCCACCCCGGCCTGGAAGAAACTCGGTACTGTAAAAGGTGCTAAGGGAGACAAAGGCGATAAGGGTGATAAAGGTGACACCGGAGCGAAAGGTGATACCGGTGCCGCTGGCGCCAAGGGTGATGCCGGTGCAAAGGGTGACAAGGGCGATATTGGTAACACCGGTCCTGCGGGTCTGGGTATCACAGTTATCTCTGGTCTGGATGATGAATCCCAACTCCCTGATCCGGCTGACTACAGCAAAGGCGACACGTTCATTATCAAAGGCCACTACTGGACTCTGTATGAAGGTGCGTTCAGCGACATGGGTAACATGACCGGCCCTGAAGGTAAGTCAATCTACGACCTGTGGTTAGAAGACGGTAACGAAGGTACCCTGCAAGAGTTCTTTGACTCGCAGAAAGGTGCTGACGGTATTGGTCTGCAGATCCGTGGCTCCTTCGGTTCTACTAACGACCTGCCAACATCTGGCCAGATCAATGGTGATGCGTACATCATCAATCAGCAGATGTATGTGTGGGACGGCACACAGTGGTCAGTCGTTGGTCAGGTTGGTCCGAAGGGTGACAAGGGCGATACCGGAGCCAAGGGCGACACAGGTGCTAAAGGTGATAAGGGCGACCAAGGCGCTACTGGCGCTAAAGGTGACACCGGAGCCAAGGGCGACAAAGGTGACAAAGGCGATCAGGGTGACCAAGGTGATATGGGCGCCGGTGTAGTTATTTTAGGCAAACTCGACTCAACTGATGATCTGCCTACCACTGGTGAACTGGGTCAAGGCTATCTGATCAACGGTAGCTTCTGGGGCTGGACAGGTTCTGCCTACGAAGACCTTGGTGTTATCCAGGGACCTAAAGGCGACCAAGGTGTCAAAGGCGACACTGGAGCCAAGGGCGACACCGGTGATAAAGGTGATCAAGGCGCAAGCATCAGTCCTCGCGGTACTGTAGCCGACGAAGCTGATCTGGCATCTGTTGCTACTCCGGTTGCTGGCTGGCTGTACAACGTCACTGGCGGTACCTCTGCCGGTCATCAGTTCATCTACAACGGTACAACCTGGATCGATCAGGGTGATGCCCGTGGTGTGAAAGGTGATACTGGCGCCAAAGGTGATACCGGTGCGAAGGGTGACACAGGCGCTAAAGGCGACAAAGGTGATGCTGGAGCTGCGGGAGCTAAAGGCGACGCCGGTGCTAAGGGAGACAAAGGCGATAAGGGTGATACTGGTGCTGGTCTGGAAGTCAAAGGCACGGCGGCTGATGTCGGTTCTCTGCCAAGTGATGCTGTACAAGGTGATGTATACCTGGTACCAGTTAATGGGGATAACCACTTTGTCATTCGCAACAACGGCACCTGGGAAGATGTAGGTCCATTGCGTGGTGCTAAAGGTGACACGGGTGCGAAGGGTGATACCGGTACCAAAGGTGACACCGGAACCAAGGGCGATAAAGGCGATACCGGTGCTGGCGTAAAAGCTAAAGGCACGGTAGCAGATCAGGCTTCACTTCCATCAACAGGCAACGCTGCCGGCGACATGTATTACGTTGCAGGCCATACCTTTATCTACAGCGGATCAGCTTGGGTCGACATGGGTTCTAACGTCGGTCCGAAGGGTGATACCGGAGCTAAAGGCGACACAGGTGCTACGGGTGCCAAAGGTGATACTGGCTTAACCGGTGCTAAAGGTGACCAAGGTATTCAGGGTCTGACTGGTGCAACCGGTGCTGATGGCAACTCTGTTGTTATTCGTGGTCATGTTGATGCGGTGGGTAACTTACCTACTACCGGCAACGTGAAAGGCAGTGTCTACACTGTGACCGATGACATGATCATCTACTCCTGGGATGGTACTCAGTGGGTCGCCGCGGGTTCTATCCGTGGTCAGCAAGGTGACGTTGGCCCTGCGGGTGCCAAAGGTGACATCGGTGCAGGTATCAAGATCCTCGGTAAGAAAGATACCGAAGGTGATCTGCCTGCTACTGGTAACACCGCAGGTGATGGCTACATGATCGGGACTAACTTCTACGCTTGGGATGGTGCTGAGTGGGTGAACGTTGGTCCTATCCAGGGTCCGAAAGGGGACACTGGTGCACGTGGTCTGACTGGTGCTAAAGGCGACCAGGGCGATAAGGGTAACAAAGGTGATAAAGGTGATGCCGGTACCAAGTGGATCGTCTTTGCCCGTGACCCGAACTCTGCCGATGGTGTGGTAGGCGATTACTTCCTGAACTCCTCTAGCCAGGCGTTCTACCAGAAAACCTCTACGACTACATGGTCGCAGCTGGGTACCCTGGGTGGCGGTAACGTCTTCGATGCTAACTTCGACGGTAAAGCGAAAGTTCGTAAAGATGGCCAGTGGATCGATCTGGTCATTGTCTTTGACAAATACGACCTGGCTGTTCTGGATGTGACAGGCACCACGCTTGACATCTCTAAGAACAACTGCTTCCGCTTCAGCGGCACCACTGATAAGTCTATCACCTTCAGTGGCATGCCTACGTCTGCGCGTGCAGAACCGATCGTCTTGATCGTTACTGGTAAAGGTGCGAACTTCACCTGGGGTAACACCATCCTGTGGTCACGTGGTGAATCTGTGGCACTGGGTGATAACCTCACCATCATTACCCTGCTGTGGACTGGTACTCAGTTCATCGGTCAGGTGTCAATGTCTGCCTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
432742fe64221984f74e82e74864390dab447ccb920ea564efa422c0524b0bfe
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7069
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50