Genbank accession
QVW56392.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MAKKKNGVDDFNLDNLDLDWNDFDEPPRNKDKKRNPILETGRTIKRSALSAIWPEGKRDQVILKGMPDSATDAYKGYQDAKSVAKDVYAHTKDELVKTERVIKNQARQLGPTMKKYLPDAITRRVDKWARSDEIQGGRYDPEQAGLDRMMAEVFNGQGSGGDAPMTAQEQRDAQQQATEDRIRDGVKDMKSDAMLNAVLSIARDTNSTAALTRGVLLNVERKQLELQYRTLFALQDLSKLSQTQFDRNTPALEAIVKNTALPDYAKEDFSEVRWAHVRRQAADWMNPLRYAEGFMDSIRQKATKKISGAFSDGRGILETLMGMGVEDDFGMEDSSSLSPDARKKNGRDKATGWATKFLAKKLLGPLVEKGQAKSKAYLEENPQAMSAIERAKFLARGATDGSIANSAIAGEREGFLANMFRMGNTLGIVDPLKRENVFLDERNVENLNRSAKFDRKFYLTVVESLPALLSEINKSIRRGYGEHADVEYDMTTRGITSRRDLADRVRKGLADDRGRQKTQESINGVVDFIDQKKTLEPKERQQLADYIESRAATGKSMDVDAIIKDQSQLFRYMGGNTARKVVDALKHVAAGTAGENWGLSNELHDRISSVQVHYKRRQEAVDQAATIYGERILRDAGIFNYDKKNNVFGVDKDFTDPYTMFNDTRMGKTRSGRALTREQELQRKLQNGSATADYIRRKFGEEGGVEDTLSAGDPAKGLGGDKGRYGGGITARQMARVLYGETETNLVDLLGGQDRKNASGETDRLIEAIRATNVTTFVQDILKHVKNMDEQGVLLASLEGGGPDGAGTGGGDGDGPTPRGGGPRRRRIVLGESGLLRRWGGILFDTASGGFNLAKRGVMGAKDRLGKFGSWAKSKFSAGDGPGIFSKLKGLATGGISGAFGSAVEFGKGLLGVRDVYDERGKVVLQGKRLEAGEYWQLSEDGNHLHNPKTLDEIKLGMDILDNAGNVILSAADLAAAGKLSYYKGGKLQSLFKAMSHKSGNLIRNAIGAPKRLLDRMAPSVKSVKEWFTTTPDIYVKGETVPRMTAMLMRQGKYLLKATKTPVFKAKDITGPIIDEAGNDIITAEEMQNPDFKLVDKWGREVKSPLQRIIGRVGGLLSRGKNLIMGIPDMLRKGMGKLKHLATNNPIANWFKGKGGGDFFSNNSLFGGLNTTGKKTNHILIRIYKLLNRRMPGEPEDEGWTEEMEKGIGGGKGVKDALKSAQRFGRGVKARMNRRWGRRFRNGRASVSDWFRGKRDGIMGWAGGVRDRFNNFSDSMRESEHDIGTRYEVERRLAGRDDETADFYRSRLHRKGKFSRNKFKDAIHDDIASAGEAGAEALNAAKGKAQSIGSKLLDRMNRMVNLQEINWFNTMRSSLEENGAQEGFIRGMYAKFSRRMKFKEGGEKRDYLQWFRRKRTDHEGATASGGGRSGGKVKGIMDLFKSIPIIGPLVSILGTVASVMGTIAKWGIMKPAKLLGQGAWWLAKGGARMLGGAAMRGLIMPVATAAGAVVTAVGWPVILGVAAVAGLTWAAFKIATTTYTEYLDTLRLAQYGFQDYDKWSSDDGAKARYLEKQLKQYVSFNETGQATCRGLGAREVQELAVGFGVAEDDKSGMLAFQAMMLQRFIPIYLRWLSALYSQERDIQLADVGNANKVSKDEMKSIFNKVQLTKDAPHLRALTDPRNVDRSLWQKFKDAVTFTSPDLLDADDVMDIQEDVLRGINRRMEDKKNRKFNKGAMEARGIEESGVKEAFTALAANDKETRENAPRPNGWEDGTEQIQIQVDNFAVLNQKDVDALESIRFKTYGLKELDPAIVGQLKMLERFVLPNIDIKNATYKGKWTEAMDVIEPQGWKDPHRADKLRLWFTSRFLPTFMFYVCGYHRFVPTGDPLNLKLTGGYLFELGLLVSRAYNMKADVRQSVWEVAINPFGQDPNMDPSSVSKELETLKVLSKEADLAVRNLLNDKKPMGKRAKWADKNTNTSFYQSKDEGESTSFTAEDHKAAKAAGAFGGGTFTGTPTDINQAVDAMGGARNYAAFSTGSVGIKLGDVEPGSYKQLAEKYPINSLNSEARIKQMISDVAKSMGVPPSVALGMAYAESKFNYKAKNPYASAAGLFQFINSTWDSQLGQYGRQFGIPGQLMASAGGQFDPHANTILGVQFIRDNIMKAQKDLGGKAPPPAVAYLYHFLGPGGGRQFMQAWAKNPNAPATAAPPVTQKVLAGNKSVFYTKQGRLRTLDEVIRELNGRMGSVTANEVESDPSKTKQAISGLSPDAPSSSSPAAAAGAAANDPSMSGTAAGGGQNLPADNENRRDGALETKGAMAADSAVASMSSGPAMPGGTASSSSDMSNVADEVAKQAAADGLSPKDVEKVKSGAAQRTGQANATPVSVASDVSPSAGGFSNATVADQQLQVTKDIKQILEDMRKLMQNGAPMGPSGSTSPAPAKASQTYTQPAPSLNVSRKTG
Physico‐chemical
properties
protein length:2460 AA
molecular weight: 269108,69260 Da
isoelectric point:9,45862
aromaticity:0,07398
hydropathy:-0,54858

Domains

Domains [InterPro]
DC_0337
STR
1–2131
IPR008258
ENZ
2073–2166
QVW56392.1
1 2460
Architecture
STR
ENZ
RBD
STR 1-2131 | ENZ 2132-2166 | RBD 2247-2460
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Erwinia phage pEa_SNUABM_6
[NCBI]
2835896 No lineage information
Host Erwinia amylovora
[NCBI]
552 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QVW56392.1 [NCBI]
Genbank nucleotide accession
MW812343.1 [NCBI]
CDS location
range 203984 -> 211366
strand -
CDS
ATGGCAAAAAAGAAAAATGGTGTCGATGATTTTAATCTCGACAACCTTGATCTTGATTGGAATGACTTTGACGAGCCGCCTCGGAACAAAGACAAAAAACGTAACCCAATCTTGGAGACCGGTCGCACGATTAAGCGTTCCGCGCTGTCAGCAATTTGGCCAGAAGGCAAACGCGACCAGGTCATTTTAAAAGGTATGCCCGATTCTGCTACCGATGCGTACAAAGGCTATCAGGACGCCAAATCGGTCGCAAAAGATGTTTACGCTCATACCAAAGACGAGCTGGTCAAGACTGAGCGTGTAATTAAGAACCAAGCCCGTCAACTTGGCCCAACAATGAAGAAATATTTACCCGATGCGATTACGCGTCGTGTAGATAAATGGGCACGCAGTGACGAGATTCAGGGTGGACGTTATGACCCTGAGCAGGCTGGTTTAGACCGCATGATGGCGGAGGTCTTTAACGGTCAGGGTAGTGGCGGCGACGCCCCGATGACCGCGCAAGAGCAACGCGATGCACAACAGCAAGCCACCGAAGATCGTATTCGTGATGGCGTGAAGGACATGAAGTCCGATGCGATGCTCAACGCTGTACTGAGCATTGCCCGTGACACCAACTCTACCGCTGCCTTAACACGCGGTGTGTTGTTGAACGTTGAACGTAAACAGCTTGAGCTGCAATACCGCACACTGTTTGCACTGCAAGATTTATCCAAACTGAGCCAGACCCAGTTTGACCGTAATACCCCGGCACTCGAAGCGATTGTCAAAAACACCGCACTGCCTGACTACGCCAAAGAGGACTTCTCTGAGGTACGTTGGGCACACGTACGCCGTCAAGCGGCAGACTGGATGAACCCCCTGCGTTATGCCGAAGGGTTCATGGATAGCATTCGTCAGAAAGCGACGAAGAAAATCTCCGGTGCCTTCTCGGATGGTCGTGGGATTCTTGAAACGTTAATGGGGATGGGTGTCGAAGATGACTTCGGCATGGAAGACAGCTCATCACTGTCCCCTGACGCTCGTAAGAAAAACGGCAGGGACAAAGCAACAGGTTGGGCAACCAAGTTCCTGGCTAAAAAGCTGCTGGGGCCGTTGGTTGAGAAAGGGCAGGCGAAATCTAAAGCGTATCTGGAAGAGAACCCACAGGCAATGTCCGCGATTGAGCGGGCGAAGTTCCTTGCCCGTGGTGCGACAGATGGTTCGATAGCCAACTCCGCCATCGCTGGAGAGCGCGAAGGATTTCTGGCGAATATGTTCCGCATGGGGAACACGCTGGGCATCGTTGACCCACTCAAACGAGAAAACGTCTTCCTCGACGAACGTAACGTTGAGAACCTAAACCGTTCAGCGAAATTCGACCGCAAGTTCTATCTGACTGTTGTCGAATCCTTACCGGCATTACTGTCCGAAATCAACAAATCGATTCGTCGTGGCTACGGCGAGCACGCTGATGTTGAATACGACATGACCACGCGCGGTATCACCAGTCGTCGTGACTTGGCTGACCGTGTCCGTAAAGGTCTGGCAGATGACAGAGGTCGTCAGAAAACCCAAGAGTCTATCAACGGGGTTGTGGACTTCATTGACCAGAAGAAAACGCTCGAACCAAAAGAGCGCCAACAACTGGCTGATTACATCGAGTCGCGTGCAGCGACCGGTAAGTCCATGGATGTGGATGCCATCATCAAAGACCAGTCTCAGCTGTTCCGCTACATGGGGGGAAACACCGCCCGTAAGGTGGTGGATGCACTGAAACATGTTGCTGCGGGTACAGCGGGTGAAAACTGGGGCCTGTCGAATGAACTGCACGATCGTATCTCTTCGGTGCAGGTGCATTACAAACGTCGTCAGGAAGCGGTAGACCAAGCAGCGACTATCTACGGGGAACGTATCCTGCGTGATGCCGGTATCTTTAACTACGACAAGAAGAACAATGTCTTTGGCGTGGATAAAGACTTCACCGACCCGTACACCATGTTCAATGACACACGGATGGGGAAAACCCGTTCCGGTCGTGCCCTCACCCGTGAACAGGAGTTGCAACGCAAACTCCAGAACGGTTCCGCAACCGCCGATTATATTCGTCGGAAGTTTGGTGAAGAGGGCGGTGTTGAAGACACCTTATCTGCCGGTGATCCGGCGAAAGGGTTGGGTGGTGATAAGGGTCGTTATGGTGGTGGAATCACAGCCCGTCAGATGGCGCGTGTGCTCTACGGAGAGACCGAGACGAACTTAGTCGACCTGTTAGGTGGCCAAGACCGTAAAAACGCGTCAGGAGAGACTGACAGGCTTATAGAGGCTATCCGCGCAACGAACGTAACCACTTTCGTACAAGACATCCTCAAACATGTCAAAAACATGGATGAACAGGGTGTTCTGTTAGCATCACTTGAAGGTGGTGGCCCCGACGGTGCCGGTACAGGCGGTGGTGACGGCGATGGCCCTACCCCACGCGGCGGTGGACCTCGCCGCCGTCGTATCGTGTTGGGTGAATCCGGCCTGTTACGCCGTTGGGGTGGAATTCTGTTCGACACGGCTTCCGGTGGTTTCAATCTGGCCAAACGTGGTGTCATGGGTGCCAAAGACCGTTTAGGTAAGTTCGGCAGTTGGGCGAAAAGCAAGTTCTCCGCGGGCGACGGTCCGGGAATTTTCTCCAAACTCAAAGGGCTGGCGACCGGCGGTATTTCAGGTGCCTTTGGTTCCGCGGTAGAGTTCGGGAAGGGTTTGCTCGGCGTCCGGGATGTTTACGACGAACGTGGCAAGGTGGTGTTGCAAGGCAAGCGTTTAGAAGCTGGTGAATACTGGCAGTTAAGCGAAGACGGCAACCACTTACACAACCCGAAAACGCTGGACGAGATTAAGTTGGGGATGGATATCCTTGACAACGCCGGTAACGTGATTCTCTCTGCGGCGGATTTAGCAGCAGCGGGTAAACTCAGTTACTACAAAGGCGGGAAACTCCAGTCGTTGTTCAAAGCCATGTCCCACAAATCGGGTAATCTCATCCGTAATGCGATTGGTGCACCGAAGCGTCTACTTGATCGCATGGCCCCTAGCGTGAAGTCGGTTAAAGAATGGTTCACCACAACGCCTGACATTTACGTGAAGGGGGAAACGGTTCCACGCATGACTGCCATGCTGATGCGTCAAGGGAAATACCTGCTGAAAGCGACAAAGACCCCGGTATTCAAAGCGAAGGATATCACAGGGCCAATTATCGACGAAGCTGGTAATGACATCATCACGGCGGAAGAGATGCAGAATCCCGACTTCAAACTGGTGGACAAATGGGGACGTGAAGTTAAATCACCACTCCAACGTATCATCGGCCGTGTGGGCGGGCTGCTGTCGCGTGGTAAGAACCTTATCATGGGTATCCCCGATATGCTTCGTAAGGGCATGGGGAAACTGAAACATCTGGCGACGAACAACCCTATCGCCAATTGGTTTAAAGGGAAAGGGGGAGGAGACTTCTTCAGCAACAATTCCCTGTTCGGTGGCTTGAACACCACTGGCAAGAAAACCAACCATATCCTTATCCGTATCTACAAACTCTTGAACCGCCGTATGCCGGGGGAGCCAGAGGATGAAGGTTGGACTGAGGAAATGGAAAAAGGAATTGGGGGCGGTAAGGGTGTGAAAGATGCACTCAAATCCGCACAACGTTTCGGTCGGGGTGTCAAAGCCCGTATGAACCGTCGCTGGGGTCGCCGGTTCCGCAATGGTCGTGCGTCTGTTTCCGATTGGTTCCGGGGCAAACGCGATGGTATCATGGGGTGGGCTGGCGGGGTTCGTGACCGCTTTAATAATTTCAGCGATTCCATGCGTGAATCTGAACACGACATCGGTACCCGGTACGAAGTGGAACGTCGCTTAGCGGGACGTGATGACGAGACGGCTGATTTCTACCGCAGTCGTTTACACCGCAAAGGCAAGTTCAGCCGGAACAAGTTCAAAGATGCGATCCACGACGATATCGCCTCCGCCGGTGAGGCGGGTGCAGAAGCGCTGAATGCGGCCAAAGGCAAAGCCCAGTCTATCGGGTCGAAACTCTTAGACCGCATGAACCGAATGGTGAACCTGCAAGAAATTAACTGGTTCAACACCATGCGCTCGTCGTTAGAAGAGAACGGTGCCCAAGAAGGGTTTATCCGCGGCATGTACGCCAAGTTCTCTCGTCGCATGAAGTTCAAAGAGGGGGGTGAGAAACGCGACTACCTCCAATGGTTCCGTCGTAAGCGCACTGACCATGAAGGGGCTACTGCCTCAGGTGGCGGACGTTCAGGCGGGAAAGTGAAAGGGATTATGGATCTGTTCAAATCCATCCCGATCATCGGGCCGTTGGTCAGCATTCTGGGCACGGTAGCGTCGGTAATGGGCACCATTGCAAAATGGGGTATCATGAAACCAGCGAAACTGTTAGGTCAGGGTGCATGGTGGTTAGCGAAGGGTGGTGCACGTATGTTGGGCGGGGCTGCGATGCGTGGACTCATCATGCCGGTTGCGACAGCAGCAGGCGCGGTGGTGACTGCGGTCGGTTGGCCGGTGATTCTGGGTGTGGCAGCGGTGGCGGGGCTGACATGGGCGGCGTTTAAGATTGCCACCACAACCTACACCGAATACCTCGACACGTTACGTCTGGCGCAGTACGGTTTCCAAGACTACGATAAGTGGTCATCGGATGACGGTGCGAAAGCCCGCTACCTTGAGAAGCAGTTGAAGCAATACGTGAGCTTCAATGAAACGGGACAAGCCACTTGTCGCGGTTTAGGCGCGAGAGAGGTGCAGGAGTTAGCCGTTGGGTTCGGTGTGGCCGAGGACGACAAGTCCGGTATGCTCGCATTCCAAGCGATGATGCTCCAGCGCTTCATTCCGATTTATCTGCGTTGGTTGTCTGCGCTCTACAGTCAGGAGCGTGATATCCAATTAGCGGATGTCGGTAACGCAAACAAAGTCAGCAAAGACGAGATGAAGTCTATCTTCAACAAAGTTCAGCTCACCAAAGATGCCCCACATCTGCGTGCGCTGACTGACCCTCGTAATGTCGACCGGAGTTTGTGGCAGAAGTTCAAGGATGCGGTGACCTTTACCTCACCTGACTTACTCGATGCTGATGACGTCATGGACATTCAGGAAGATGTCCTGCGCGGCATTAACCGCCGTATGGAAGACAAGAAGAACAGGAAGTTCAACAAAGGCGCAATGGAAGCCCGTGGTATTGAAGAGTCTGGTGTGAAGGAAGCCTTTACCGCACTGGCCGCCAACGACAAAGAAACCCGTGAGAACGCCCCACGTCCAAACGGGTGGGAAGATGGTACGGAGCAGATTCAGATTCAGGTCGATAACTTTGCGGTCTTGAATCAGAAAGATGTGGATGCCCTCGAATCGATTCGTTTCAAAACGTACGGTTTGAAAGAGCTTGACCCGGCAATCGTCGGCCAGCTGAAAATGCTGGAACGGTTTGTGTTGCCAAACATCGACATCAAAAATGCGACGTATAAAGGTAAATGGACTGAGGCGATGGATGTCATCGAACCTCAAGGTTGGAAAGACCCACACCGTGCAGACAAACTGCGCCTGTGGTTCACCAGTCGTTTCCTGCCGACCTTCATGTTCTACGTATGTGGCTATCACCGCTTCGTCCCGACGGGCGATCCGCTGAACCTGAAACTGACGGGCGGTTATCTGTTTGAGTTGGGTCTGTTAGTCAGCCGCGCTTACAACATGAAAGCCGATGTCCGTCAGTCTGTCTGGGAAGTGGCCATCAACCCGTTCGGTCAAGACCCTAACATGGACCCTAGTTCGGTTTCGAAAGAACTGGAAACCTTGAAGGTGCTCTCGAAAGAAGCGGACCTTGCGGTGCGTAATTTACTCAACGACAAAAAGCCGATGGGTAAACGCGCGAAATGGGCAGACAAAAACACCAACACCAGCTTCTACCAATCCAAGGATGAAGGTGAGTCAACGTCGTTTACGGCGGAAGACCACAAGGCCGCAAAAGCAGCCGGTGCATTCGGCGGGGGAACCTTCACGGGAACACCGACCGATATTAACCAAGCTGTAGATGCGATGGGGGGTGCGAGAAACTATGCTGCGTTCTCCACAGGGAGTGTCGGGATTAAACTCGGCGATGTGGAACCGGGTAGTTATAAACAGTTGGCAGAGAAATACCCCATCAATTCACTGAACAGTGAAGCGCGCATCAAGCAGATGATTTCTGATGTCGCCAAATCGATGGGTGTGCCACCAAGTGTGGCATTGGGGATGGCGTACGCCGAGTCGAAGTTTAACTACAAGGCGAAAAACCCGTATGCTTCTGCCGCTGGTCTCTTCCAGTTCATCAACTCCACATGGGATTCCCAGTTGGGGCAGTATGGACGACAATTTGGTATACCTGGCCAGTTAATGGCCAGTGCCGGGGGGCAATTCGACCCACACGCTAACACCATTCTGGGCGTTCAGTTCATTCGTGATAACATCATGAAAGCGCAGAAGGACTTGGGTGGGAAGGCACCACCGCCTGCGGTGGCCTACCTTTACCACTTCTTAGGTCCAGGTGGAGGTCGTCAGTTCATGCAAGCATGGGCGAAGAACCCGAATGCACCAGCTACCGCCGCACCGCCTGTAACGCAGAAAGTGTTGGCCGGTAACAAGAGTGTGTTTTATACCAAACAAGGAAGACTTCGCACACTGGATGAGGTCATTCGTGAACTGAATGGCCGTATGGGGTCAGTGACCGCAAACGAGGTGGAGAGTGATCCATCGAAGACAAAACAAGCTATCAGTGGATTGTCTCCTGATGCACCATCTTCATCAAGCCCTGCGGCTGCTGCGGGAGCTGCTGCAAACGATCCATCCATGTCGGGTACCGCAGCGGGAGGTGGTCAAAACCTGCCTGCCGATAACGAGAACCGTCGTGATGGGGCCTTGGAGACGAAAGGGGCAATGGCTGCGGACAGCGCCGTCGCCTCCATGTCAAGCGGGCCTGCTATGCCGGGAGGTACAGCGTCGAGCAGTTCCGATATGTCAAACGTTGCCGACGAGGTAGCGAAGCAAGCTGCCGCCGATGGACTTTCGCCGAAGGATGTGGAGAAAGTGAAATCGGGTGCCGCACAACGGACAGGACAAGCCAATGCGACTCCTGTGTCGGTCGCGTCGGATGTTTCACCATCCGCTGGCGGTTTCTCTAACGCCACGGTTGCGGATCAGCAACTGCAAGTCACGAAAGACATCAAACAGATTCTGGAAGACATGCGGAAACTGATGCAGAACGGGGCACCGATGGGGCCATCTGGCTCAACGAGTCCTGCGCCTGCGAAAGCATCCCAGACATACACTCAACCAGCCCCAAGTCTGAACGTCTCACGTAAGACGGGCTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
df0fab01dd9d9dc99e5edcfe73cf1257105975b6620fd1b135ee41b2af94a2a3
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,4453
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequence of Erwinia phage pEa_SNUABM_6 Kim,S.G., Lee,S.B. and Park,S.C. 2021-01-07 — GenBank