Genbank accession
QWY83010.1 [GenBank]
Protein name
central tail fiber J
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MIKILSHSDTALATQEVVSAQPARIRGFKGSSKGGKVTNDGNTLRSRANFRLVEAVSEGPIWGLVDGAKSIYFDQTPLLNDDGTYNFKNISVSSHKGLPDEGYFNGHTAVETPVNVEVQVKNSLGPVVRTIVDENVDAVRVIMRIPSLVHQDSKGGLKKTSVSYAIDVRANNGSWNQVVLQNLDNEKTLSPFQIDHRVPLPLNGAPWDVRVRRLTADTTDDKLQNDTIWESYVELVEGKFIYPNTAAFAISGSAEQMGSNIPPRSYHIRGLLVNVPSNYNPLTRAYTGIWDGTFKIAWTNNPAWVFYDLLINDRYGLGEFIKPDIVDKWSLYTIAQYCDQLVKSGFKNGDTGADLYEPRYTFNGVINTRDEAFFVLQSITKAWRGMGYWALGQVFATADMPQDPVRLVTPANVIGGEFEYGGTALKARHSVVTVKWNNPDDFYRPDTEVVIDSELLHKYDWRDKTLQLTGCTSRGLAHRYGKWVIDTEQHETDTLTYQASWDHAELRPGEIIAVSDPRKALIRAGGRIVDHTGLTVTLDADFEYTEGETYQLMLTLPSGQVETKPILAFLDARTVRLASGFSAEAQPDAVWTIKGTDITPRLYRVISVDETDTNVFKITALFHDPLKYARIEKDIVFEPLPYDRPDKKAVPPSNLIVRETGYVTGGQTFHSLTVSWSPPPNTLVRGFVVAVDAPDGESFVIGSTNETFMELLTTRGGTYKFYVQTISYTGLVSDPATIEFEAVGPEGYPIPTVTDLELVDDPTTSNFTGTDVRVRWKNNFALSANGELEHVASPHYSHNTVNVYHNGTGALLRSERITSETYTYDLGSNRADCTKLGYATPTRAVRIEVTVTDVFARTSNEVDRVFTNPVPQAIAPSYTVAASTIFLGFNQPADPDYAGFLLLRSKTPGIDLTDEPYYDGQANPLTIPGEQNTTYYFRIAAYDAFGKTGLNWSSEFEVATHTDSVDFEPPAVPTGLAATSVIRADGMVDVTYTWDANTEGDLMGYIVQIKEGAGNYIGFSAPSPALKVTVLPSTLLTAQVLAYDTSGNRSNFSDPPLVYTASRDELPPAVPSNWTARGGFGLVVLSGDPNTELDFSHYEIYQSTTDTAPDAATPATLVASSNQFFVTDLDDELTLYFWLRSVDGSGNKSDWSEGLVATTVSSNVLLTTEALEGLVDRTSFATSIEPPGIGNTLPELPFTSQTPKQFFLTTDGKMYIQKVDGSGWVPTTSTTILDGKIVTGQIAAGAIGADQIAAGAVTAKNLSIRDFTILAENADMQLGSTVGWTGGRERIIQDAANAYPGQTWVAAMTGTGTFVVTNALEVACVAGERFYLSAHVKTAGNAGAGRKGVRAQFIDKDGNLLTPGTADTITNPTAWTAVAGFATAPADSAKVRLEVINYNNVGGTCYVANPRMMRAAAVLIEPNGITADKLTTGELITLSAQIKDAIITSAKVVDLDAAKIRAGTIMAATITVNGSQLGVIKNNAELGATDPATRINSGTTTINGGKVTISNTGVLSDWAMGGDSTEINGGAVAANTLTANKLTIGQRGINLENVQFSYDKATGIVSWTAGVLRYTRTNATTLAPEVGFVNISAGSATWTTGRLYVYWDKGATDPANGTAVTLSSTTAAGTANGDNKLVLATYSGGTMFVANYGQTIIDGGTIRANSIDAAQIKANAISAGLIASDAIETRHLKSQIITAKQMVMYDAQNWVSNGEFEELDAEATWAFGGGNISPQFSGLNPTSMFYLSTEGSQTGRYVLALDRKSPSYGTNLNVNMKNKFQVTAGSTLTVSVAFGSLNEASSAGFYITLYWYDRDGVQTTSTFLWNNSSIPAAITEQTKKIVVPADATYCHLRITHGSGSTEPVLYVDRVAVRKANAASLIVDGGIKANHIDVDNLSALNIKVQNIDIETGTIGGEKLTNGAISEVYVDSSGNDIYLNGSSNILVRNIAVKANERLLFTGFWNIRSFISYDSEITWFGYAQIVVNSTLVAQTMIVGPAVDGYTCSNQSISGACIIGSDSTVTCYFRFVIGSGGTPRSGSYNNGALAQNPMSNDSVTWSIMRAKK
Physico‐chemical
properties
protein length:2064 AA
molecular weight: 222691,52950 Da
isoelectric point:4,99356
aromaticity:0,09157
hydropathy:-0,14826

Domains

Domains [InterPro]
IPR036116
STR
667–737
QWY83010.1
1 2064
Architecture
STR
ATT
STR
ATT
STR
ATT
STR
STR
STR
RBD
STR 39-109 | ATT 110-237 | STR 238-374 | ATT 375-523 | STR 524-825 | ATT 863-967 | STR 969-1168 | STR 1266-1525 | STR 1704-1876 | RBD 1879-2064
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Rhizobium phage RHph_X66
[NCBI]
2836081 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QWY83010.1 [NCBI]
Genbank nucleotide accession
MW960030.1 [NCBI]
CDS location
range 40256 -> 46450
strand +
CDS
GTGATAAAGATCCTCTCCCACAGCGACACCGCGCTCGCGACCCAGGAAGTCGTCAGCGCCCAGCCGGCGCGTATTCGCGGCTTCAAGGGCAGCAGCAAGGGCGGCAAGGTCACGAACGACGGCAACACGCTGCGTTCGCGTGCAAACTTCCGGCTCGTCGAGGCTGTCTCGGAAGGTCCGATCTGGGGCCTCGTCGATGGCGCCAAGTCGATCTACTTCGACCAGACGCCGCTCCTCAACGACGACGGCACCTATAACTTCAAGAACATCTCGGTCTCGTCGCATAAGGGCCTGCCTGACGAAGGCTATTTCAACGGCCACACGGCAGTCGAGACGCCGGTAAACGTCGAGGTCCAGGTCAAGAATTCGCTTGGCCCGGTGGTGCGCACCATTGTCGATGAGAACGTCGACGCCGTGCGCGTCATCATGCGCATTCCCTCGCTCGTCCACCAGGACAGCAAGGGCGGCCTGAAGAAGACCTCGGTCTCCTACGCGATCGACGTGCGCGCCAACAATGGCAGCTGGAACCAGGTCGTCCTGCAGAATTTGGACAACGAGAAGACGCTCTCGCCGTTCCAGATCGATCACCGTGTTCCCCTGCCGCTGAATGGCGCTCCCTGGGATGTTCGCGTGCGTCGTCTGACGGCCGACACGACCGACGACAAGCTTCAGAACGATACCATCTGGGAGAGCTACGTCGAGCTTGTCGAGGGCAAGTTCATCTACCCGAACACGGCTGCTTTCGCGATCTCCGGTTCTGCCGAGCAGATGGGCTCGAATATCCCGCCGCGGTCCTATCATATCCGCGGCCTGCTGGTGAACGTTCCGTCGAACTACAACCCCCTGACGCGCGCCTATACCGGCATCTGGGATGGCACCTTCAAGATCGCCTGGACGAACAATCCGGCGTGGGTGTTCTACGATCTGCTGATCAACGACCGCTATGGCCTCGGTGAATTCATCAAGCCCGACATCGTTGACAAGTGGTCGCTCTACACCATCGCGCAGTATTGCGACCAGCTCGTTAAGTCCGGCTTTAAGAACGGCGACACGGGCGCGGATCTCTACGAGCCCCGCTATACCTTCAACGGCGTCATCAACACCAGGGATGAAGCCTTCTTCGTGCTGCAGTCGATCACGAAGGCATGGCGCGGCATGGGCTATTGGGCACTCGGCCAGGTCTTTGCCACCGCAGACATGCCGCAGGATCCTGTGCGCCTGGTCACGCCGGCAAACGTCATTGGAGGAGAGTTCGAATACGGCGGGACGGCGCTTAAGGCCCGGCACTCCGTCGTCACGGTCAAGTGGAACAATCCGGATGACTTCTATCGCCCGGACACCGAAGTCGTCATCGATAGCGAGCTGCTCCACAAGTATGACTGGCGCGACAAGACGCTCCAGCTCACCGGCTGCACCTCGCGCGGCCTCGCGCATCGTTACGGCAAGTGGGTAATCGATACCGAGCAGCACGAGACCGATACGCTCACCTATCAGGCGAGCTGGGATCACGCCGAGCTTCGGCCTGGCGAAATCATCGCAGTCTCGGATCCTCGCAAGGCGCTGATCCGCGCGGGCGGCCGCATCGTCGACCACACCGGCCTGACGGTCACGCTCGATGCGGACTTCGAATACACCGAGGGCGAAACCTACCAGCTCATGCTGACGCTGCCGTCGGGCCAGGTCGAGACCAAGCCGATCCTGGCGTTCCTCGACGCCCGCACCGTTCGCCTCGCCTCTGGCTTCTCCGCTGAAGCCCAGCCCGACGCGGTGTGGACGATCAAGGGCACGGACATCACGCCGCGGCTCTATCGCGTCATCTCCGTCGATGAGACGGACACCAATGTCTTCAAGATCACGGCGCTGTTCCACGATCCGCTGAAGTATGCGCGCATCGAGAAGGACATTGTATTCGAACCGCTGCCGTATGATCGGCCGGACAAGAAGGCGGTTCCGCCTTCGAACCTCATCGTGCGCGAGACCGGCTATGTCACGGGCGGCCAGACTTTCCACTCGCTGACGGTCTCCTGGAGCCCGCCTCCGAATACGCTGGTGCGCGGCTTCGTCGTCGCCGTCGATGCGCCGGACGGTGAGAGCTTCGTCATTGGCTCGACCAACGAGACCTTTATGGAGCTGCTGACCACGCGGGGCGGCACCTACAAGTTCTATGTCCAGACGATCAGCTACACCGGCCTGGTATCGGATCCTGCGACCATCGAATTCGAGGCAGTCGGCCCGGAAGGCTATCCGATCCCGACCGTCACGGATCTGGAGCTCGTTGACGATCCGACGACCTCGAACTTCACCGGCACTGACGTTCGCGTCCGCTGGAAGAACAACTTCGCCCTGTCGGCCAACGGCGAGCTCGAGCACGTCGCCTCGCCGCACTACAGCCACAACACGGTCAACGTCTACCACAACGGCACGGGCGCGCTGCTGCGCTCGGAGCGCATCACGTCGGAGACCTACACCTACGATCTCGGCTCGAACCGAGCTGACTGCACGAAGCTGGGCTACGCAACCCCGACCCGCGCCGTCCGCATCGAAGTCACCGTCACCGACGTTTTCGCCCGCACCTCGAATGAGGTCGATCGGGTGTTCACGAACCCGGTCCCGCAGGCGATCGCGCCGAGCTACACCGTTGCCGCATCGACGATCTTCCTCGGCTTCAATCAGCCGGCCGATCCCGATTACGCGGGCTTCCTGCTGCTGCGCTCCAAGACGCCGGGCATCGATCTCACCGATGAGCCCTATTACGACGGCCAGGCCAACCCGCTGACCATTCCGGGCGAGCAGAACACGACCTATTACTTCCGTATTGCCGCATACGACGCATTCGGCAAGACGGGCCTCAACTGGTCGTCCGAATTCGAAGTCGCCACCCACACCGACAGCGTCGACTTTGAGCCGCCTGCGGTTCCGACCGGCCTCGCCGCAACGTCGGTTATCCGCGCCGACGGCATGGTGGACGTTACCTATACCTGGGACGCCAACACCGAAGGCGACCTGATGGGCTACATCGTCCAGATCAAGGAAGGTGCTGGCAACTACATCGGCTTCTCCGCCCCGTCGCCGGCGCTGAAGGTCACCGTGCTGCCTTCGACTTTGCTGACCGCCCAGGTGCTCGCCTACGATACCAGTGGCAATAGGTCGAACTTCAGCGATCCTCCGCTCGTCTACACGGCAAGCCGGGATGAGCTGCCGCCTGCCGTTCCGTCGAACTGGACCGCAAGGGGCGGCTTCGGCCTCGTCGTGCTGTCCGGCGATCCGAACACCGAACTGGATTTCTCCCACTACGAGATCTACCAGAGCACGACGGATACGGCGCCCGACGCCGCAACGCCTGCAACGCTTGTCGCCAGCTCCAATCAGTTCTTCGTCACCGACCTGGATGACGAGCTGACGCTCTATTTCTGGCTGCGCTCCGTCGATGGTAGCGGCAACAAGTCGGACTGGTCCGAGGGGCTGGTTGCGACCACGGTCTCTTCGAACGTTCTGCTGACCACCGAGGCTCTCGAGGGCCTGGTCGATCGGACGAGCTTTGCAACCTCGATCGAGCCGCCTGGCATTGGCAACACCCTGCCGGAGCTGCCCTTCACCAGCCAGACGCCGAAGCAGTTCTTCCTGACCACCGATGGGAAGATGTATATCCAGAAGGTCGACGGCTCCGGCTGGGTGCCGACCACCTCGACCACTATCCTCGACGGCAAGATCGTCACCGGCCAGATCGCGGCAGGCGCGATTGGTGCGGATCAGATCGCGGCCGGCGCTGTCACTGCCAAGAACCTGTCGATCCGCGATTTCACGATCCTTGCGGAAAATGCAGACATGCAGCTCGGCAGCACTGTCGGCTGGACGGGCGGTAGGGAGCGCATCATCCAGGACGCGGCCAATGCCTATCCGGGCCAGACCTGGGTAGCAGCCATGACGGGCACCGGCACGTTCGTCGTGACCAACGCCCTTGAAGTGGCGTGCGTGGCCGGTGAGCGCTTCTATCTGTCCGCGCATGTGAAGACTGCAGGGAACGCTGGCGCCGGCCGCAAGGGCGTGCGTGCTCAGTTCATCGACAAGGACGGCAATCTGCTGACGCCTGGCACGGCCGACACGATCACCAATCCGACGGCCTGGACTGCCGTTGCGGGCTTTGCGACTGCGCCTGCGGATTCGGCCAAGGTTCGGCTCGAGGTTATCAACTACAACAATGTGGGCGGCACCTGCTATGTCGCCAACCCGCGCATGATGCGTGCAGCCGCGGTTCTGATCGAGCCGAATGGCATCACGGCCGACAAGTTGACGACTGGCGAATTGATCACGCTCTCGGCGCAGATCAAGGACGCCATCATCACCAGCGCCAAGGTCGTCGATCTCGATGCGGCCAAGATCAGGGCCGGCACCATCATGGCTGCGACGATCACGGTCAACGGCTCGCAGCTCGGTGTCATCAAGAACAATGCCGAGCTCGGCGCAACCGATCCGGCAACCCGCATCAACTCCGGCACCACGACGATCAACGGCGGGAAGGTTACGATCTCCAACACCGGCGTCCTGAGCGATTGGGCGATGGGTGGCGACTCGACCGAGATCAATGGTGGCGCCGTTGCGGCAAACACCCTGACTGCCAATAAGCTGACGATCGGCCAGCGCGGCATCAACCTCGAGAACGTTCAGTTCTCCTACGACAAGGCGACTGGCATCGTCTCGTGGACGGCCGGCGTGCTGCGCTATACCCGCACCAATGCGACGACGCTCGCGCCTGAAGTCGGCTTCGTTAATATCTCTGCGGGCAGCGCAACCTGGACCACTGGCCGCCTCTACGTCTATTGGGACAAGGGCGCAACGGATCCGGCCAATGGCACGGCCGTCACGCTCAGCTCCACCACCGCAGCCGGCACGGCCAACGGTGACAACAAGCTCGTGCTGGCGACCTATAGCGGTGGCACGATGTTCGTTGCCAACTACGGCCAGACGATCATCGACGGTGGGACGATCCGCGCGAATTCGATCGACGCGGCGCAGATTAAGGCGAACGCCATCTCGGCCGGCCTGATCGCTTCGGATGCGATCGAGACGCGGCACCTGAAGTCGCAGATCATTACCGCGAAGCAGATGGTCATGTATGACGCCCAGAATTGGGTGTCGAACGGTGAATTCGAAGAGCTCGACGCCGAGGCTACTTGGGCGTTCGGCGGTGGCAATATTTCGCCGCAGTTCAGCGGTCTGAACCCGACCAGCATGTTCTATTTGTCGACCGAGGGATCGCAGACCGGCCGTTATGTCCTGGCGCTCGATCGCAAGAGCCCCTCGTATGGCACCAACCTGAACGTCAACATGAAGAACAAGTTTCAGGTGACCGCGGGCTCGACGCTGACTGTCAGCGTTGCTTTCGGCTCGCTGAACGAGGCAAGCAGCGCGGGCTTCTATATCACGCTCTACTGGTATGATCGGGACGGCGTGCAGACGACCAGCACGTTCCTTTGGAACAACAGCTCCATTCCCGCGGCGATCACTGAGCAGACGAAGAAGATCGTGGTGCCGGCCGACGCAACCTATTGCCATCTGCGCATCACCCACGGCTCCGGCTCGACCGAGCCTGTCCTCTACGTCGACCGCGTTGCTGTTCGTAAGGCCAACGCTGCCAGCCTGATCGTGGACGGTGGTATCAAGGCCAACCACATCGATGTCGATAACCTGAGCGCCTTGAACATCAAGGTGCAGAACATCGACATCGAAACCGGCACGATCGGTGGTGAAAAGCTCACCAATGGTGCGATCTCTGAGGTCTATGTCGATAGCTCTGGAAACGACATCTACCTCAACGGCTCATCGAATATCCTTGTCCGCAACATCGCCGTTAAGGCGAATGAGCGGCTCCTGTTCACGGGTTTCTGGAACATTCGGAGCTTCATCAGCTACGACAGCGAAATTACCTGGTTCGGCTATGCTCAGATCGTCGTTAACAGCACCCTGGTCGCCCAGACGATGATCGTCGGACCTGCCGTTGACGGGTATACGTGCAGCAACCAGTCTATATCCGGCGCCTGCATTATCGGATCTGACTCTACCGTTACTTGTTATTTCCGCTTCGTCATCGGCTCCGGCGGCACCCCTCGCTCCGGCAGCTATAACAATGGTGCGCTTGCGCAAAACCCGATGTCCAACGACAGCGTTACGTGGTCCATCATGAGGGCAAAGAAGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
bc39de7cadf40430dd9222f3f7305383949e8d02bb9a39a0400f04e0ec09beae
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,7280
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
The Hidden Diversity and Expansion of Phages in the Symbiotic Bacteria Rhizobium Gonzalez,V., Santamaria,R.I., Bustos,P., Cauwenberghe,J.V. and Juarez,S. 2017-09-25 GenBank