Genbank accession
UNA01573.1 [GenBank]
Protein name
tail fibers protein
RBP type
TF
Evidence GenBank
Probability 1,00
Protein sequence
MTNEKDTRVVEGYMGACAVVMGYLKRERGNIPVSSVNKLIKELGYDGMSLNELQHVGKEINEDKLLSNLYELARKGEITLDNVPPAYSDEEQEEDKKNLTEKDVFSAVTPYIAERTNNMADIREFRKMQRDGTAMKLLFESLKKELVEELKDLPKAKYIKSEVKAPQQGDKSLILCFSDWHVGMYVINETTGGYNFDMLTSYVDNIVDEVMKLVKEQDIKHLYVYNLGDITEHINMRNVNQAFDAEMHLSKQIATSTRLTVDVLSKLSKHLHVTYTQIAGNHDRMQASKNDVISGDSTAYVLLSTLIMLQEDLGQLPNVTVVDNRESMYAYTQDIAGLTVKAVHGDKEKKGLHNVIGKHVKTKNIDLIIMGHFHSTLIQQEDYARYKVVVGSPQGENDFSKDNNMSSSFGSQMIIILEEGRKSPVFYPIMLKEGEII
Physico‐chemical
properties
protein length:437 AA
molecular weight: 49504,93750 Da
isoelectric point:5,54609
aromaticity:0,06865
hydropathy:-0,41854

Domains

Domains [InterPro]
IPR029052
STR
170–397
IPR029052
STR
173–420
IPR029052
STR
174–397
UNA01573.1
1 437
Architecture
STR
STR 170-420 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage vB_BcgM
[NCBI]
2918264 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Bacillus weihenstephanensis
[NCBI]
1405 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Bacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UNA01573.1 [NCBI]
Genbank nucleotide accession
OM743306.1 [NCBI]
CDS location
range 109183 -> 110496
strand +
CDS
TTGACAAACGAGAAAGACACAAGAGTAGTAGAAGGGTACATGGGTGCCTGTGCTGTTGTAATGGGTTATTTAAAACGAGAGCGCGGTAATATCCCAGTATCATCAGTTAATAAGTTAATCAAAGAGCTAGGCTACGATGGTATGAGTTTAAATGAATTGCAGCATGTAGGTAAAGAGATTAACGAGGACAAACTACTATCTAATCTATATGAACTAGCCCGTAAAGGTGAAATCACATTAGACAATGTTCCACCAGCATACAGCGATGAAGAGCAGGAAGAAGATAAGAAAAACTTAACAGAGAAGGATGTATTCTCTGCTGTAACCCCATACATAGCAGAAAGAACAAATAACATGGCGGATATCCGTGAGTTCCGTAAGATGCAGCGTGACGGTACCGCAATGAAGTTACTCTTCGAGAGCCTTAAGAAAGAGCTTGTTGAGGAGCTTAAAGACCTACCTAAAGCTAAATACATTAAGTCGGAAGTAAAAGCGCCACAGCAGGGCGACAAGAGCCTTATTCTTTGCTTTAGTGATTGGCATGTAGGAATGTATGTCATTAACGAAACTACAGGAGGATATAACTTCGATATGTTGACAAGCTACGTGGATAACATCGTAGACGAAGTTATGAAACTAGTAAAAGAGCAGGACATCAAACACCTATACGTATACAACTTAGGAGACATTACAGAACATATCAACATGCGTAATGTGAACCAAGCGTTTGATGCGGAGATGCACCTATCGAAACAGATTGCAACTTCTACTCGACTAACTGTAGATGTACTAAGTAAGTTATCAAAACATTTACACGTTACGTACACACAAATTGCCGGGAATCACGATAGAATGCAAGCTTCAAAGAATGATGTAATCAGCGGAGATAGTACAGCATACGTATTACTTTCTACTTTAATCATGCTGCAAGAGGATTTAGGGCAACTACCTAACGTCACTGTAGTAGATAACCGTGAATCTATGTATGCTTACACACAAGATATTGCCGGGTTAACAGTAAAAGCGGTACATGGTGACAAAGAGAAGAAAGGTCTACATAACGTAATCGGAAAGCACGTTAAAACGAAGAACATCGATTTAATTATTATGGGTCACTTCCATTCTACTTTAATCCAGCAAGAGGATTATGCACGATACAAAGTAGTAGTAGGTAGCCCGCAAGGAGAAAATGACTTCTCTAAAGATAACAACATGTCTTCAAGTTTTGGCTCCCAGATGATTATTATCCTAGAAGAAGGTCGTAAGTCTCCAGTGTTTTACCCAATCATGTTAAAAGAAGGAGAGATTATTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
e77c371192d529981435f0a043f156d03292f49da3b031f91066033127f312ff
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8182
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50