Genbank accession
UBF22508.1 [GenBank]
Protein name
putative tail fiber protein
RBP type
TF
Evidence RBPdetect
Probability 0,73
Protein sequence
MAYQSKVKTYGAPADERAERPDSWRWKQNEPPVAEYLNDLNYNIIEDIKHLVALTNAIDPDNDGMVANADKLDGKHAEELGGFKYVQTETPDTPAVGNSWFKDTNSLILVGDGQKYQPQPEVGYDETENFTEQGYKVLHETVPRTMVNDAGSIRLINELAVVNFEEGKINPNLKTWAWTDSSGLTAQNTTVISGTHSGEYSVGGTLDAITLKREAPIIQDFETTFQIGSDTGNISDYSELIVKAQDGTLIGGVRFNDGNGSLVVLDDARSPIENIQSAWSVGQNYSFEWDWDFGNSQYDLYMNGALVGTYSVPTGVSDFGEFTVRQDNSSSGATRSVFIDDLHTGAREYGEAVITLPVPDSRIESWDIIRIMRTSANESVVVDVEDSTGTTLLADVHSEDDLSAFVSASENFQLRAKFSRNNTANNPSLDGVYRRWTMRPGDHGMSDKEREALDRQMFIHQKLASR
Physico‐chemical
properties
protein length:466 AA
molecular weight: 51661,05470 Da
isoelectric point:4,49087
aromaticity:0,09013
hydropathy:-0,54742

Domains

Domains [InterPro]
UBF22508.1
1 466
Architecture
ATT
STR
RBD
ATT 1-180 | STR 212-396 | RBD 397-466
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Haloarcula virus HCTV-15
[NCBI]
2877979 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Haloarcula californiae
[NCBI]
2238 cellular organisms > Archaea > Methanobacteriati > Methanobacteriota > Stenosarchaea group > Halobacteria

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UBF22508.1 [NCBI]
Genbank nucleotide accession
MZ334520 [NCBI]
CDS location
range 24298 -> 25698
strand +
CDS
ATGGCATACCAAAGCAAAGTCAAAACCTACGGCGCTCCGGCGGACGAGCGGGCCGAACGGCCCGATTCGTGGCGCTGGAAACAAAACGAGCCGCCTGTCGCTGAGTACCTGAACGACCTGAACTACAACATCATCGAGGACATCAAGCACCTCGTGGCGCTGACGAACGCCATCGACCCGGACAACGACGGGATGGTGGCGAACGCCGACAAGTTGGACGGCAAGCACGCCGAGGAACTTGGCGGCTTCAAGTACGTTCAGACCGAGACCCCGGACACGCCCGCAGTGGGTAATTCGTGGTTCAAGGACACGAACAGCCTAATCCTCGTTGGTGACGGTCAAAAGTACCAACCTCAACCCGAGGTTGGCTACGACGAGACTGAAAACTTCACCGAGCAGGGATACAAAGTTCTTCACGAGACAGTTCCGAGAACGATGGTTAATGACGCTGGTAGCATCCGGCTCATCAACGAACTCGCTGTCGTGAACTTTGAAGAAGGGAAAATCAACCCGAACCTCAAGACTTGGGCGTGGACAGACTCATCGGGTCTGACCGCACAGAACACTACGGTCATCTCGGGTACTCACAGCGGCGAGTATTCGGTCGGTGGCACGCTCGACGCAATTACGCTGAAGCGTGAAGCGCCCATCATCCAAGACTTCGAGACTACGTTCCAAATCGGCTCTGACACCGGGAACATCAGCGACTACTCGGAACTCATCGTCAAAGCACAGGACGGAACGCTCATCGGTGGCGTTCGGTTCAACGACGGCAACGGCTCGCTGGTCGTACTCGATGACGCCCGCTCGCCTATCGAAAACATCCAGTCCGCGTGGTCTGTTGGGCAAAACTACTCGTTCGAGTGGGATTGGGACTTCGGAAACTCCCAGTACGACCTGTATATGAACGGCGCGCTGGTCGGCACGTACTCCGTTCCGACGGGCGTGAGCGACTTCGGGGAGTTCACTGTCCGACAAGACAACTCCTCGTCCGGTGCTACTCGGTCGGTCTTCATAGACGACCTCCACACCGGAGCGCGTGAATACGGCGAGGCGGTCATTACTCTGCCCGTGCCGGACTCGCGGATTGAATCGTGGGACATCATCCGCATTATGCGGACTTCGGCTAACGAGAGCGTCGTCGTAGATGTGGAAGACTCCACAGGCACGACGCTACTTGCGGACGTTCACAGCGAAGACGACCTTTCGGCTTTCGTCTCCGCTTCAGAAAACTTCCAACTCAGAGCAAAATTCAGTCGGAATAACACAGCAAACAATCCGTCTCTCGATGGTGTGTACCGGCGCTGGACAATGCGGCCCGGCGACCACGGTATGAGCGACAAAGAAAGAGAAGCACTGGACCGGCAAATGTTCATCCACCAAAAACTCGCAAGCAGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
fa143d48109a7afd42adc1d1787025fe402897f11c86c1b2cba164b8348978de
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7262
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50