Genbank accession
YP_010055808.1 [GenBank]
Protein name
tail protein
RBP type
TF
Evidence RBPdetect2
Probability 0,90
Protein sequence
MSISSYPFDGQAVSEGQYSYLFRELASHSGIAGPEGLGTSSFSVFGDGTGMNVKVNAGFAIVRGHAVQSTATEVVTIAAASAAQRYDRVVLRLDPTANSIKLAVVQGTSGGGLPALTQTDTGIYDFPLATVTVPVGAATITSGNVQGEREFLGNTVGAWTTATRPKTPRMGRLGFNNSTKVWEFWDGTAWKDLAPTINWGTIEGAPATFPPASHTHPWGDVTGKPTTFPPSSHNHDWDQVTGKPSTYPPSSHSHSWSSITSKPSSFPPESHSHSGYLTSGSTISWANGSKKPHSNAASGSGTWYAVWVEGDGTFCRNTSSIKFKENVRDYTVNPDDVLALRPVVYDRKDTVNEDGSVKEGRKDEVGLIAEEVEAAGLTWLVNYLDGEVDGLRYDLLGVALVPVVQRQAQQISDLEARLARLEAQLS
Physico‐chemical
properties
protein length:426 AA
molecular weight: 45491,77060 Da
isoelectric point:5,56752
aromaticity:0,08920
hydropathy:-0,32300

Domains

Domains [InterPro]
DC_1002
STR
1–333
DC_0942
RBD
315–426
IPR030392
CHP
319–418
IPR030392
CHP
319–375
YP_010055808.1
1 426
Architecture
STR
RBD
STR 1-333 | RBD 334-426
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptomyces phage Thestral
[NCBI]
2301715 Uroviricota > Caudoviricetes > Arquatrovirinae > Caelumvirus thestral >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_010055808.1 [NCBI]
Genbank nucleotide accession
NC_054670 [NCBI]
CDS location
range 20035 -> 21315
strand +
CDS
GTGTCCATCAGTTCCTACCCGTTCGACGGCCAGGCCGTCTCCGAGGGGCAGTACAGCTACCTCTTCCGCGAGCTCGCCTCGCACTCCGGGATCGCCGGCCCCGAGGGGCTGGGCACCTCCAGCTTCTCCGTCTTCGGCGACGGCACCGGCATGAACGTCAAGGTCAACGCCGGCTTCGCGATCGTGCGCGGCCACGCCGTCCAGTCGACGGCGACCGAGGTCGTCACCATCGCCGCGGCGAGCGCAGCCCAGCGCTACGACCGTGTCGTCCTGCGCCTGGACCCGACCGCGAACAGCATCAAGCTCGCTGTCGTCCAGGGCACCTCGGGCGGCGGCCTGCCTGCCCTGACGCAGACGGACACCGGCATCTACGACTTCCCCCTGGCGACCGTCACCGTCCCGGTCGGCGCCGCGACCATCACGTCCGGCAATGTCCAGGGCGAGCGCGAGTTCCTGGGCAACACGGTCGGCGCCTGGACGACCGCGACGCGACCGAAGACCCCGCGCATGGGTCGGCTCGGCTTCAACAACTCCACGAAGGTCTGGGAGTTCTGGGACGGCACGGCGTGGAAGGATCTCGCCCCGACGATCAACTGGGGCACGATCGAGGGGGCGCCGGCCACCTTCCCCCCGGCCTCGCACACCCACCCCTGGGGCGACGTCACCGGCAAGCCGACGACCTTCCCGCCCAGCTCGCACAACCACGACTGGGACCAGGTCACCGGTAAGCCCTCGACGTACCCGCCGAGCTCGCACTCGCACTCCTGGTCCTCGATCACCTCGAAGCCGTCCTCGTTCCCGCCCGAGTCGCACAGCCACTCCGGGTACCTGACGTCCGGCTCGACGATCTCCTGGGCCAACGGCTCGAAGAAGCCGCACAGCAACGCGGCCTCCGGGTCCGGTACCTGGTACGCGGTGTGGGTCGAGGGGGACGGCACCTTCTGCCGGAACACCTCCTCGATCAAGTTCAAGGAGAACGTTCGCGACTACACGGTGAACCCGGACGACGTGCTGGCCCTGCGCCCGGTCGTCTACGACCGCAAGGACACCGTCAACGAGGACGGCTCCGTCAAGGAGGGCCGCAAGGACGAGGTCGGCCTGATCGCGGAAGAGGTGGAGGCCGCGGGCCTGACCTGGCTGGTCAACTACCTGGACGGCGAGGTCGACGGCCTGCGCTACGACCTCCTGGGCGTCGCCCTGGTCCCGGTCGTGCAGCGCCAGGCGCAGCAGATCTCAGACCTGGAGGCCCGCCTCGCACGCCTGGAGGCCCAGCTCTCGTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
f6af45f27386e8218566cb223adc27ace3617b2c527a108c10f188991ca6d538
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7824
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50