UniProt accession
A0A8S5RH31 [UniProt]
Protein name
Collagen-like protein
RBP type
TF
Evidence RBPdetect
Probability 0,62
Protein sequence
MEKVVRIALGLALSLMTLSCSDEMHMLFPEGPQGPQGLSAYEVWVKAVENGEVDWPKDRTDVNNFFIFLKGKDGKDGVDGVDGINGLSAYEIWKQEVEKGLDNPHNPGTQWDKNKTSLQDFWYYLSGADGQDGATPKIGENGNWWINGEDTGIPARGKDGANGQDGKDGKDAVAPTVEIGANGNWHINGEDTGVPARGKDGQNGQDGRDGHTPTVTIGENGNWFVDGVDTGHKAQGPKGDKGEDGENGKDGKTPIVTIGQNGNWYIDGVDTGKPSRGKDGDNGLSVTVKIGDNGNWFIDDIDTGVPARGSDGRNGTQWSIGENGNWYYFDYETNTWKDSGKPSQGADGTGSAGLSAYELWVREVLKGTISKDGIVWDKNKISMSDFWEYLRGNNGKDGTDGKDGEDLSGVPQPVVQQGIYNVIAGYYNISHHEYVNWGTGGVTYTVYGPNAQHVPAGVKITNMPKMDSNLEFVTDENGQFVVSKEQLPQNSYNSIEIYGKPTVTVDGETKEVATATHVPCAMQIRLVVKDVLFNETQAPYKFSTTAIFLQLERKKDAGSTWEEVPTWIGATRGMSYVKIYDSNHQLVGSEPTQEYRTSNVLTNYRFNVTRRIKSDSHYDYSQDAAREAIGWYGEGDERYYMKVSVGSLEDSKICYGETPEADAWIEDVPLRPAPYCTRLDLSYEIDNRNMLVKAYFDQTAMQNIIDKTTVLYEAKFSNRYINGSNTWIPTRFEDPSSRANMQLISERTSGVGSITTSRSQFHSIPQLLPNGNPGYIAMEHVLSGSKLQICANGLFSVTFFSFDIGIIHVEGTGSDAKFTLEKNPALKDDITVTNIK
Physico‐chemical
properties
protein length:836 AA
molecular weight: 91894,25330 Da
isoelectric point:4,81252
aromaticity:0,09809
hydropathy:-0,64187

Domains

Domains [InterPro]
PS51257
STR
1–20
DC_0947
STR
38–169
DC_1486
ATT
158–207
A0A8S5RH31
1 836
Architecture
STR
STR
ATT
STR
STR 1-20 | STR 38-157 | ATT 158-287 | STR 288-748 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage virus sp. ct5rm7
[NCBI]
2827298 No lineage information
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
DAE30268.1 [NCBI]
Genbank nucleotide accession
BK059103 [NCBI]
CDS location
range 42839 -> 45349
strand -
CDS
ATGGAAAAAGTAGTAAGAATTGCATTAGGGCTTGCTCTAAGTCTGATGACTTTATCGTGCAGCGATGAGATGCATATGCTTTTCCCAGAAGGACCACAGGGTCCCCAAGGCTTGTCTGCCTATGAGGTATGGGTAAAAGCGGTTGAAAACGGTGAAGTGGACTGGCCTAAAGATCGTACAGACGTAAACAACTTCTTCATCTTTCTTAAAGGGAAAGATGGAAAAGACGGCGTGGACGGTGTTGATGGCATTAACGGACTGTCAGCCTATGAGATTTGGAAACAAGAGGTTGAAAAGGGATTGGACAATCCGCATAATCCCGGTACTCAATGGGATAAGAACAAGACGAGCCTACAAGATTTCTGGTATTATCTTTCGGGGGCAGATGGGCAAGATGGAGCAACGCCCAAAATAGGTGAGAATGGCAACTGGTGGATAAACGGTGAAGACACCGGCATTCCGGCTCGCGGTAAAGACGGAGCCAATGGGCAAGATGGCAAAGATGGTAAAGACGCCGTAGCACCGACAGTCGAAATTGGAGCAAATGGCAACTGGCATATCAACGGCGAAGACACGGGTGTTCCTGCTCGCGGTAAGGATGGACAAAACGGACAAGATGGCCGCGACGGTCATACGCCAACTGTTACCATAGGCGAAAATGGCAACTGGTTTGTGGACGGAGTAGATACCGGTCACAAAGCGCAGGGTCCCAAAGGTGACAAAGGAGAAGACGGAGAAAACGGGAAAGATGGCAAAACACCGATAGTAACCATCGGACAAAATGGAAATTGGTACATTGATGGTGTGGACACAGGTAAACCCTCACGTGGCAAAGACGGTGACAATGGCCTTTCCGTAACGGTTAAAATCGGAGATAATGGAAATTGGTTCATCGATGATATTGATACAGGTGTTCCGGCACGAGGCTCCGATGGGCGGAATGGGACGCAATGGAGCATCGGCGAAAATGGCAACTGGTATTACTTTGACTACGAAACAAATACATGGAAAGATAGCGGGAAGCCTTCACAAGGTGCAGATGGTACGGGTAGTGCCGGGTTAAGCGCATACGAACTATGGGTACGGGAGGTATTGAAAGGCACTATATCCAAAGACGGAATTGTATGGGATAAAAACAAAATCTCGATGTCGGACTTCTGGGAATACCTGCGAGGGAATAACGGTAAAGACGGTACAGATGGTAAGGATGGCGAAGATTTGTCAGGTGTTCCACAACCGGTAGTTCAACAAGGCATTTATAATGTAATTGCCGGATATTACAATATTTCCCACCATGAATATGTAAATTGGGGAACAGGTGGTGTAACTTATACCGTTTATGGTCCGAATGCGCAGCATGTTCCGGCAGGAGTGAAAATAACCAACATGCCCAAAATGGATTCGAATTTGGAATTCGTGACCGATGAGAACGGTCAATTCGTCGTGTCGAAAGAACAGTTGCCGCAAAACTCGTACAATTCAATTGAAATTTATGGCAAACCGACCGTAACAGTCGATGGTGAAACAAAAGAAGTAGCAACAGCAACACATGTGCCGTGTGCTATGCAGATACGCCTTGTCGTGAAGGATGTTTTGTTTAACGAAACGCAGGCTCCTTATAAATTCTCGACCACAGCCATATTTTTACAACTTGAACGTAAAAAAGATGCGGGATCGACATGGGAAGAGGTGCCAACGTGGATAGGTGCTACCAGAGGAATGAGCTATGTCAAGATATACGATTCCAATCACCAATTAGTGGGAAGTGAGCCTACGCAAGAATATCGGACATCGAATGTCCTGACGAATTACAGATTTAATGTGACGCGCAGAATTAAAAGCGACAGCCATTATGACTATTCACAGGATGCCGCCCGTGAAGCTATTGGATGGTATGGCGAGGGCGACGAACGTTACTATATGAAGGTATCTGTCGGGTCATTGGAGGACTCAAAGATATGTTACGGTGAAACGCCCGAAGCTGACGCGTGGATTGAGGATGTGCCATTGCGCCCGGCTCCCTATTGTACCCGTCTTGATTTGAGTTATGAAATCGACAATAGGAATATGTTGGTGAAAGCCTATTTCGACCAAACGGCTATGCAGAATATCATTGATAAAACGACCGTTCTTTATGAGGCTAAATTCTCCAACCGGTATATCAACGGCAGCAACACATGGATTCCCACAAGATTTGAAGACCCATCATCGCGTGCCAATATGCAACTTATATCTGAACGGACATCCGGAGTAGGTTCTATAACAACAAGTAGAAGTCAATTTCATTCAATTCCCCAATTGCTTCCCAACGGCAATCCGGGATACATCGCAATGGAACATGTACTAAGCGGCTCCAAACTTCAGATTTGTGCCAATGGCCTGTTCTCCGTGACGTTCTTCAGTTTTGATATAGGTATTATACATGTTGAAGGAACAGGAAGCGACGCTAAGTTTACGTTGGAAAAGAATCCTGCACTTAAAGATGATATAACAGTCACGAATATAAAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
0220dd3747ef91949758e3232da7b8f883f6267b53a0f4c320ba8be284cafd1d
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,5757
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50