Protein
View in Explore- Genbank accession
- QAY16138.1 [GenBank]
- Protein name
- hypothetical protein
- RBP type
-
TF
- Protein sequence
-
MSKQIIQRYTFDPAARTVTLTDFDAVELGRLALITNVTTNTVIFNFADPGRGATVAGNVITLAFDTTAMSSTDRLRIDYDIMFGDPASDKTVVGNARSKFRDGFATPGGTFPNPSTWDLVNEATDPSNGHILTQGGDSFGSSYLRVSLSPFLDNSEVRLTSRQAFSFPMRVGFGLSMSQRIQGQEVFLGMVGADSAGDLDYTAAPADIPITGATASITSNVATFTVTNHGLKGGDRIEIEFCVERRLNVGPVTATIVDANTFTVPCTLTAGSYPTTGGVVRIVDPVRSARNAAGLLFENQTTTNASFVSRRNGSKFRSKNETVASTTATQSNTNPYTDALNSAANHELYYSLDEVAFRSFASDSGGGMNGYDKYTQGIPDEDPAYKIHVRARNLTGLTRPVARIASIAKTGTSTATVTTVEAHGLAVTDFVQVYGVWDQTNFPNLASQTAVSSVIDANTFTIVIGTAVTASSLGGAVWLNQGSVLAPGVQAQVVQSLSRTNGVLTVIGNTTWTSPIPGELFHLWGLAGAPSYEGAYKVLRASGTTLELDAPGPDFSLITGVGGAAIRRTDVRLHFARVMDFTRMSVEVYGGKGNTNDANNATPVTITGSATVPASQTTGSSSTIWNAAGWGGFLVNDIASAALTSTSTSSAVTPGSVGSIGTYAHEFNVIVTAVSGTNPTMDVAIEESPDNGTNWVRIYEFQRITATGTYTSPLIRSTHGTRYRYVRTVGGTSPSFTNAVNRLQYSSAAAFHRQYFDRSINLATLNSVTPTYNVEGATRFVLGINVGAITTTAPALQLEGSEDGSTWYALAAPLTAVASSTVVAYAIDVLPKFVRARVSTAGVGVTAGYVTIKGHGA
- Physico‐chemical
properties -
protein length: 857 AA molecular weight: 90208,40970 Da isoelectric point: 5,93555 aromaticity: 0,08518 hydropathy: -0,02124
Domains
Domains [InterPro]
DC_1239
RBD
1–309
RBD
1–309
IPR023366
STR
209–284
STR
209–284
1
857
Architecture
RBD 1-208 | STR 209-284 | RBD 285-309 | STR 399-485 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Arthrobacter phage Sonali [NCBI] |
2510495 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QAY16138.1
[NCBI]
Genbank nucleotide accession
MK411746
[NCBI]
CDS location
range 25104 -> 27677
strand +
strand +
CDS
TTGAGCAAGCAGATCATCCAGCGGTACACGTTCGACCCGGCGGCCAGGACCGTTACCCTGACGGACTTCGATGCCGTGGAGCTCGGTCGCCTGGCGCTCATCACGAACGTCACGACCAACACGGTCATCTTCAACTTCGCCGACCCGGGCCGCGGCGCCACCGTGGCAGGCAATGTCATCACCCTGGCATTCGACACCACTGCGATGTCCTCCACGGACCGGCTCCGGATCGACTACGACATCATGTTCGGGGACCCCGCCTCCGACAAGACCGTGGTTGGGAACGCCCGCTCGAAGTTCCGGGACGGCTTCGCCACGCCTGGCGGGACCTTCCCGAACCCCTCCACCTGGGACCTGGTCAACGAGGCCACCGACCCGAGCAACGGGCACATCCTCACCCAGGGCGGCGATAGCTTCGGCTCCTCCTACCTCCGGGTCTCCCTCTCCCCGTTCCTGGACAACTCCGAGGTCCGGCTGACCTCGCGCCAGGCGTTCTCGTTCCCCATGCGGGTCGGCTTCGGCCTGTCGATGTCCCAGCGCATCCAGGGCCAGGAGGTGTTCCTCGGCATGGTCGGGGCCGACTCCGCCGGGGACCTGGACTACACCGCCGCCCCGGCTGACATCCCGATCACCGGCGCCACGGCCTCCATCACCTCGAACGTCGCTACCTTCACCGTGACCAACCACGGGCTCAAGGGCGGCGACCGGATCGAGATTGAGTTCTGCGTGGAGCGGCGCCTGAATGTCGGCCCGGTCACGGCGACCATCGTGGACGCCAACACCTTCACCGTCCCCTGCACCCTGACGGCAGGCTCCTACCCCACCACGGGCGGCGTCGTCCGCATCGTGGACCCGGTCCGGTCCGCCAGGAACGCCGCCGGGCTGCTGTTCGAGAACCAGACCACCACCAACGCCTCCTTCGTCTCCAGGCGGAACGGGTCCAAGTTCCGGTCCAAGAACGAAACGGTCGCCTCCACCACGGCCACCCAGTCCAACACCAACCCCTACACCGATGCCCTGAACTCGGCAGCCAACCACGAGCTCTACTACTCCCTGGACGAGGTAGCGTTCCGCTCCTTCGCCTCCGACTCCGGCGGCGGCATGAACGGCTACGACAAGTACACCCAGGGCATCCCGGACGAGGACCCGGCCTACAAGATTCACGTCCGGGCCCGGAACCTCACCGGGCTCACCCGCCCCGTCGCTAGGATCGCCTCCATTGCCAAGACCGGCACCTCGACGGCGACCGTGACCACGGTGGAGGCTCATGGCCTGGCGGTGACGGACTTCGTCCAGGTCTACGGGGTCTGGGACCAGACCAACTTTCCGAACCTGGCCTCCCAGACCGCGGTGTCCTCCGTGATCGACGCCAACACCTTCACCATCGTCATCGGCACCGCGGTCACGGCATCCTCCCTCGGTGGAGCCGTCTGGCTGAACCAGGGCTCGGTCCTGGCTCCTGGCGTCCAGGCGCAGGTCGTCCAGTCCCTCTCCAGGACCAACGGCGTCCTCACCGTGATCGGCAACACCACCTGGACCTCCCCGATCCCTGGCGAGCTCTTCCACCTCTGGGGCCTGGCTGGGGCCCCGAGCTACGAGGGCGCCTACAAGGTCCTCCGCGCCTCGGGCACCACCCTGGAGCTCGACGCCCCGGGCCCGGACTTCTCCCTTATTACTGGGGTCGGCGGCGCAGCCATCAGGCGCACCGACGTCCGGCTGCACTTCGCCCGGGTCATGGACTTCACCCGCATGTCGGTGGAGGTCTACGGCGGCAAGGGCAACACGAACGATGCCAACAACGCCACCCCGGTCACGATCACTGGCTCCGCCACGGTCCCGGCCTCCCAGACCACCGGCTCGTCCTCGACCATCTGGAACGCGGCGGGCTGGGGCGGGTTCCTGGTCAACGACATCGCCTCGGCGGCCCTGACCTCGACCTCGACCTCCTCGGCGGTCACGCCTGGTTCGGTGGGCTCCATCGGCACCTACGCCCACGAGTTCAACGTCATCGTCACCGCTGTCTCCGGCACGAACCCGACGATGGATGTGGCGATTGAGGAGTCCCCGGACAACGGCACCAACTGGGTCCGCATCTACGAGTTCCAGCGGATCACCGCGACGGGCACCTACACGAGCCCGCTCATCCGGTCCACGCATGGCACCCGCTACCGCTATGTCCGGACCGTCGGCGGAACCTCGCCCTCGTTCACGAACGCGGTCAACCGGCTCCAGTACTCCTCCGCCGCGGCGTTCCACCGGCAGTACTTCGACCGGAGCATCAACCTGGCCACCCTGAACTCGGTCACCCCGACCTACAACGTGGAGGGAGCCACCAGGTTCGTCCTCGGGATCAACGTCGGAGCCATCACCACCACCGCTCCGGCCCTCCAGCTCGAAGGCAGCGAGGACGGGTCCACCTGGTACGCCCTGGCGGCGCCGCTCACCGCGGTCGCGTCCTCCACCGTCGTCGCCTACGCCATCGACGTCCTGCCCAAGTTCGTCCGCGCCAGGGTCTCCACCGCGGGGGTCGGCGTCACGGCGGGCTACGTCACCATCAAGGGCCACGGCGCCTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
5cbadd903f9b2ea044f8b6f90db6a3c93d5f9a5c9c5ca2dc1e01d24c6bfe17f6
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50