UniProt accession
A0A2Z4QHN9 [UniProt]
Protein name
Uncharacterized protein
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
Protein sequence
MGLFSTKYIINVSSTAYNMAGDENDRPNFIKGSIFGSIISDSPSLADDLIGSHFNGPGMKQRQFFRYANQKNLSGMPSATILNNVSIDISVVEGEITVSPSPAGLILTAFSAEVNDGDPQIWIEKWILENHPTRIDEAWVGDYSPDTDAFSVEFPNNDFFSWANDGTFGPVFDTGKRYIVAKYIETLEDSEDAVVEGTPTTGVLTLPDLTNFTQESDTETFTPVTLQRTRTTIYSYNNGDPDETFEDAVDADVSANLSTAEEVWKKEIIVDSSGIQVHGQRQWWYLTGTDTVGTGYVDVVVTETDLGGGVIRTETATTTGEQVVPSWTTQYDTQEIYSGEVVGNEQVFIYEVGTGNATLDALVDEVDASSFQEFFPFMPIRINNVSITDDIYANVDNTATETDPELINSPPYGNGLYPEMSKAYRRAYQNKSFAALVDKVEDNESIDDIDYAYLMWGCSLNTKENACKKYIYKFFEQMATFQVAGSSGVMADMQAQVDAYDAALTAINDWESTLSSTYDELWDTLPPKPTLPKITPPATNTIRLNDDTLGFDIRLQWIDVTVEQFAGTYDSETGALEAPGKNDLEFAVGADFTWTERQTYNDRDGGYTQNFQRSIPSMVIYWQVSVDDPSVGTTAAYRKMTIWGLTHYNYIYGGKAVVITSKEALEDTDESGFIVPLHYPTMSEMGIVDYTQMSTANAWILFNSYTITKQRWYQRGIFKILLVILIIVIAVVAFPGAFAAGGGILGGNLAVGAALGLTGTAALVAGVVANYIASMIISQLLSIVGTALFGEKWGAVFAAIAGFALGAAISGVNIFSAEGLLGLGNAIANGYAGWVQGDIAEMQQDLEADREAYEEEMDRIQELLDALGGNDLNFNPIFLTDYGKRGNGRGTKGYIPETADEFIRRTTMTGSDIVELTHAMVYDFVPVQTTLPRN
Physico‐chemical
properties
protein length:934 AA
molecular weight: 102400,70130 Da
isoelectric point:4,16666
aromaticity:0,11135
hydropathy:-0,14507

Domains

Domains [InterPro]
DC_2139
STR
1–934
Coil
Unmapped
839–870
A0A2Z4QHN9
1 934
Architecture
STR
STR 1-934
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Ruegeria phage vB_RpoP-V13
[NCBI]
2218612 Uroviricota > Caudoviricetes > Schitoviridae > Pomeroyivirus > Pomeroyivirus V13
Host Ruegeria pomeroyi DSS-3
[NCBI]
246200 Bacteria > Proteobacteria > Alphaproteobacteria > Rhodobacterales > Rhodobacteraceae > Ruegeria

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AWY09414.1 [NCBI]
Genbank nucleotide accession
MH015256 [NCBI]
CDS location
range 53577 -> 56381
strand -
CDS
ATGGGTCTGTTCTCCACCAAGTACATCATCAACGTCTCCAGCACTGCTTACAACATGGCTGGAGACGAAAATGATCGTCCCAACTTCATCAAGGGAAGCATCTTCGGGTCTATCATCTCTGATAGTCCCTCGCTTGCTGATGACCTGATTGGTTCCCACTTTAATGGTCCGGGGATGAAACAGCGTCAGTTCTTCCGGTATGCAAACCAGAAGAACCTCTCTGGGATGCCTTCTGCAACGATCCTGAACAACGTATCCATCGACATCTCTGTGGTGGAAGGGGAGATCACTGTCTCTCCTTCTCCTGCTGGTTTGATCCTCACTGCATTCTCTGCTGAAGTGAATGATGGAGATCCTCAGATCTGGATCGAAAAATGGATCCTCGAAAACCATCCAACTCGAATTGATGAAGCATGGGTCGGAGATTACTCTCCTGATACTGATGCTTTTTCTGTGGAGTTTCCAAACAATGACTTCTTCTCGTGGGCCAATGATGGGACTTTTGGTCCTGTTTTTGACACTGGGAAACGGTATATTGTGGCCAAGTACATCGAAACTCTCGAAGACTCTGAAGATGCTGTCGTTGAAGGAACTCCTACGACTGGGGTTCTTACTCTTCCTGATTTGACGAATTTTACTCAGGAATCAGATACTGAGACATTCACTCCGGTAACTCTTCAACGTACCCGAACTACAATCTACAGCTACAATAACGGGGATCCTGATGAGACCTTTGAAGATGCTGTGGATGCGGATGTTTCTGCAAACCTGTCCACTGCTGAAGAGGTCTGGAAGAAAGAGATCATCGTCGATTCTTCCGGGATTCAAGTCCATGGGCAACGCCAATGGTGGTATCTTACCGGGACTGACACGGTTGGAACCGGGTATGTTGATGTGGTGGTCACAGAGACAGATCTGGGAGGAGGAGTGATCCGCACGGAAACTGCAACCACCACAGGAGAACAGGTGGTTCCGAGTTGGACAACCCAGTATGACACACAGGAGATTTACTCCGGTGAAGTCGTTGGGAACGAACAGGTTTTCATCTATGAGGTGGGGACTGGGAATGCGACTCTCGATGCTTTGGTCGATGAAGTGGATGCTTCGTCGTTCCAAGAGTTCTTTCCGTTCATGCCAATCCGGATCAACAACGTCTCGATCACTGATGACATCTACGCAAACGTGGACAACACAGCCACTGAAACTGATCCTGAATTGATCAACAGTCCTCCCTATGGGAACGGATTGTATCCTGAGATGTCGAAAGCCTATCGACGGGCTTACCAGAACAAGAGCTTTGCTGCTCTGGTGGACAAGGTTGAGGACAATGAGTCCATCGACGACATCGACTATGCCTATCTGATGTGGGGCTGTTCTCTGAACACCAAGGAGAATGCCTGCAAGAAGTACATCTACAAGTTCTTCGAACAGATGGCGACGTTTCAGGTTGCTGGTTCGTCTGGTGTGATGGCTGACATGCAGGCACAAGTTGATGCCTATGATGCTGCTCTGACTGCTATCAATGATTGGGAATCGACTCTCAGTTCTACCTATGATGAATTGTGGGATACCCTTCCACCAAAACCAACTCTTCCGAAGATCACACCTCCGGCTACGAACACCATTCGTCTGAATGATGATACTCTTGGTTTCGACATTCGGTTGCAGTGGATTGATGTGACTGTGGAACAGTTCGCTGGAACCTATGATTCTGAAACTGGAGCATTGGAAGCTCCGGGAAAGAACGATTTGGAATTCGCAGTCGGTGCTGATTTCACATGGACTGAACGTCAAACCTATAATGATCGGGATGGTGGATATACTCAGAATTTCCAGCGTTCCATTCCTTCGATGGTGATCTACTGGCAGGTGTCAGTGGATGATCCCTCTGTGGGAACAACTGCTGCGTACCGAAAGATGACCATCTGGGGTTTGACCCATTACAACTACATCTATGGAGGCAAAGCCGTCGTCATCACTTCCAAGGAAGCTCTTGAAGATACTGATGAATCTGGTTTCATTGTGCCTTTGCATTACCCCACCATGAGTGAAATGGGGATTGTGGACTATACTCAGATGTCCACTGCAAACGCATGGATCCTGTTCAACAGCTATACTATCACCAAACAACGCTGGTATCAGCGAGGTATCTTCAAGATTCTCTTGGTCATTCTCATCATTGTGATCGCAGTTGTTGCGTTCCCCGGAGCGTTCGCCGCAGGAGGAGGCATACTAGGTGGAAACCTTGCCGTTGGTGCTGCCTTGGGTCTCACAGGCACGGCTGCCTTGGTCGCAGGGGTCGTTGCCAACTATATCGCGTCCATGATCATCTCTCAGCTTCTGAGCATTGTGGGGACTGCTTTGTTCGGTGAGAAATGGGGTGCTGTGTTTGCTGCTATCGCTGGTTTCGCTCTGGGTGCTGCAATCTCTGGGGTCAATATCTTCAGTGCTGAAGGTCTTCTTGGCCTTGGGAATGCCATTGCCAATGGTTATGCTGGTTGGGTACAAGGGGACATTGCAGAAATGCAGCAAGATCTGGAGGCTGATAGGGAAGCCTACGAGGAAGAAATGGATCGAATTCAGGAGCTTCTTGATGCTCTTGGTGGAAACGATTTGAATTTCAACCCGATTTTCCTTACAGACTACGGTAAGCGAGGCAATGGACGAGGCACGAAAGGGTATATCCCTGAAACTGCTGATGAGTTTATCCGACGAACCACAATGACAGGATCCGACATCGTGGAGCTAACCCACGCCATGGTCTACGATTTTGTCCCCGTTCAAACCACATTGCCGAGGAACTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
b30419ac5c903826a9953012926ec45f16ded6a503e971659bb3f755b0ade220
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4663
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50