Genbank accession
UTS53887.1 [GenBank]
Protein name
hypothetical protein
RBP type
TF
Evidence RBPdetect2
Probability 0,95
Protein sequence
MYSIKTDLDITGAGTVGKDLLVKGNAVFKNNLTVNGSISFANASFTAIETETANITSTLDVAGKATLSGGLDVKGNTTIGSEDGGSDTATINANATFNGVVSVGGDFTQTAGSTALQETKVKSLEVDEVTTLKGNLTADVGTTAAFDKITANSAEITTMSTTDITSTGTAEFNDVNINGTLGGEFNLSDLNAETLNVTGASNQKGAVTFGANVTGINSTATFKDIRIGSNSESQTFRLSFPYSAPDKRPTVILQNEIQSELMSPAKLTVLTSATFGNASLPTYGITGNGLNKLDYLTVSGNDTQSPDTPLLEVKKGKTKVADFEVTGTATIPNIESTGTANFNNINVSGLLGGEFQLDDINATTLNVSGTTSLVGGVTLGSNITGLNGTATFKSISLGKNSQDPAVKLGFAYTTPEQRPTVILPNEVQSELVSPATLKVLKTATFGNASLSTYGITGNGLNKLDYLTITGNETQDPSTPFLQVGGKAILNDVDFTGKVTGLTVDVSGQDLTPKSVVAAEHVKGATLESTGDTTVGGALTVTGDITGTTATLSGALSAGSVSSGVITGTTSVSAPTISASTEVTAPTITASGTLSGETIKGTNITATSLTAPTISGETTFTENVDITGSLTVGSLDLSAAELNAKSITTTAGATVGGDLVVKGSFDLSEAELNVKSLTTSGVIKSNDSVSENVLPVLKSTTATITTVNADELHVTGQSNLSSVLVGTTLNVSGVTTTPSLVTPNISNEHGITIANNTKVTGDLTVSGAIIPGSIDLTKADVNANSITTTAGATVGGDLTVNGTVDLTNADVTAKSLTSTGAIVSKESSIASVLPKLESTDGTITTLGSTTANITNLKVTGTSTVADMTSSGKVKAVTIETPTISNDDGVSISNDTTITGNLTVSGTVSPGTIDLSQTEVNAKSITTTEGANIGGDLVVSGTVNLSGADVSVKSLTSSGIITVNSKDGINALPKVKSTEITTTTLNATNAVVAGDISAASANITGEMNGISLTLSGEETALTVTNNATIGGALTVGSITSASETVSITKNTAITGDLAVSGTLTAGVIDLSKTDVSVKSLNSLGDATVHGNLTVDGSIDLKSANIVGVTLESTGSTTVGTDLVLTTGNITGNPSISGNMSVAGTTTLTGATTISSTLNTAEKLTVDAGGIKVVSGDVQVDKGSITAPSANISGNSTLNSATVTTTLDVTGEASLNGGLTASTLDVTGDSSVQQLTVKGKFIPEGGLDLSGADLNVNSVSAAKTLSVTGASTLSGGVTTTTINASDKVTAKDLSTGTLEVTTNGTVGGTLGVTGKTTVGSLESGSISATSGTFSSTLDVTGAATFGNNVNITGTLTPGALDLTSTDVVANSLSVAQTLHSDGNATIGGTLDVTGNASASSMTLNGDDIALTVTNNAKVGGKLNVTGTATVGALTSEGSIKTGSSVIIGTQVGEHSETVQIFPNTYIAGSLRVDGGINADIDVSGQTIEPYAVKAANTISAAGNITSGAELISKSATIGDVGSKNNNLTINGNVVNNGDFTVTGILNATLNQSNSDVAVKSLTATNGVAAGTSITAGENITATKLLKGNTLEVMTTGSFGGAVTMSAGANVTGSLTVDGKLTASSITLEDATVTTITTSGAATLASASVTGEATIGGTLTVTGLMTANGSVVLGDSDSDTLTVNATSSFKENAVFDKGVTVTGHLSTTNADFTTTKVTTKKYDVIPNQVTSSVIAPSGTWTPDGTSNVYFITLDQDTTLAPITGLIGGGKASSVYIYVKQDTTGNRNFTTDGTYAVVDGTLNKTANSVTIYQVIYDGVSSVADMFIAQRTA
Physico‐chemical
properties
protein length:1827 AA
molecular weight: 182053,99020 Da
isoelectric point:4,36071
aromaticity:0,02846
hydropathy:0,08889

Domains

Domains [InterPro]
DC_0092
STR
304–595
UTS53887.1
1 1827
Architecture
STR
STR
RBD
STR 1-864 | STR 876-1188 | RBD 1412-1827
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage UE-S1
[NCBI]
2951239 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Escherichia coli
[NCBI]
562 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UTS53887.1 [NCBI]
Genbank nucleotide accession
ON568341 [NCBI]
CDS location
range 268118 -> 273601
strand -
CDS
ATGTACTCAATAAAAACTGACTTAGATATTACTGGTGCTGGCACGGTTGGTAAGGATCTTTTAGTCAAAGGGAATGCTGTATTCAAGAATAACCTAACTGTAAATGGTAGTATATCTTTTGCAAATGCATCTTTTACTGCCATTGAAACAGAAACTGCCAATATTACATCTACATTAGATGTTGCTGGAAAAGCAACACTAAGTGGTGGTCTTGATGTTAAAGGTAACACTACTATCGGTAGTGAAGATGGTGGTTCTGATACAGCAACAATCAATGCAAATGCTACATTTAACGGTGTTGTGTCAGTTGGTGGTGATTTTACACAAACTGCTGGGTCAACAGCACTACAAGAAACTAAAGTAAAAAGCTTAGAAGTTGATGAAGTAACAACACTTAAAGGTAACTTAACTGCTGATGTTGGTACAACTGCTGCTTTTGATAAAATTACTGCTAATTCCGCAGAAATCACAACTATGTCTACAACTGATATTACAAGCACTGGTACTGCTGAATTCAACGATGTAAACATTAATGGTACACTAGGCGGTGAGTTTAATCTTTCTGATTTGAATGCTGAAACATTGAACGTCACTGGTGCATCTAACCAAAAAGGTGCTGTAACTTTTGGTGCTAATGTAACAGGTATTAATAGTACTGCTACATTTAAAGACATCCGTATTGGCTCTAACTCTGAATCACAAACCTTTAGACTAAGCTTTCCTTACAGTGCCCCAGATAAGCGTCCTACTGTAATTCTACAAAACGAAATTCAATCTGAACTAATGTCACCAGCAAAATTGACTGTTTTGACATCTGCAACATTTGGTAATGCATCATTGCCAACCTATGGCATTACTGGTAATGGTCTAAACAAATTAGATTATCTAACTGTTTCTGGTAACGATACTCAATCACCAGACACACCACTTCTAGAAGTAAAAAAAGGTAAAACTAAAGTTGCTGATTTTGAAGTTACTGGTACTGCAACTATCCCAAATATTGAAAGTACTGGCACAGCTAATTTTAATAACATTAATGTTTCTGGTCTTCTTGGTGGCGAATTCCAGTTGGATGATATTAATGCAACCACATTGAATGTATCAGGAACTACTTCATTGGTGGGTGGTGTTACACTAGGTTCTAATATTACTGGTTTAAACGGTACTGCAACTTTCAAATCTATCAGTTTAGGTAAAAATAGTCAAGACCCAGCGGTTAAACTCGGTTTTGCATATACTACACCAGAACAACGACCAACTGTTATTTTACCGAATGAAGTTCAATCTGAGTTGGTTTCTCCAGCTACATTGAAAGTTCTTAAAACTGCAACATTTGGCAATGCATCACTATCAACATATGGTATTACTGGTAATGGTCTAAACAAATTAGATTATCTAACAATTACAGGTAACGAAACACAAGACCCAAGTACACCATTCCTACAAGTTGGTGGTAAGGCAATTCTTAATGATGTTGATTTCACTGGTAAAGTAACTGGTTTAACCGTTGACGTTAGTGGACAAGATTTAACACCAAAATCAGTTGTGGCAGCCGAACATGTCAAAGGTGCAACTTTGGAAAGTACAGGTGATACTACTGTTGGTGGAGCACTAACTGTCACTGGTGATATTACTGGTACAACTGCAACTCTTTCTGGTGCATTATCTGCTGGATCAGTAAGTTCTGGTGTTATTACTGGTACAACTTCGGTTTCCGCACCAACAATTAGTGCATCTACAGAAGTTACCGCACCGACTATTACTGCTAGTGGTACATTAAGTGGTGAAACAATCAAAGGTACTAATATCACTGCGACGAGTTTAACTGCCCCAACGATTAGTGGGGAGACTACCTTTACTGAAAATGTTGATATCACTGGTAGCTTAACTGTTGGTTCACTAGATTTAAGTGCAGCCGAACTTAATGCAAAATCTATTACTACTACTGCTGGTGCAACAGTAGGTGGTGACCTCGTAGTTAAAGGTTCTTTTGATTTATCAGAAGCCGAACTTAATGTTAAATCACTTACTACTTCTGGTGTTATTAAAAGCAATGATAGTGTGTCCGAAAACGTACTCCCAGTACTTAAAAGTACAACTGCAACTATCACAACTGTTAATGCAGATGAACTTCACGTAACTGGACAATCTAATCTATCAAGTGTATTAGTTGGTACAACATTAAATGTATCTGGCGTAACTACTACTCCTTCATTAGTAACTCCTAATATTTCCAATGAACATGGAATTACAATTGCTAATAATACAAAAGTAACTGGTGATCTAACTGTCTCTGGTGCAATCATTCCAGGTTCAATTGATCTAACTAAAGCAGATGTTAATGCTAATTCAATTACTACTACTGCTGGTGCAACAGTTGGGGGAGATCTAACCGTTAATGGAACAGTTGACCTTACTAATGCTGATGTAACTGCAAAATCACTAACCAGCACTGGTGCAATTGTTAGTAAAGAATCTTCTATTGCTAGTGTTCTTCCTAAACTAGAAAGTACTGATGGTACTATTACTACACTTGGTTCAACTACTGCAAATATTACTAATCTAAAGGTTACTGGTACATCAACTGTTGCTGATATGACTTCTTCAGGTAAAGTTAAAGCTGTTACTATTGAAACCCCAACAATTAGTAATGATGATGGTGTATCTATTTCTAATGATACCACCATTACTGGTAATCTTACTGTTTCTGGAACTGTATCACCTGGTACAATTGATTTGAGCCAAACTGAAGTTAATGCAAAATCAATCACTACAACAGAAGGTGCTAATATTGGTGGCGATCTAGTTGTTTCTGGAACAGTTAACTTAAGTGGTGCAGATGTTTCTGTTAAATCGCTAACAAGTTCTGGTATTATTACAGTTAATAGTAAAGATGGTATCAACGCACTTCCTAAAGTAAAAAGTACTGAAATTACTACAACAACTCTAAACGCAACAAATGCGGTAGTTGCTGGCGATATTTCTGCGGCATCTGCAAATATTACTGGTGAAATGAATGGTATTTCTTTAACACTATCTGGTGAAGAAACAGCGTTAACTGTAACTAACAATGCAACCATTGGTGGTGCACTTACTGTTGGCTCAATTACGTCAGCATCAGAAACTGTATCTATTACTAAAAATACAGCAATTACTGGTGATTTGGCAGTATCTGGAACACTTACTGCTGGTGTAATTGACCTTAGTAAAACTGATGTTTCTGTGAAATCATTAAATTCACTCGGTGATGCAACAGTACATGGTAACTTGACTGTTGATGGCTCCATTGACCTTAAATCTGCAAATATTGTCGGTGTAACATTAGAAAGTACTGGTTCCACTACTGTAGGTACTGACTTGGTTCTAACTACTGGTAACATTACAGGTAATCCATCTATCTCTGGAAACATGAGTGTTGCAGGAACCACAACCTTAACTGGTGCAACAACAATTTCAAGTACTTTGAACACTGCCGAAAAACTAACAGTTGATGCTGGTGGTATTAAAGTTGTTTCTGGTGATGTACAAGTTGATAAAGGTTCAATCACTGCACCAAGTGCTAATATTTCCGGTAACTCCACTCTTAACAGTGCGACTGTAACAACTACCCTAGATGTTACTGGGGAAGCAAGCCTGAATGGTGGTCTAACTGCTTCTACACTGGATGTTACTGGTGACAGTTCTGTTCAACAACTAACCGTTAAGGGTAAATTTATTCCTGAAGGTGGTTTAGACCTATCTGGTGCAGATCTTAACGTAAACAGCGTTAGTGCAGCTAAAACACTCAGTGTTACTGGTGCAAGCACCCTAAGTGGTGGTGTTACAACAACAACTATTAACGCATCTGACAAAGTTACAGCGAAAGATCTAAGTACTGGAACATTAGAAGTTACAACAAATGGAACAGTTGGTGGTACACTAGGTGTAACTGGAAAAACTACTGTTGGTTCACTAGAATCTGGTTCAATCTCTGCAACTTCTGGTACATTTAGCTCTACCCTAGATGTTACTGGGGCAGCAACATTTGGTAATAATGTTAACATTACTGGTACATTAACACCGGGTGCATTGGATTTGACCAGTACTGATGTGGTTGCAAACAGTCTTTCTGTTGCACAAACTCTACATTCTGATGGCAATGCAACTATTGGTGGTACACTCGATGTTACTGGAAACGCATCTGCATCATCAATGACTCTTAATGGTGATGATATAGCGTTAACAGTAACTAATAACGCTAAAGTTGGTGGCAAACTAAACGTTACTGGCACAGCAACAGTGGGAGCACTAACATCTGAAGGTTCAATAAAAACTGGTTCATCTGTTATTATTGGTACACAGGTTGGTGAACACTCAGAAACTGTTCAAATTTTCCCTAATACTTACATTGCTGGTTCTTTACGTGTTGATGGTGGTATTAATGCTGATATCGATGTTAGTGGTCAAACTATTGAACCTTATGCAGTTAAGGCAGCTAACACTATTAGTGCCGCAGGTAACATTACATCTGGTGCAGAATTGATTTCTAAATCAGCAACCATCGGTGATGTTGGTTCTAAAAACAATAACTTAACAATCAACGGTAACGTAGTTAACAACGGTGACTTCACTGTAACTGGCATTCTAAACGCAACACTAAACCAATCAAACTCTGACGTGGCTGTTAAATCATTAACTGCAACCAATGGTGTTGCTGCTGGTACTAGTATTACTGCTGGTGAAAATATAACTGCAACTAAATTACTTAAAGGAAATACCCTTGAAGTCATGACCACTGGTTCATTTGGTGGAGCAGTAACTATGTCGGCTGGTGCGAATGTTACTGGTAGCCTAACGGTTGATGGAAAATTAACTGCATCAAGTATTACACTTGAAGACGCTACTGTTACCACCATTACAACATCTGGTGCAGCTACACTTGCTAGTGCATCTGTAACTGGTGAAGCTACAATCGGCGGTACACTAACTGTTACTGGTTTAATGACAGCAAATGGTAGTGTTGTGTTAGGTGATTCTGATTCTGATACATTAACTGTTAATGCAACATCTTCTTTCAAAGAAAATGCAGTATTTGACAAGGGTGTAACTGTCACAGGTCATTTATCTACAACCAACGCAGACTTCACTACAACAAAAGTAACTACCAAAAAATATGATGTTATACCAAATCAAGTAACTTCTTCTGTTATTGCACCTTCTGGAACTTGGACACCTGACGGAACTAGCAACGTATACTTCATCACACTTGATCAAGATACAACACTAGCACCTATCACTGGTCTAATTGGTGGTGGTAAAGCATCTTCAGTATACATTTATGTTAAACAAGATACAACAGGTAATAGAAACTTTACTACCGATGGTACATATGCTGTAGTTGATGGAACACTTAACAAAACTGCAAACTCTGTAACTATCTATCAAGTAATTTATGATGGTGTAAGTTCAGTAGCAGATATGTTTATTGCTCAACGTACTGCTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
cbbe7c1f42ddc8dd422858d5c69b4168fe87ad96c7344a6136827571c4e6003b
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,5145
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequence of UE-S1 bacteriophage infecting Escherichia coli Niaz,H., Masood,S., Khizar,A., Abbas,A. and Adnan,F. 2025-12-11 — GenBank