Genbank accession
UIS74194.1 [GenBank]
Protein name
tail fiber
RBP type
TF
Evidence GenBank
Probability 1,00
Protein sequence
MTDKLIRELLIDVKQKGATRTAKSIENVSDALENAAAASELTNEQLGKMPKTLYSIERAADRAAKSLTKMQASRGMLSVTKSINDIGTKLDDLAITMIEVADKLEVGFDGVSRSVKTMGNDVAAATEKVQDRLYDTNRALGGTARGFNDTAGAAGRASRAIGNTSGSARGATRDFAAMAKIGGSLPIMYAALASNIFVLQSAFEQLKLGDQLNRLEKFGVIVGTQTGTPVQTLARSLQEAAGYAISFEEAMRQASSASAYGFDAEQLNKFGLVARRAAAVLGVDMTDALNRVIKGVSKQEIELLDELGVTIRLNDAYADYVKQLNAANTGITYNVNSLTTFQKQQAYANAVIAESTKRFGYLDEVLRATPWEQFAANADAALRKIQQAAAKYLGPVIDAINTVFYTSQASISAEAARAQEKTNRQIDPTNVGAVALSLAASEEGYNKALDMYKESLDKRNKLKSEFDKRMEQADFYTKLAIRQVGEGIPVGLAAAGASEANKKFVEETAAMGLQVTRLGKEVEDSTENLNAWKSAYQAAGAAAAKANPEFQKQINLQRDTTDPDAVYDFNSTVLKGLTEQQKAYNQTKKTASDLANDIQNVAQNTDTAAKTSATLADAIKNIESLSLGTGKSADEYVKNLNLGYNTLSEMKTASQALSEYVKLTGNETKNQLAVQQKIADVYNQTKDKEKAQEAGRRLELQQLEEQEAALRRVLQTNQGNKAVEKEIEKIQLEKLKLTNQGMEAQKKVKDYTDKILGVDREIALLNNRTMTDTQYRLAQLNLELTIEKEKYEWYTKQADKQKEAEQSRRSQAQIEREIWKFRQNQQAEMTSKRQEAFENTLTSMFPLAGEMQKMEMQLDFYTQMKELTKGNANEQMRWNAEIAKTRAQMSALTAQRNAQMQQQVGSSVGATYTPTTGLSGADKDFADMQNRMSSYDQAISKLSELNSEATAVAQSMGNLTNSMIQFSQGSLDTTSMIASGMQTVASMIQYSTSQQVSAIDQAIAAEQKRDGKSEASKAKLKKLEAEKLKIQQDAAKKQIIIQTAVAVMQAATAVPYPFSIPLMVAAGLAGALALAQASSASGMSSIADSGADTTSYLTLGERQKNIDVSMSANAGELSYIRGDKGIGGANSFVPRAEGGNMYPGVSYQMGEHGTEVVTPMVPMKATPNDELKTSSNSTSGRPIILNISAMDAASFREFASSNSSALRDAVELALNENGASLKTLGNS
Physico‐chemical
properties
protein length:1227 AA
molecular weight: 132936,05680 Da
isoelectric point:5,92714
aromaticity:0,05542
hydropathy:-0,44165

Domains

Domains [InterPro]
Coil
Unmapped
686–745
UIS74194.1
1 1227
Architecture
TAS
STR
TAS
TAS 1-81 | STR 82-1189 | TAS 1190-1225 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage EC100
[NCBI]
2894397 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Escherichia coli
[NCBI]
562 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
UIS74194.1 [NCBI]
Genbank nucleotide accession
OK665835.1 [NCBI]
CDS location
range 89956 -> 93639
strand -
CDS
ATGACTGATAAGCTAATACGAGAATTACTAATAGACGTTAAACAGAAGGGGGCAACTCGTACTGCAAAGTCTATTGAAAACGTATCTGATGCATTAGAGAATGCTGCTGCGGCTTCTGAGCTAACGAATGAACAGTTAGGTAAAATGCCCAAAACTCTATACTCCATTGAGAGGGCAGCAGATAGAGCAGCAAAAAGTCTTACTAAAATGCAAGCTAGTAGGGGTATGCTTAGTGTTACTAAATCTATTAATGATATAGGAACTAAGCTGGACGACCTTGCTATTACAATGATAGAGGTAGCTGATAAGCTAGAAGTTGGATTCGATGGGGTTTCTAGATCTGTTAAAACAATGGGCAATGATGTTGCAGCTGCAACAGAGAAAGTTCAAGATAGGTTATATGATACTAATAGAGCATTAGGTGGCACAGCTAGGGGTTTTAATGACACTGCTGGTGCCGCTGGTAGAGCTTCTAGAGCTATTGGTAATACTTCTGGTTCAGCACGTGGTGCAACTCGTGATTTTGCAGCAATGGCTAAGATAGGTGGTAGTTTACCTATTATGTACGCAGCTCTTGCTTCCAACATCTTCGTTTTGCAATCAGCGTTCGAACAACTTAAACTAGGTGACCAGCTAAATCGTCTAGAAAAATTTGGTGTTATAGTAGGTACTCAGACAGGTACTCCTGTTCAGACCCTTGCTAGATCACTACAAGAAGCTGCTGGATATGCTATTTCTTTTGAGGAAGCAATGAGACAGGCATCTTCAGCATCTGCTTATGGATTTGATGCCGAACAACTTAATAAATTTGGTTTAGTAGCTCGTCGTGCTGCTGCTGTTCTTGGTGTTGATATGACTGATGCACTTAACCGTGTAATTAAGGGCGTATCTAAACAAGAAATCGAACTTCTGGATGAACTTGGTGTCACCATCCGTCTTAATGACGCATACGCCGATTATGTTAAACAGTTAAATGCTGCAAACACAGGTATAACATATAATGTTAATAGTCTTACCACTTTCCAGAAACAACAAGCATACGCTAACGCGGTAATTGCTGAATCTACTAAGAGGTTTGGCTACCTAGATGAAGTACTACGTGCAACTCCATGGGAGCAATTTGCTGCTAATGCAGATGCCGCCCTGAGAAAGATTCAGCAGGCTGCTGCTAAGTATTTAGGGCCAGTAATTGATGCTATCAATACTGTATTCTACACTTCTCAGGCTTCGATATCTGCTGAGGCAGCTAGAGCGCAAGAAAAAACTAATAGACAGATAGATCCTACCAACGTTGGTGCTGTTGCTTTAAGTTTGGCTGCTTCTGAAGAAGGCTATAATAAAGCTCTAGATATGTATAAGGAATCTCTTGATAAGCGTAATAAGCTAAAATCTGAGTTCGACAAACGAATGGAACAAGCAGATTTCTATACAAAACTAGCCATACGTCAAGTTGGTGAAGGTATTCCTGTTGGTCTTGCTGCTGCTGGTGCTTCCGAAGCTAATAAAAAGTTCGTAGAAGAAACTGCGGCTATGGGTCTACAAGTAACCAGACTAGGTAAGGAAGTAGAAGATTCTACTGAAAACCTTAATGCTTGGAAGTCAGCCTATCAAGCTGCGGGTGCTGCTGCTGCAAAAGCTAATCCAGAGTTTCAGAAACAGATTAATCTACAGAGAGATACTACTGATCCTGATGCTGTATACGATTTTAACTCTACTGTATTAAAAGGACTAACTGAGCAGCAGAAAGCGTACAATCAGACTAAGAAAACGGCTAGTGACTTAGCTAATGACATACAGAACGTTGCTCAGAATACAGATACTGCTGCTAAAACTAGTGCTACTTTAGCAGATGCTATAAAAAATATAGAATCTCTATCTCTAGGTACTGGTAAAAGTGCAGATGAGTACGTTAAAAATCTTAACCTAGGCTATAACACTCTGTCTGAAATGAAAACTGCGTCTCAGGCCTTATCTGAGTATGTTAAACTAACCGGTAATGAAACTAAAAATCAGTTAGCAGTTCAACAGAAGATAGCTGATGTATATAACCAAACTAAGGATAAAGAAAAAGCACAGGAAGCCGGTAGGCGTTTAGAACTCCAACAGTTAGAAGAGCAAGAAGCTGCTTTACGCCGTGTTCTTCAAACAAACCAGGGAAATAAAGCTGTTGAGAAAGAAATTGAAAAAATTCAGCTGGAGAAACTTAAACTTACCAATCAGGGTATGGAAGCTCAGAAGAAGGTCAAGGATTACACAGATAAAATTCTTGGTGTAGATCGTGAGATAGCTCTCTTAAATAACCGTACTATGACAGATACTCAGTATCGTCTAGCACAGTTAAATCTTGAATTGACCATTGAAAAAGAGAAGTACGAATGGTATACAAAACAAGCGGACAAACAGAAAGAGGCTGAACAGTCTAGACGTTCTCAAGCCCAAATTGAACGTGAAATATGGAAATTCCGTCAGAACCAGCAAGCTGAAATGACCAGTAAAAGGCAAGAAGCCTTTGAAAATACTCTAACTTCCATGTTCCCTCTGGCAGGGGAAATGCAAAAAATGGAAATGCAGTTAGATTTTTATACTCAGATGAAAGAACTTACCAAAGGTAACGCTAATGAGCAAATGCGTTGGAATGCTGAAATAGCTAAGACAAGGGCTCAGATGTCAGCTTTAACAGCACAACGTAATGCTCAGATGCAGCAACAGGTAGGTTCTTCTGTTGGAGCTACTTATACTCCTACAACTGGCCTATCTGGAGCAGATAAAGATTTTGCTGATATGCAGAATAGGATGTCTTCGTATGACCAAGCAATTTCTAAACTATCTGAGTTAAATTCCGAAGCAACTGCTGTAGCTCAAAGCATGGGTAATTTAACTAACTCTATGATTCAGTTCTCCCAGGGATCCCTAGATACTACGTCTATGATTGCTTCTGGTATGCAGACTGTAGCCTCGATGATTCAATATAGTACTAGCCAACAAGTTAGTGCAATTGATCAGGCTATTGCAGCAGAACAGAAACGTGATGGTAAATCAGAAGCATCTAAAGCTAAGTTGAAGAAGTTGGAAGCTGAAAAGCTGAAGATTCAACAAGACGCAGCTAAGAAGCAGATTATCATCCAAACTGCAGTAGCTGTAATGCAAGCGGCAACAGCTGTACCATACCCGTTCTCTATTCCTTTAATGGTTGCGGCAGGTTTAGCGGGTGCATTGGCGTTAGCACAAGCATCTTCTGCATCTGGCATGTCTTCTATTGCAGATTCTGGGGCGGATACAACTAGTTATTTAACCTTAGGAGAACGTCAGAAGAATATAGATGTGTCCATGTCTGCTAATGCTGGTGAATTATCTTATATTCGTGGCGATAAAGGCATAGGCGGTGCTAACTCTTTCGTTCCTCGTGCTGAGGGTGGTAATATGTACCCTGGGGTTAGCTATCAAATGGGTGAGCATGGTACAGAAGTAGTTACCCCTATGGTTCCTATGAAAGCTACACCTAATGATGAGTTAAAAACCTCATCTAACTCAACTTCAGGAAGACCTATCATCTTGAATATTAGTGCTATGGATGCTGCAAGTTTTAGAGAGTTTGCTTCTAGTAATAGTAGTGCTCTAAGAGACGCAGTAGAATTAGCTCTGAATGAGAACGGTGCTAGTCTGAAAACATTAGGAAATTCTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
67b557f7c15da418a13261467e29620434d7f9b1c528fc47e353f1fc3820eccd
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6134
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequences of 17 Escherichia coli bacteriophages isolated from wastewater, pond water, cow manure and bird feces Vitt,A.R., Ahern,S.J., Gambino,M., Holst Sorensen,M.C. and Brondsted,L. 2022-10-20 — GenBank