UniProt accession
A0A023MI25 [UniProt]
Protein name
Putative tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,85
Protein sequence
MADIKVVRIESLPATTAVTEDDYLVVQQPDLTRRVKIGDVVHVDGTVSHVISFKEGGKLNGPMDFAYFEEEDLYLRWKGEFPHTVPALSSPYSDGGITDAAWMVYTDPSLREELESTIGASMIMTAEGQSVQDVMDVTVQTANDAKALAQRVDFGTVHTVGDVIHLDNFVGPAVIEEGRTTNYPSVAAGEKFLNGVVSRRDTTTVDGIFRGATSGAMYTIAVTNGVATTKRIALRDEFKRLEANTPTRTVIRAGDDLNTAGYLQLDATGRWGMWNQQTASWQPLAIEQGGTGARDAAGARINLGAFYKQRAALESNFNINNLTGNQDGVYYQPMTAYATEANGYPAGSGAGHLIVWQNNANGGTGCRQEYYPFSNVDVWYLRTYQANTNQWTAWQPMVRPRNDDTFRSHIGLGSRNSPTFGHLYLSQSSADVKSASGIVNGDKYSADGVLEHGYRIYSEVRNDNKAWLTIHLHKGAKGSETHRYLGFREDGVLDCPKYMQVGDLTGQLTNWGLGEWIRSSGAERGFWGSKKAAKMVIWDGGMDESGNGALEWGVYNNRKAKWEPLPQAAGGTGATTLADAQNLFKVPIAAGVKDFLTLPRTAGMEDGKYYPIIVRTDPYYAPSTGTDITIVTRSSSGNDPMNCATLQCHYRTGGWTDRGDSFYGVVNFYQNEKALLGMVAPTRGKQEYVAFYAEARAFPVSIYASRNVVEVFTREQDYQVGSVTNNQDGVKFVAPLQSADLNLAILGDNNTNTRPIVDFKGTSGFYTGGGTQWHYIGSAERYAVMSKMNMPKVELWADGLDYLCYGSPRKALFSNAGFQCASDGTEDLTNGTFTSKCGNGAGLKGQAEFRSTPEAGQVIVRDVVGTAHRFYNFNKDGTFSAPGGFVCHTGADWNNQFGNNNPSKIMAGNVNGPEGSMVVGGLSVAFSGNYAFQIAGRLDQLYTRSIEQGNHRAWNKVIQHRGQGLGNSDLNDYKADREGIYHQEANANATAERHYPPGQQMAGTLIVLRNSANEGTGCIQIYKMYLGGTWERYYNNTGSGMAWSPWKRTSFPESTTAPVMPDLWLPLTSNLKPALGEGEMVFSRPSTATYFTKRGVMAVAQANQPRFERDGLLIEGQRTNLMLNSEDPSKWGAQQAITVGSTVTNTNGTKGARFTVNTTSGVETTALNLATVPATRGADVTGAEKFCTGSIIARGGKAHQRLRVRFDMYNGSTTVFQGDAYVNLSTLEVKTTGDAAGRIKVKAERWQTAGPAWIRIAATFEAVASDNKIGCQFQIAPPEGAQHAVGDWVDVAIPQFELGSCESSFIPTGSSPVTRAADLCKFPMTDNLAPRPFTIAATVDANWRGWGKAPNAAPRVIDTEGHQSGASFIMGFGSATNIAEDGYPYCDIGGSNRRVYEMAKARKLKIGFRIKDDGKTCSFANGLVSTETQSSWEFLAGGAFIRIGGQTATGERHLFGHIKDIRVWNSALTDTQLMMESVE
Physico‐chemical
properties
protein length:1479 AA
molecular weight: 160837,60640 Da
isoelectric point:6,14733
aromaticity:0,09939
hydropathy:-0,38925

Domains

Domains [InterPro]
IPR040775
RBD
46–103
G3DSA:2.10.10.80
ATT
47–117
A0A023MI25
1 1479
Architecture
ATT
STR
ATT 1-448 | STR 623-1479
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
A0A023MI25
1 1479
Domain Start End Length (AA) Confidence
N-terminal 1 574 574 0,4369
Central domain 575 773 200 0,3247
C-terminal 774 1479 705 0,8387
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-574
Central
575-773
C-terminal
774-1479

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage FFH2
[NCBI]
1446490 Uroviricota > Caudoviricetes > Vequintavirinae > Vequintavirus PDX > Vequintavirus FFH2
Host Escherichia coli O157:H7
[NCBI]
83334 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Escherichia

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AHN83629.1 [NCBI]
Genbank nucleotide accession
KJ190158 [NCBI]
CDS location
range 34806 -> 39245
strand -
CDS
ATGGCTGATATTAAAGTTGTCAGAATCGAATCTCTTCCTGCCACTACCGCAGTGACAGAGGATGATTACCTGGTTGTTCAACAACCAGACCTGACCCGTCGTGTAAAAATTGGCGATGTTGTCCATGTGGATGGGACTGTTTCTCATGTAATCTCCTTTAAGGAAGGTGGTAAGTTAAACGGCCCAATGGATTTTGCCTATTTCGAAGAGGAAGATCTCTACCTGCGTTGGAAAGGCGAATTTCCACACACTGTTCCTGCACTATCTTCACCGTACTCCGATGGTGGGATTACTGACGCTGCATGGATGGTATATACTGACCCGTCCCTAAGGGAGGAGCTGGAATCTACCATTGGCGCATCTATGATCATGACAGCCGAAGGGCAGTCTGTCCAGGATGTAATGGATGTTACTGTTCAGACAGCTAACGATGCTAAAGCACTTGCACAGCGTGTAGATTTTGGTACGGTGCACACTGTAGGTGATGTTATTCACCTTGATAACTTTGTGGGTCCTGCAGTTATTGAAGAGGGAAGAACCACCAACTACCCTTCTGTAGCAGCTGGTGAAAAATTTCTGAACGGTGTGGTATCTCGTCGTGATACTACAACTGTTGATGGTATTTTCCGTGGCGCTACATCCGGAGCCATGTATACCATTGCAGTAACCAACGGTGTAGCAACAACAAAAAGAATAGCACTTCGTGATGAATTTAAACGCCTGGAGGCAAACACCCCAACAAGAACAGTTATCCGTGCTGGAGATGATTTAAACACGGCAGGGTACTTGCAGCTTGACGCAACAGGCCGTTGGGGCATGTGGAACCAACAAACAGCCTCGTGGCAGCCTCTTGCTATAGAGCAAGGCGGTACGGGGGCCAGAGATGCCGCAGGTGCACGCATTAACTTAGGGGCTTTCTATAAGCAACGTGCAGCTCTTGAGTCAAATTTCAATATCAATAACTTGACTGGTAATCAGGATGGTGTATACTACCAGCCGATGACTGCTTATGCAACTGAGGCAAATGGTTACCCTGCAGGTTCTGGTGCTGGTCACTTGATTGTTTGGCAGAACAATGCTAACGGCGGTACAGGTTGTCGTCAGGAATACTATCCATTCTCTAACGTGGATGTTTGGTATTTGAGAACCTATCAGGCCAACACAAACCAGTGGACTGCATGGCAGCCAATGGTCAGACCTCGTAACGATGATACCTTTAGATCGCACATCGGTCTCGGGTCTAGAAACTCCCCTACCTTCGGGCACCTTTACCTGTCTCAAAGTTCTGCTGATGTTAAGTCAGCATCAGGTATTGTTAACGGGGACAAATACAGCGCTGACGGTGTCCTTGAGCATGGATATAGGATCTACTCTGAGGTAAGAAACGACAATAAGGCTTGGTTGACAATCCACCTGCACAAAGGTGCAAAAGGATCTGAAACCCATAGATATTTAGGTTTCCGCGAAGACGGCGTGTTAGACTGTCCTAAATACATGCAGGTTGGGGATCTTACTGGTCAGCTGACAAACTGGGGACTTGGAGAGTGGATTCGTAGTTCAGGAGCAGAAAGAGGCTTCTGGGGGTCCAAGAAAGCCGCCAAGATGGTTATCTGGGATGGTGGGATGGACGAATCCGGTAACGGCGCTCTGGAATGGGGTGTTTATAACAACCGGAAGGCCAAGTGGGAACCTCTACCTCAAGCCGCAGGTGGCACCGGGGCTACAACTTTAGCAGATGCTCAGAATCTGTTCAAAGTTCCTATAGCAGCAGGTGTAAAAGACTTCTTAACACTGCCAAGAACTGCAGGAATGGAAGATGGGAAATACTACCCAATCATCGTTAGAACAGATCCGTATTACGCCCCTTCGACAGGTACAGATATTACTATAGTCACCAGGTCTTCATCTGGAAATGACCCTATGAACTGTGCCACCCTGCAGTGTCACTATAGAACTGGCGGCTGGACGGACAGGGGAGACTCTTTCTACGGGGTAGTAAATTTCTACCAGAATGAAAAAGCACTTCTTGGGATGGTTGCTCCAACAAGGGGTAAACAAGAGTATGTTGCTTTCTATGCAGAGGCTCGTGCTTTCCCTGTCAGCATATACGCAAGTAGAAATGTTGTCGAAGTGTTTACCAGAGAGCAAGATTATCAAGTCGGCTCTGTAACAAACAATCAGGATGGGGTTAAGTTCGTTGCACCTCTTCAATCAGCAGATTTGAATCTTGCTATTCTTGGAGATAACAACACCAATACCAGACCTATTGTTGACTTCAAAGGTACTTCAGGATTCTACACTGGTGGCGGCACACAGTGGCACTATATAGGTTCTGCTGAACGCTATGCTGTGATGAGCAAAATGAATATGCCAAAAGTCGAGCTATGGGCAGACGGTCTTGACTATTTGTGCTACGGCAGTCCTAGAAAGGCGTTATTCTCTAATGCAGGATTCCAGTGTGCATCCGATGGGACAGAGGATCTGACTAACGGTACGTTTACCTCTAAATGCGGTAATGGTGCTGGTCTCAAAGGTCAGGCAGAGTTCAGATCTACTCCGGAAGCGGGTCAAGTTATTGTTCGCGATGTTGTAGGCACAGCTCATAGATTCTACAACTTCAACAAGGATGGTACTTTCTCAGCACCGGGTGGTTTTGTATGCCACACAGGTGCAGACTGGAACAACCAGTTCGGGAATAACAACCCTTCTAAAATAATGGCTGGTAATGTTAACGGGCCTGAAGGTTCGATGGTTGTTGGCGGGTTGTCTGTGGCATTCTCTGGGAACTATGCTTTCCAGATAGCAGGTCGCTTAGATCAGCTGTATACTCGTTCCATAGAGCAGGGAAATCACAGAGCGTGGAACAAGGTTATTCAGCACCGTGGTCAAGGACTGGGGAATAGCGACCTTAACGATTATAAAGCAGATCGTGAAGGTATCTACCATCAAGAGGCGAATGCTAATGCTACAGCTGAAAGACATTACCCGCCTGGACAGCAGATGGCTGGTACGCTAATTGTGCTTAGAAACTCTGCTAACGAAGGCACGGGCTGTATTCAGATCTATAAGATGTACCTTGGTGGAACATGGGAAAGGTATTATAATAACACTGGTAGTGGAATGGCTTGGAGTCCTTGGAAGAGGACAAGCTTCCCGGAAAGCACAACAGCCCCAGTTATGCCTGATCTTTGGTTACCTTTGACCTCCAACTTAAAACCTGCACTTGGTGAGGGAGAGATGGTATTTTCCAGACCTTCTACAGCAACCTATTTCACTAAGCGGGGTGTTATGGCTGTTGCACAAGCAAACCAACCACGTTTTGAAAGAGATGGGTTGCTTATCGAGGGGCAAAGGACAAACCTCATGCTCAACAGTGAGGACCCAAGCAAGTGGGGTGCACAGCAAGCGATTACTGTCGGTAGCACTGTAACAAATACTAACGGCACAAAAGGCGCAAGATTTACAGTAAACACCACATCCGGTGTAGAAACAACAGCGTTAAACCTTGCCACTGTTCCAGCCACCAGGGGTGCCGATGTGACAGGTGCTGAGAAATTCTGTACTGGGTCTATTATTGCAAGAGGTGGTAAAGCCCACCAGAGACTGCGTGTAAGATTCGACATGTACAATGGATCCACCACGGTGTTCCAAGGTGACGCTTATGTTAACCTGTCAACACTTGAAGTTAAAACAACAGGGGATGCAGCTGGGAGAATTAAAGTAAAAGCTGAGAGATGGCAAACAGCAGGTCCTGCTTGGATAAGGATTGCTGCTACGTTTGAAGCAGTGGCCTCTGACAATAAGATCGGGTGCCAGTTCCAAATTGCTCCACCAGAAGGTGCTCAACATGCCGTAGGAGATTGGGTTGATGTTGCAATACCTCAATTTGAGTTAGGGTCCTGTGAGTCCTCGTTTATCCCTACAGGGTCTTCACCTGTAACCAGGGCGGCAGATCTTTGTAAATTCCCAATGACGGATAACCTAGCTCCCAGACCATTCACTATCGCCGCTACGGTTGATGCCAACTGGAGAGGCTGGGGCAAAGCTCCTAACGCAGCCCCTAGGGTTATTGATACAGAGGGTCATCAATCCGGTGCTTCATTTATCATGGGGTTTGGCTCTGCAACAAATATTGCGGAGGACGGTTATCCATACTGTGATATTGGAGGGTCAAACAGACGTGTTTACGAGATGGCTAAAGCCCGTAAATTGAAAATTGGGTTCAGGATAAAAGATGACGGTAAAACCTGCTCTTTTGCTAACGGACTGGTGAGCACGGAAACGCAGTCTTCTTGGGAATTCCTAGCAGGAGGCGCTTTCATCCGCATTGGTGGTCAAACGGCGACAGGTGAAAGACACTTATTTGGTCATATTAAGGACATAAGAGTTTGGAACTCTGCACTGACAGACACCCAGCTTATGATGGAGAGTGTTGAATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
0cd7720cc167c1c647c0f6d3023aa30ea0ca9a25e70ec9b88ced6a9a62383a25
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6053
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50