Genbank accession
WJN62482.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect
Probability 0,65
Protein sequence
MPPAIIGAAIALGASAAAAAGWIATGVALAIGMAATAAGALLTKTPNMNFNAYKGQQERKQVLRAAAASRTVVYGTTVASGVMTFAEEQPGDQDEDELLHMALVVASHPLEGIGDIWLGDDLVQTFEQYVTWEFHNDRQTVDPFMLSNCPSWKEDMIGKGIAWLRISFKFNAEKFPSGLPNIKLLKRGRRVYDPRSGYTIFSDNAALVILDYFRTYLKRKDEDINWDQFKEAANICDEYVNNADGSTERRYKINGEFEVDEAPSKILDAMLQACGGELTYVAGKHGLLVGAYYGPATMTLDESCIAGDIKIVPETSYKERTNTITGTFIDPKQNYVEADFPPVVVKEWVEKDGGEITQDMDFRFVTSEYQAQRLSNIILRRKRVGRTIEIPCNMKGYKFRPGMYVKVTITQIGMKNVEMRVTKWSFNPKGGVNLTLRQDFLEMWDDAIGKPMDRPDLVDLPSGGVAQPQNLQYQILQISDVVQGVLSWTNMGQVAYNRVAVRQGGVTIWTAQVPGQSVRVTGLLRGAYTAHVQAVSHSGAISPEAYLEFNIQAPPPPSSVEIQNGYFSLTLIPKIAELTSVSTQFDFWTSGETKLPSANTDVVERDATREGMGTIWQKNNLLNDHTYYWYIRTINAFGSSAFVEVEARVWAETAQIIEIMDKEFQETETFKNLMETVQKVDDGVTELSKVVEGQATKIDSVQTRVSDVVVTVQEQSQALADLNGKLSAQWGQKVQIDNNGNKYVAGMQLGIEGSGGQFQSYFMVSADNFAIYNPVAGAAQLAFAIKNGQSFLQEAFIENGSITNAKIGNVIQSNNWNGNDQGWAITKDGYCVFNNVTVRGTVVANAGQFGFNGNGGITIDSNGIRVPLSGGGVVIVGRW
Physico‐chemical
properties
protein length:879 AA
molecular weight: 96638,05370 Da
isoelectric point:5,07381
aromaticity:0,09556
hydropathy:-0,20830

Domains

Domains [InterPro]
DC_0754
STR
1–878
IPR032876
ATT
314–424
IPR015406
RBD
712–848
WJN62482.1
1 879
Architecture
STR
ATT
STR
ATT
STR
STR 1-313 | ATT 314-424 | STR 425-555 | ATT 556-661 | STR 662-878 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage phiG7
[NCBI]
3044011 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Escherichia coli
[NCBI]
562 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
WJN62482.1 [NCBI]
Genbank nucleotide accession
OQ791410.1 [NCBI]
CDS location
range 23310 -> 25949
strand -
CDS
ATGCCACCAGCAATAATTGGAGCAGCAATAGCTTTAGGCGCTTCCGCTGCCGCTGCGGCGGGGTGGATTGCTACGGGTGTAGCTTTAGCTATTGGTATGGCTGCAACTGCGGCAGGTGCTCTTTTAACTAAGACACCTAATATGAACTTTAATGCTTATAAAGGTCAACAAGAGCGTAAGCAGGTTTTACGAGCAGCCGCAGCGTCCCGAACAGTAGTATACGGGACAACGGTTGCTTCCGGTGTTATGACGTTTGCCGAGGAGCAGCCTGGTGATCAAGACGAAGACGAACTCCTGCATATGGCGCTTGTTGTAGCTTCACATCCATTGGAGGGGATTGGTGATATTTGGCTTGGGGATGATCTTGTACAGACTTTCGAACAGTATGTTACTTGGGAATTTCATAACGACCGTCAGACTGTAGATCCATTCATGTTAAGCAATTGCCCTTCCTGGAAAGAGGATATGATTGGGAAAGGGATTGCATGGCTTCGCATTAGCTTTAAATTTAATGCAGAAAAATTCCCTTCTGGTTTGCCAAACATTAAGCTTCTTAAAAGAGGACGCCGTGTATATGATCCTCGTTCTGGCTATACCATATTTAGCGATAATGCAGCTTTAGTAATACTTGATTACTTCCGCACGTATTTAAAGCGAAAAGATGAAGATATTAACTGGGACCAGTTCAAAGAAGCTGCTAACATCTGTGATGAATACGTCAATAACGCTGATGGTTCTACAGAGCGCCGTTATAAAATTAACGGTGAATTTGAAGTAGATGAAGCCCCCTCCAAAATTCTGGATGCTATGTTGCAAGCTTGTGGTGGCGAGCTAACGTATGTGGCGGGTAAACACGGTCTTCTGGTTGGCGCATATTACGGTCCAGCAACAATGACGCTGGACGAAAGTTGTATTGCTGGGGATATTAAGATTGTTCCAGAGACTTCTTATAAGGAGCGCACAAACACCATCACAGGGACATTTATTGATCCGAAGCAGAACTACGTTGAAGCAGACTTCCCCCCAGTTGTGGTTAAGGAATGGGTGGAAAAGGATGGCGGGGAAATAACTCAGGACATGGATTTTCGTTTTGTAACTAGTGAATATCAGGCACAACGTTTGTCTAATATTATTCTACGTCGTAAACGTGTTGGACGTACAATTGAAATCCCTTGTAACATGAAGGGTTATAAGTTCCGTCCAGGAATGTATGTAAAAGTTACCATTACGCAGATTGGCATGAAGAATGTTGAAATGCGCGTTACCAAATGGTCTTTTAACCCTAAAGGTGGTGTTAACCTTACATTACGTCAAGATTTCCTGGAAATGTGGGACGATGCAATTGGTAAACCTATGGACAGACCGGATCTTGTAGACTTGCCAAGTGGTGGTGTTGCTCAACCTCAAAATCTTCAATACCAGATATTGCAAATCAGTGATGTGGTACAGGGGGTATTATCCTGGACAAACATGGGGCAAGTCGCATATAACCGCGTAGCTGTGCGACAGGGAGGCGTTACTATTTGGACCGCACAAGTCCCTGGCCAAAGCGTCCGCGTTACTGGGTTGCTGCGTGGGGCGTATACCGCACACGTTCAAGCTGTATCTCACAGCGGTGCAATATCACCAGAAGCTTATCTGGAGTTTAATATTCAAGCTCCACCGCCACCTTCATCTGTTGAGATACAGAACGGTTATTTTTCTTTAACTCTTATACCAAAGATTGCAGAGCTGACTAGTGTTAGCACACAATTTGATTTCTGGACATCTGGTGAAACAAAACTGCCATCTGCTAATACAGATGTTGTCGAGCGTGATGCTACCCGTGAAGGTATGGGAACTATATGGCAGAAAAATAACTTACTCAATGACCACACTTATTACTGGTATATAAGAACAATCAACGCCTTTGGCTCGTCCGCGTTTGTGGAAGTTGAAGCTCGTGTATGGGCAGAAACCGCACAGATTATAGAAATCATGGATAAAGAGTTTCAAGAAACTGAGACTTTCAAAAACCTCATGGAGACTGTGCAAAAGGTTGATGACGGTGTAACGGAATTGTCCAAAGTAGTTGAAGGACAGGCTACAAAGATAGATTCTGTTCAGACCAGAGTGAGTGATGTTGTTGTCACCGTGCAAGAACAGTCACAGGCACTAGCAGACCTTAACGGCAAACTTTCCGCTCAATGGGGCCAAAAGGTTCAAATAGACAATAATGGTAACAAATACGTTGCAGGTATGCAGTTAGGTATTGAAGGTAGCGGAGGACAATTCCAGTCTTACTTCATGGTGAGTGCGGACAACTTTGCTATTTATAATCCTGTAGCTGGAGCAGCACAGCTTGCTTTTGCTATTAAAAACGGTCAAAGTTTCTTACAAGAAGCCTTTATTGAGAATGGCTCAATCACCAATGCCAAGATTGGTAATGTTATTCAGTCCAATAACTGGAATGGTAACGATCAAGGTTGGGCAATTACAAAAGACGGTTATTGCGTATTTAATAACGTTACCGTCAGAGGGACGGTCGTCGCTAACGCTGGTCAATTTGGTTTCAACGGAAATGGAGGTATTACAATTGATAGTAACGGTATTCGCGTTCCGTTATCCGGCGGTGGTGTTGTCATAGTAGGACGCTGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
574114cd5947d8bb79aa08fe2d46b1835dbddec3906096ee43b2a4766a52579f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7942
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50