Genbank accession
YP_009151963.1 [GenBank]
Protein name
central tail fiber J
RBP type
TF
Evidence UniProt/TrEMBL
Probability 1,00
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,50
Protein sequence
MPPAIIGAAIALGASAAAAASIISATTALVIGIAATAAGALLTKTPNMNFDAYKGQQERKQVLRAATASRSVVYGTTVASGLLAFAEEEAGDQDEGEWMHLVVVLASHKLEGIETIWLGDDGIDWFGENATWEFHNDRQTVDPFMLKHCPSWKEDMIGKGIAWLRLSLKFDAEKFPSGLPNVKVLKKGRRIYDPRSGQTVFSDNAALVILDYFRTYLKRKDENINWDQFKEAANICDEFVTNADNTTERRYRINGEFEVDEAPAKILDAMLEACGGELTYIGGKHGLLVGAYYGPATMTLDESCIAGDIKIIPETSYKERTNTITGTFVDPKQTYAEADFPPVVVKEWVEKDGGEITQDMDFRFVTSEYQAQRLANIILRRKRVGRTIEVPCNMKGYKFRPGMYVNVTISNIEMKNVEMRVTKWSFDLKGGINLVLRQDFLEMWDDAIGKPMERPDLVDLPSGAIAQPQNLQYQVLQISDVVQGVLTWSNIGQVAYNRVAVRQGGTTVWTAQVPGQNVRVTGLLRGAYTAHVQAVAYSGAISPEAYLEFNIQAPPPPTSIEVQQGYFAISLIPKSADLANVSTQYDFWTSGETRLSSVSTDVVEREATRKGIGTTWTSEGLKNDHTYYWYVRTINAFGSSAFVEVAALCFTTATDLMPQIDSEFKKTETYKELTTEITGVKDGVTQLSQTVVETEQRLSQSVSNVQQSVITLDGVVQDQGVTINEQGQLIDAQGKLIDTQGKTIETVSATVQETSKAVVDLEGNVNAQWGAKVQVDSKGQKYVAGIQLGMEGSGGAVQSYFMVSANNFAIYNPTNSAAELAFAVKNGQVFMKATFIENGTIDSAKIANQIQSTNYANNSAGWMINKNGSAQFNNVTIRGTVYANNGSFTGTVNATSGKFKGTVEATSFVGDVANMCVIAESAIPNTQTTSSRTWTKTFKDSSGSTLSKDFVLLLSYSLTAYTSKQASRIIVTANIGGTSITRRIERAANGPAMDVTIPLAVKGKTASRVTISVKEEYTNVYGSYLRPSVILMTRGTGSWS
Physico‐chemical
properties
protein length:1040 AA
molecular weight: 113441,68460 Da
isoelectric point:5,38825
aromaticity:0,08750
hydropathy:-0,19240

Domains

Domains [InterPro]
DC_0754
STR
1–988
IPR057587
ATT
556–660
IPR053171
Unmapped
713–904
IPR015406
RBD
751–887
YP_009151963.1
1 1040
Architecture
STR
ATT
STR
STR 1-555 | ATT 556-660 | STR 661-988 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage Seurat
[NCBI]
1540098 Uroviricota > Caudoviricetes > Queuovirinae > Seuratvirus seurat >
Host Escherichia coli
[NCBI]
562 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_009151963.1 [NCBI]
Genbank nucleotide accession
NC_027378.1 [NCBI]
CDS location
range 15337 -> 18459
strand +
CDS
ATGCCACCAGCAATAATTGGAGCAGCGATAGCTTTAGGTGCGTCAGCTGCTGCCGCGGCTAGTATTATTTCGGCTACTACCGCTCTCGTTATCGGTATTGCTGCAACCGCGGCAGGTGCTCTTTTAACTAAGACACCAAATATGAACTTTGATGCTTACAAGGGGCAGCAAGAGCGTAAACAGGTTCTGCGTGCAGCTACAGCGTCACGTTCTGTTGTATATGGCACGACTGTAGCGTCCGGACTATTAGCATTTGCGGAGGAAGAAGCTGGAGATCAAGATGAAGGTGAATGGATGCATCTTGTTGTCGTTCTTGCCAGTCATAAATTGGAAGGTATTGAAACGATTTGGTTGGGTGATGACGGAATTGATTGGTTTGGTGAAAACGCTACTTGGGAGTTTCATAACGACCGTCAGACTGTTGACCCATTCATGTTAAAACATTGTCCTTCCTGGAAGGAGGATATGATTGGCAAGGGTATTGCATGGCTACGTTTAAGCTTAAAGTTTGATGCTGAAAAATTCCCATCCGGTTTGCCAAACGTCAAGGTGTTGAAAAAGGGACGTAGAATTTATGACCCACGTTCCGGTCAAACTGTCTTTAGCGATAACGCCGCTCTTGTTATTCTTGATTATTTCCGCACGTATTTAAAGCGCAAGGACGAGAATATTAACTGGGACCAATTCAAGGAAGCTGCTAACATCTGCGATGAGTTTGTTACTAACGCAGATAACACTACGGAAAGACGCTATCGCATTAACGGTGAGTTTGAAGTGGATGAAGCACCTGCCAAAATCCTTGATGCTATGCTTGAAGCTTGCGGCGGGGAGCTTACCTATATTGGCGGCAAGCATGGTCTGTTAGTTGGTGCTTATTACGGCCCAGCTACCATGACTTTGGATGAAAGCTGCATTGCTGGGGATATTAAAATAATCCCTGAGACGTCTTATAAAGAGCGTACCAATACCATTACAGGTACATTCGTCGACCCGAAGCAAACATACGCTGAAGCAGATTTCCCTCCAGTTGTGGTTAAGGAATGGGTGGAAAAAGATGGCGGTGAAATAACGCAAGACATGGATTTCCGCTTTGTTACAAGTGAATATCAAGCTCAACGTCTTGCTAATATTATTTTACGTCGTAAGCGTGTTGGTCGAACAATTGAAGTTCCGTGTAACATGAAGGGGTATAAATTCCGCCCAGGCATGTATGTCAACGTAACCATTTCAAACATCGAAATGAAAAACGTTGAGATGCGCGTTACTAAATGGTCATTCGATCTTAAAGGTGGGATTAATCTTGTCCTTCGTCAAGACTTCCTGGAAATGTGGGACGACGCTATTGGTAAACCAATGGAGCGCCCGGATCTGGTAGACCTTCCGTCTGGTGCTATTGCTCAACCGCAAAACCTTCAGTATCAGGTATTGCAGATTAGCGATGTTGTGCAGGGTGTTTTAACGTGGAGCAATATTGGGCAGGTAGCATATAACCGCGTAGCCGTGCGACAGGGAGGTACAACGGTTTGGACCGCACAAGTCCCTGGCCAAAACGTTCGCGTTACTGGGTTGCTGCGGGGCGCGTATACAGCGCATGTTCAAGCGGTAGCTTATAGCGGGGCAATATCGCCTGAAGCATATCTGGAATTTAATATTCAGGCTCCGCCGCCACCAACATCTATTGAAGTACAACAGGGTTACTTTGCTATAAGCCTAATCCCTAAATCTGCGGACCTTGCAAACGTTAGCACGCAGTATGATTTCTGGACTTCCGGTGAAACAAGATTGTCATCTGTGTCTACAGACGTTGTTGAGCGTGAAGCAACTCGTAAAGGTATAGGCACAACCTGGACTTCGGAAGGTTTGAAGAATGACCACACTTATTACTGGTATGTCCGCACCATTAACGCTTTCGGATCATCTGCATTTGTAGAAGTAGCTGCATTGTGCTTTACAACAGCTACAGATTTGATGCCACAAATTGATTCTGAATTCAAGAAGACGGAGACTTACAAAGAGCTTACTACTGAGATCACAGGTGTTAAAGACGGTGTTACTCAGCTTAGCCAAACTGTAGTGGAAACTGAACAGCGTTTAAGTCAAAGCGTTAGCAATGTTCAACAAAGCGTTATTACTTTGGACGGTGTTGTTCAGGATCAGGGCGTTACCATTAACGAACAAGGACAGCTTATCGACGCACAGGGTAAGTTGATTGACACTCAAGGTAAGACTATTGAAACGGTTAGCGCGACCGTGCAGGAGACAAGTAAAGCAGTTGTAGATCTGGAAGGTAATGTTAACGCTCAATGGGGCGCTAAGGTACAGGTTGATAGTAAAGGACAAAAATACGTCGCTGGTATCCAGCTAGGTATGGAGGGTTCCGGTGGCGCTGTTCAGTCTTACTTTATGGTAAGTGCTAACAACTTTGCTATCTATAACCCGACAAACAGCGCCGCTGAATTAGCATTTGCCGTTAAAAACGGTCAAGTGTTTATGAAGGCTACATTTATTGAAAATGGTACTATCGACAGTGCTAAGATAGCAAACCAAATTCAGTCAACAAACTACGCTAACAATAGCGCGGGTTGGATGATTAACAAGAATGGTAGCGCTCAGTTTAACAACGTAACGATAAGAGGTACTGTATACGCTAACAACGGATCTTTCACAGGCACAGTGAACGCAACAAGCGGTAAATTCAAGGGTACTGTGGAAGCTACCAGTTTTGTGGGTGATGTTGCGAATATGTGTGTCATTGCTGAGTCTGCAATACCAAACACACAAACTACAAGTTCAAGAACCTGGACAAAAACTTTCAAAGACTCATCTGGTTCAACATTATCTAAAGACTTTGTGTTGCTATTAAGTTATAGTTTAACTGCATATACATCAAAACAGGCGAGTCGTATAATTGTGACTGCTAACATAGGGGGGACATCAATTACAAGGAGGATTGAGCGAGCTGCTAATGGACCTGCGATGGATGTAACCATACCTTTAGCAGTGAAAGGAAAGACAGCGTCGCGCGTAACAATAAGCGTTAAGGAGGAGTATACGAACGTCTATGGGAGCTACTTGCGCCCGTCTGTAATATTAATGACTCGCGGAACTGGTAGTTGGTCGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
5afba1cea31fee7ebdc0bb125546bc8d99c4faf53067075ccb946e2a2b08fcfd
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7211
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete Genome Sequence of Enterotoxigenic Escherichia coli Siphophage Seurat Doan,D.P., Lessor,L.E., Hernandez,A.C. and Kuty Everett,G.F. 2015 25720682 GenBank