Genbank accession
VAY28018.1 [GenBank]
Protein name
central tail fiber J
RBP type
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,51
Protein sequence
MPPAIIGAAIALGASAAAAASIISATTALVIGIAATAAGALLTKAPNMNFDAYKGQQERKQVLRAATASRSVVYGTTVASGLLAFAEEEAGDQDEGEWMHLVVVLASHKLEGIETIWLGDDGIDWFGENATWEFHNDRQTVDPFMLKHCPSWKEDMIGKGIAWLRLSLKFDAEKFPSGLPNVKVLKKGRRVYDPRSGQTVFSDNAALVILDYFRTYLKRKDENINWDQFKEAANICDEFVTNADSTTERRYRINGEFEVDEAPAKILDAMLEACGGELTYIGGKHGLLVGAYYGPATMTLDESCIAGDIKIIPETSYKERTNTITGTFVDPKQTYAEADFPPVVVKEWVEKDGGEITQDMDFRFVTSEYQAQRLANIILRRKRVGRTIEVPCNMKGYKFRPGMYVNVTISNIGMKNVEMRVTKWSFDPKGGINLVLRQDFLEMWDDAIGKPMERPDLVDLPSGAIAQPQNLQYQVLQISDVVQGVLTWSNIGQVAYNRVAVRQGGTTVWTAQVPGQNVRVTGLLRGAYTAHVQAVAYSGAISPEAYLEFNIQAPPPPTSIEVQQGYFAISLIPKSADLANVSTQYDFWTSGETRLSSVSTDVVEREATRKGMGTTWTSEGLKNDHTYYWYVRTINAFGSSAFVEVAALCFTTATDLMPQIDSEFKKTETYKELTTEITGVKDGVTQLSQTVVETEQRLSQSVSNVQQSVITLDGVVQDQGVTINEQGQLIDAQGKLIDTQGKTIETVSATVQETSKAVVDLEGNVNAQWGAKVQVDSKGQKYVAGIQLGMEGSGGAVQSYFMVSANNFAIYNPTNSAAELAFAVKNGQVFMKATFIENGTIDSAKIANQIQSTNYANNSAGWMINKNGSAQFNNVTIRGTVYASNGSFTGTVNATSGKFKGTVEATSFVGDVANMCVIAESAIPNTQTTSSRTWTKTFKDSSGSTLSKDFVLLLSYSLTAYTSNQASRIIVTANIGGTSITRRIERAANGPAMDVTIPLAVKGKTASSVTISVKEEYTNVYGSYLRPSVILMTRGTGSWS
Physico‐chemical
properties
protein length:1040 AA
molecular weight: 113190,33660 Da
isoelectric point:5,33578
aromaticity:0,08750
hydropathy:-0,18587

Domains

Domains [InterPro]
DC_0754
STR
1–989
IPR057587
ATT
556–660
IPR053171
Unmapped
713–904
IPR015406
RBD
751–887
VAY28018.1
1 1040
Architecture
STR
ATT
STR
STR 1-555 | ATT 556-660 | STR 661-989 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage vB_Eco_SLUR76
[NCBI]
2029172 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
VAY28018.1 [NCBI]
Genbank nucleotide accession
LR025195.1 [NCBI]
CDS location
range 33207 -> 36329
strand -
CDS
ATGCCACCAGCAATAATTGGAGCAGCAATAGCTTTAGGTGCGTCGGCTGCTGCTGCGGCTAGTATTATTTCGGCTACTACCGCTCTCGTTATCGGTATTGCTGCAACCGCGGCAGGTGCTCTTTTAACTAAGGCACCAAATATGAACTTTGATGCTTACAAGGGGCAGCAAGAGCGTAAACAGGTTCTGCGTGCAGCTACAGCGTCACGTTCTGTTGTATATGGCACGACTGTAGCGTCCGGACTATTAGCATTTGCGGAGGAAGAAGCTGGAGATCAAGATGAAGGTGAATGGATGCATCTTGTTGTCGTTCTTGCCAGTCATAAATTGGAAGGTATTGAAACGATTTGGTTGGGTGATGACGGAATTGATTGGTTTGGTGAAAACGCTACTTGGGAGTTTCATAACGACCGTCAGACTGTTGACCCATTCATGTTAAAACATTGTCCTTCCTGGAAGGAGGATATGATTGGCAAGGGTATTGCATGGCTACGTTTAAGCTTAAAGTTTGATGCTGAAAAATTCCCATCCGGTTTGCCAAACGTCAAGGTGTTGAAAAAGGGACGTAGAGTTTATGACCCACGTTCCGGTCAAACTGTCTTTAGCGATAACGCTGCTCTTGTTATTCTTGATTATTTCCGCACGTATTTAAAGCGAAAGGACGAGAATATTAACTGGGACCAATTCAAGGAAGCTGCTAACATCTGCGATGAGTTTGTTACTAACGCAGATAGCACTACGGAAAGACGCTATCGCATTAACGGTGAGTTTGAAGTGGACGAAGCACCTGCCAAGATTCTTGATGCTATGCTTGAAGCTTGCGGTGGGGAACTAACCTATATTGGCGGCAAGCATGGTCTGTTAGTTGGTGCTTATTACGGCCCAGCCACCATGACTTTGGATGAAAGCTGCATTGCTGGGGATATCAAAATAATCCCTGAGACGTCTTATAAAGAGCGTACCAATACCATTACAGGTACATTCGTCGACCCGAAGCAAACATACGCTGAAGCAGATTTTCCTCCAGTTGTGGTTAAGGAATGGGTGGAAAAAGATGGCGGTGAAATAACGCAAGACATGGATTTCCGCTTTGTTACAAGTGAATATCAAGCTCAACGTCTTGCTAATATTATTTTACGTCGTAAGCGTGTTGGTCGAACAATTGAAGTGCCGTGTAACATGAAGGGGTATAAATTCCGCCCGGGCATGTATGTCAACGTAACCATTTCAAATATCGGAATGAAAAACGTTGAGATGCGCGTTACTAAATGGTCATTCGATCCTAAAGGTGGGATTAATCTTGTCCTTCGTCAAGACTTCCTGGAAATGTGGGACGACGCTATTGGTAAGCCAATGGAGCGCCCGGATCTGGTAGACCTTCCGTCTGGTGCTATTGCTCAACCGCAAAACCTTCAGTATCAGGTATTGCAGATTAGCGATGTTGTGCAGGGTGTTTTAACGTGGAGCAATATTGGGCAGGTAGCATATAACCGCGTAGCCGTGCGACAGGGAGGTACAACGGTTTGGACCGCACAAGTCCCTGGCCAAAACGTTCGCGTTACTGGGTTGCTGCGGGGCGCGTATACAGCGCATGTTCAAGCGGTAGCTTATAGCGGGGCAATATCGCCTGAAGCGTATCTGGAATTTAATATTCAGGCTCCGCCGCCACCAACATCTATTGAAGTACAACAGGGTTACTTTGCTATAAGCCTAATCCCTAAATCTGCGGACCTTGCAAACGTTAGCACGCAGTATGATTTCTGGACTTCCGGTGAAACAAGATTGTCATCTGTGTCTACAGACGTTGTTGAGCGTGAAGCAACTCGTAAAGGCATGGGCACAACCTGGACTTCGGAAGGTTTGAAGAATGACCACACTTATTACTGGTATGTCCGCACCATTAACGCTTTCGGATCATCTGCATTTGTAGAAGTAGCTGCATTGTGCTTTACAACAGCTACAGATTTGATGCCACAAATTGATTCTGAATTCAAGAAGACGGAGACTTATAAAGAGCTCACTACTGAAATCACAGGTGTTAAAGATGGAGTTACTCAGCTTAGCCAAACTGTAGTAGAAACTGAACAGCGTTTAAGTCAAAGCGTTAGCAATGTTCAACAAAGCGTTATTACTTTGGACGGTGTTGTTCAGGATCAGGGCGTTACCATTAACGAACAAGGACAGCTTATCGACGCACAGGGTAAGTTGATTGACACTCAAGGTAAGACTATTGAAACGGTTAGCGCGACCGTGCAGGAGACAAGTAAAGCAGTTGTAGATCTGGAAGGTAATGTTAACGCTCAATGGGGCGCTAAGGTACAGGTTGATAGTAAAGGACAAAAATACGTCGCTGGTATCCAGCTAGGTATGGAGGGTTCCGGTGGCGCTGTTCAGTCTTACTTTATGGTAAGTGCTAACAACTTTGCTATCTATAACCCGACAAACAGCGCCGCTGAATTAGCATTTGCCGTTAAAAACGGTCAAGTGTTTATGAAGGCTACATTTATTGAAAATGGTACTATCGACAGTGCTAAGATAGCAAACCAAATTCAGTCAACAAACTACGCTAACAATAGCGCGGGTTGGATGATTAACAAGAATGGTAGCGCTCAGTTTAACAACGTAACGATAAGAGGTACTGTATACGCTAGCAACGGATCTTTCACAGGTACAGTGAACGCAACAAGCGGTAAATTCAAGGGTACTGTGGAAGCCACCAGTTTTGTGGGTGATGTTGCGAATATGTGTGTCATTGCTGAGTCTGCAATACCAAACACACAAACTACAAGTTCAAGAACCTGGACAAAAACTTTCAAAGACTCATCTGGTTCAACATTATCTAAAGACTTTGTGTTGCTATTAAGTTATAGTTTAACCGCATATACATCAAATCAGGCAAGTCGTATAATTGTGACTGCTAACATAGGGGGGACATCAATTACAAGGAGGATTGAGCGAGCTGCTAATGGTCCTGCCATGGATGTAACCATACCTTTAGCAGTGAAAGGAAAGACAGCGTCGAGCGTAACAATAAGCGTTAAGGAGGAGTATACGAACGTCTATGGGAGCTACTTGCGCCCATCTGTAATATTAATGACTCGCGGAACTGGTAGTTGGTCGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
9aac800aa591e55e2d7270af1ed4e1c59debc3794ea3a2d2bd8ede2239237364
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7247
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50