Genbank accession
VAY27923.1 [GenBank]
Protein name
side tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,84
TF
Evidence RBPdetect2
Probability 0,69
Protein sequence
MATRLRGTLVDGLNKPIINATVALLAKGNSLTVLSGSEAIFKTSATGTYDITVQTGYYKVIIGPQGVEPYKAGEIAIYADSKEGTLNNYLTTWAPEELTPEVITQVKDLVAQAETAKNASSTSATKSEQERVKAEAAAKKAEDTANGMKASIGLTTAPRHVANITVEPTAFLGFIRIVRSTTVGYPDIASSENVLAGFISAMDGTPGYVGVFVGDFTGTVYTYRWTKNVGAVWWKQVNYSTVNRYTQLNAETNFTNQLGNAKLLIDNNKVWGAYDNDNKRYIPLAIAQGGTGAVNVNDALENFGLGRNSAPRFKHLDLDNASNSTQAASGILNGYLRDSSGVQRTKHRLYSEIKSDGKAWLTMQIYSDESTQKTLGYNIDGDFQIVRNFIGQSLQLSDLTTTHKNLQIDRFKQLSAGTRVYGGPADERYFEVHTGAWGVYNVTEKKWIPLAISQGGTGAVTVADAKKNLLIPDGGLDSATRVDKPAGAEDAKYYPIIISQPSGYDGTYLTEIEMSTPSRSAAQSPNSNILRAWIRSAGWSDKGTVGFGNFFAYDSKEVAILCIRGTSRGQYPHNAVYVKGDAFPVYIRKTVGSTITVPTSDWSADPNASDKCVYKWGITGDLDGIGDEYGCRNILNFVKGLNGFYCNDYFRDAGGNAYLKDGMNYGGDIKLQLRKLEINGNLTAGNAITAFGPTVANNTFVSQLTNADSSQALHQSEFRAGESGGQIVVRDMSAVANHKFFNFNLDGSFSPPNGLLSSTGVDWNSQINTVNKFYGIAGQVNSAENNVVYGGIHVGFSGNYAFQLAGRNNKASFRTFEAGTPGPWMRLITDQYADFKVPIFANKNGEAITIKSTVDDNSESGYIAGRNNANTRLWYIGKSGPQETVVIRNDMNGNQILLRDGAGDISLDTKDGNKVVFAKASNFRLVNSNGKYTRLVTSGSSTHAISMDNWGTSARPTVFECKYEDYSTSANVGWIYYGQVNTDGSRTFQVNGTVGCTSVVQSSDRDLKDNIKTIADATKALRKMNGYTYTLKEDGLPYAGVIAQEVMEALPEAVSSFTKHEYMEGQDGEGNDTRYDLGKRYLNVDYSAVTGLLVQVCREADDRITKLETEVEELKKLVATLVNKEPLP
Physico‐chemical
properties
protein length:1128 AA
molecular weight: 122540,15530 Da
isoelectric point:6,12818
aromaticity:0,09663
hydropathy:-0,36711

Domains

Domains [InterPro]
IPR013609
ATT
1–130
Coil
Unmapped
124–144
VAY27923.1
1 1128
Architecture
ATT
STR
STR
ATT 1-162 | STR 217-420 | STR 443-1127 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
VAY27923.1
1 1128
Domain Start End Length (AA) Confidence
N-terminal 1 253 253 0,9588
Central domain 254 452 200 0,3291
C-terminal 453 1128 675 0,7556
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-253
Central
254-452
C-terminal
453-1128

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage vB_Eco_SLUR75
[NCBI]
2029171 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
VAY27923.1 [NCBI]
Genbank nucleotide accession
LR025197.1 [NCBI]
CDS location
range 25086 -> 28472
strand +
CDS
ATGGCAACTCGTTTACGTGGTACTTTAGTTGATGGTTTGAATAAGCCTATTATCAACGCTACAGTTGCGCTTTTAGCTAAAGGAAACAGTCTTACCGTATTATCCGGCAGCGAAGCTATCTTTAAAACAAGTGCAACCGGAACTTATGATATTACAGTCCAGACAGGTTATTACAAGGTTATTATCGGTCCACAGGGCGTAGAGCCATATAAAGCTGGTGAAATTGCTATTTACGCGGATAGTAAAGAAGGTACGCTGAATAACTATTTAACTACATGGGCACCGGAAGAGCTAACTCCGGAAGTTATTACTCAGGTAAAAGATTTGGTTGCACAAGCTGAGACAGCTAAGAACGCTTCATCCACGTCTGCTACTAAATCCGAACAGGAGCGAGTTAAAGCAGAAGCTGCTGCTAAAAAAGCGGAAGACACTGCTAATGGTATGAAAGCCTCTATTGGCTTAACTACTGCCCCAAGACATGTTGCAAATATTACAGTAGAACCTACAGCATTCTTAGGCTTCATACGAATTGTACGATCTACCACAGTCGGTTATCCAGATATAGCTTCATCAGAAAACGTATTGGCTGGTTTTATTTCTGCTATGGACGGAACCCCTGGATATGTCGGGGTATTTGTTGGTGACTTCACCGGAACTGTATACACTTATCGTTGGACTAAGAATGTTGGCGCGGTATGGTGGAAACAAGTTAACTACTCTACTGTCAACAGATATACCCAGCTTAACGCAGAAACTAATTTTACAAACCAATTGGGTAACGCCAAACTTCTTATTGACAATAATAAAGTTTGGGGTGCTTATGATAACGACAATAAACGCTATATACCCCTTGCAATAGCTCAGGGTGGTACTGGCGCGGTAAATGTTAATGATGCTTTGGAAAACTTTGGGTTAGGTCGTAACTCCGCGCCACGTTTCAAACATCTTGATCTGGACAATGCATCAAATTCTACACAAGCAGCTTCTGGAATTCTAAACGGCTACCTCCGTGATTCTAGCGGTGTGCAAAGAACTAAGCATAGATTATATTCAGAAATTAAAAGCGATGGGAAAGCGTGGTTAACCATGCAGATCTATTCTGATGAATCTACGCAGAAGACTTTAGGTTATAACATTGACGGCGATTTCCAAATTGTACGTAATTTTATCGGGCAGTCCTTACAATTATCGGATTTAACCACAACTCATAAAAATCTACAGATTGATAGATTTAAGCAGTTGTCCGCTGGAACAAGGGTCTACGGAGGTCCAGCCGATGAGCGATATTTTGAAGTTCATACCGGGGCCTGGGGTGTTTATAACGTAACAGAAAAGAAATGGATACCTTTAGCCATATCACAAGGTGGGACGGGAGCTGTTACAGTTGCGGACGCCAAGAAGAACCTTTTAATCCCGGACGGAGGTCTTGATTCGGCTACCCGTGTGGATAAACCCGCTGGAGCGGAAGATGCTAAGTATTATCCAATCATTATTAGCCAACCTAGCGGGTATGATGGCACGTACCTAACAGAAATTGAAATGAGCACTCCCAGCAGAAGTGCTGCACAAAGTCCTAACTCTAACATCTTAAGAGCTTGGATTCGAAGCGCTGGATGGAGCGATAAAGGTACTGTTGGCTTTGGGAATTTCTTTGCTTATGATAGTAAAGAGGTTGCAATTTTATGTATACGTGGCACATCTAGAGGTCAATATCCTCATAATGCTGTTTACGTAAAGGGCGATGCTTTCCCTGTTTATATTAGGAAGACTGTTGGATCCACAATTACAGTTCCCACTTCTGACTGGTCTGCAGATCCAAATGCGTCAGATAAGTGTGTTTATAAATGGGGCATCACAGGCGATTTAGATGGTATTGGTGATGAATATGGGTGTCGAAATATACTAAACTTTGTCAAAGGTTTGAACGGATTTTATTGTAACGACTATTTCCGTGATGCTGGAGGGAATGCTTATCTTAAGGATGGGATGAATTATGGAGGTGATATAAAATTACAACTCCGTAAATTGGAAATAAACGGTAATCTTACCGCAGGGAACGCTATAACTGCTTTCGGTCCTACTGTAGCAAATAATACATTTGTATCACAGTTAACAAATGCGGATTCTAGTCAAGCATTGCATCAAAGCGAGTTTAGAGCTGGGGAAAGCGGTGGGCAAATTGTTGTTCGGGATATGTCAGCAGTAGCCAATCATAAATTCTTTAACTTTAATCTAGACGGAAGCTTCAGTCCGCCAAACGGATTATTGTCTTCTACTGGTGTGGATTGGAACAGTCAAATTAATACCGTCAATAAGTTCTATGGAATTGCCGGACAAGTTAACTCAGCAGAAAACAATGTTGTTTACGGGGGCATTCACGTAGGTTTTAGCGGTAATTATGCATTTCAACTAGCTGGTAGAAATAACAAAGCAAGTTTTCGTACATTTGAAGCAGGCACACCTGGACCTTGGATGCGTCTTATTACTGATCAGTATGCAGACTTCAAAGTACCAATTTTTGCTAACAAGAATGGTGAAGCTATAACCATTAAATCGACAGTAGATGACAACTCTGAATCTGGATATATCGCTGGGAGGAATAACGCTAATACCCGTTTGTGGTATATAGGGAAGTCCGGACCTCAAGAAACTGTGGTTATCCGTAATGATATGAATGGAAACCAAATACTCTTAAGGGACGGTGCAGGCGATATAAGCTTGGATACAAAAGACGGGAACAAAGTTGTATTTGCAAAAGCTTCCAACTTTAGACTTGTTAATAGTAATGGAAAATATACAAGGTTAGTAACATCAGGAAGTTCAACTCATGCAATTAGCATGGACAACTGGGGTACAAGCGCAAGACCTACTGTGTTCGAATGTAAGTATGAAGACTATAGCACTTCTGCTAACGTTGGTTGGATATACTACGGTCAGGTAAATACAGATGGAAGCCGAACATTTCAGGTAAACGGAACTGTCGGTTGTACTAGTGTTGTTCAAAGCTCAGACCGAGATCTTAAAGACAACATTAAGACTATTGCAGATGCAACTAAAGCATTGCGTAAAATGAATGGCTACACATATACTCTCAAGGAAGATGGTTTACCCTATGCTGGTGTAATCGCTCAAGAAGTTATGGAAGCTCTACCTGAAGCGGTTAGCAGTTTCACAAAGCATGAGTATATGGAAGGCCAAGATGGAGAAGGTAATGATACAAGATATGATCTTGGAAAACGTTATCTTAATGTAGACTACTCCGCGGTAACTGGTCTTCTGGTTCAGGTTTGTCGTGAAGCAGATGACCGCATTACAAAACTTGAAACTGAAGTTGAGGAACTCAAAAAATTAGTTGCAACACTTGTTAATAAAGAACCACTACCATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
e6126cc6b18ae4e7ab6824e58fbe2551dc14026ff625191537c68b9ce09ca136
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5826
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50