Genbank accession
XCO69378.1 [GenBank]
Protein name
tail protein
RBP type
TSP
Evidence RBPdetect
Probability 0,86
Protein sequence
MISNNAPAKMVLNSVLTGYTLAYIQHSIYSDYDVIGRSFWLKEGSNVTRRDFTGVDTFSVTINNLKPTTTYEVQGAFYDSIIDSELLNAQIGINLSDKQTFKMKSAPRITGARCESEPVDVGVGAPIVYIDTTGEADYCTIELKNNSNANNPWVKYYVGALMPTIMFGGVPIGSYKVRISGQISLPDGVTIDSSGYYEYPTVFEVRYNFVPPTAPINVVFKAARIADGKERYDLRVQWDWNRGTGANVREFVLSYIDSAEFARTGWTKAQKINVGAAQSATIISFPWKVEHKFKVSSIAWGPDAQSITDSTVQTFILNESTPLDNSFVNETGIEVNYAYIKGKIKDGSTWKQTFLIDAATGAINIGLLDAEGKAPISFDPIKKIVNVDGSVITKTINAANFVMTNLTGQDNPAIYTQGKTWGDTKSGIWMGMDNATAKPKLDIGNATQYIRYDGDTLRISSGVVIGTPNGDIDIETGIQGKQTVFIYILDTSLPAKPTSPAYPPSGWSKTPPNRTSNTQNIYCSTGTLDPVTNQLVSGTSWSDVVQWSGTEGVDGRPGADGRPGADGKPGADGRPGADGQRGPGMYSLAIANLTAWNDSQANSFFTSNFGTGPVKYDVLTEYKSGAPGTAFTRQWNGSAWASPAMVLHGDMIVNGTVTASKIVANNAFLSQIGVNIIYDRAAALSSNPEGSYKMKIDLQNGYIHIR
Physico‐chemical
properties
protein length:706 AA
molecular weight: 76388,77920 Da
isoelectric point:5,52784
aromaticity:0,10057
hydropathy:-0,24618

Domains

Domains [InterPro]
IPR057551
STR
104–196
XCO69378.1
1 706
Architecture
STR
STR
STR
STR 10-97 | STR 103-197 | STR 211-706
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
XCO69378.1
1 706
Domain Start End Length (AA) Confidence
N-terminal 1 409 409 0,8722
Central domain 410 672 264 0,1621
C-terminal 673 706 33 0,9237
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-409
Central
410-672
C-terminal
673-706

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage phiP4
[NCBI]
3234013 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Pseudomonas aeruginosa HIM-6
[NCBI]
29322 Bacillota > Clostridia > Eubacteriales > Eubacteriaceae > Eubacterium >

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XCO69378.1 [NCBI]
Genbank nucleotide accession
PP993145 [NCBI]
CDS location
range 1949 -> 4069
strand -
CDS
ATGATTTCAAATAATGCACCAGCTAAAATGGTCCTAAATAGCGTCTTAACTGGATATACGTTGGCGTATATCCAGCATTCTATCTATTCTGATTATGACGTTATAGGCAGGTCTTTTTGGCTTAAAGAAGGTAGCAACGTTACTCGTAGAGATTTTACTGGAGTTGATACCTTCTCTGTAACTATTAATAACCTAAAACCTACAACAACTTATGAAGTTCAGGGTGCATTTTATGATTCTATAATAGACTCTGAACTACTTAATGCTCAGATAGGTATTAATCTATCTGACAAACAAACTTTTAAAATGAAGTCAGCACCTAGAATTACAGGTGCTAGATGTGAATCAGAGCCTGTAGACGTAGGTGTTGGAGCGCCAATAGTTTATATAGATACTACAGGAGAAGCTGATTATTGTACTATAGAATTAAAAAATAATTCTAATGCTAATAATCCGTGGGTTAAATATTACGTTGGTGCGTTGATGCCAACTATTATGTTTGGTGGTGTGCCAATCGGATCCTATAAGGTAAGAATTTCTGGACAAATATCTCTACCAGATGGAGTAACTATTGATTCATCTGGATACTATGAGTATCCTACTGTCTTTGAAGTTAGATATAACTTTGTACCTCCTACAGCCCCTATTAATGTTGTATTTAAAGCTGCACGTATAGCTGATGGTAAAGAACGTTATGATTTACGTGTACAATGGGATTGGAATAGGGGTACAGGTGCTAACGTTCGTGAGTTCGTTCTATCTTATATAGATTCAGCAGAATTTGCTAGAACTGGATGGACTAAGGCACAAAAAATCAACGTAGGGGCTGCTCAGTCTGCAACAATTATATCATTCCCATGGAAAGTAGAGCATAAATTTAAAGTGTCATCTATTGCCTGGGGACCAGATGCTCAAAGTATTACTGATTCTACAGTACAGACCTTTATACTAAACGAAAGTACACCATTAGATAATAGTTTTGTTAACGAAACTGGTATAGAGGTAAATTACGCGTATATTAAGGGTAAGATTAAAGATGGATCTACCTGGAAACAAACCTTTTTAATAGACGCTGCCACCGGTGCTATTAATATAGGTCTTCTAGATGCCGAAGGAAAAGCACCAATATCTTTTGACCCTATTAAAAAGATAGTTAACGTTGATGGAAGTGTAATAACTAAAACCATTAATGCTGCGAACTTTGTCATGACTAATTTGACTGGTCAAGATAATCCAGCAATATATACTCAGGGTAAAACTTGGGGAGATACAAAATCTGGTATTTGGATGGGCATGGATAATGCTACTGCAAAGCCAAAATTGGACATTGGTAACGCTACACAGTACATTCGTTATGATGGTGATACATTAAGAATCTCTAGTGGGGTTGTAATTGGCACACCTAACGGTGACATCGATATAGAGACAGGTATACAAGGTAAACAAACAGTATTTATTTATATTCTAGATACTTCATTACCTGCTAAACCAACAAGCCCTGCATATCCACCTTCTGGTTGGTCTAAAACTCCCCCGAATAGAACATCTAATACTCAGAATATTTACTGCTCTACTGGTACTCTGGACCCTGTTACTAATCAATTAGTATCTGGAACCAGTTGGTCAGATGTAGTTCAATGGAGTGGTACTGAAGGTGTTGATGGTAGACCAGGTGCTGATGGTAGACCAGGTGCTGATGGAAAACCAGGTGCTGATGGGCGGCCAGGAGCAGATGGACAACGTGGTCCCGGAATGTATTCTCTTGCTATTGCAAATTTAACCGCATGGAATGATTCTCAGGCTAATTCGTTTTTTACATCTAACTTTGGTACTGGTCCTGTTAAATATGATGTATTAACCGAGTATAAAAGTGGGGCACCAGGAACAGCGTTTACTAGGCAGTGGAATGGTTCAGCATGGGCTAGCCCTGCAATGGTTTTACATGGTGATATGATAGTTAATGGTACGGTAACTGCTAGTAAAATTGTTGCTAATAATGCTTTCTTATCACAAATTGGTGTAAATATTATATATGATCGTGCAGCAGCACTATCCTCTAATCCAGAGGGATCTTACAAAATGAAGATAGACCTGCAAAACGGGTATATCCATATAAGGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
a1d6aed64a96f2deb585317081e21efebd3721327719a406045f5a0dfc543c8f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,7901
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50