Protein

View in Explore

Genbank accession

XCX11016.1 [GenBank]

Protein name

tail spike protein

RBP type

Evidence Phold

Probability 1,00

TSP

Evidence DepoScope

Probability 1,00

TSP

Evidence RBPdetect

Probability 0,91

TSP

Evidence RBPdetect2

Probability 0,95

Protein sequence

MANKPTQPLFPLGLETSESSNIKGFNNSGTIEHSPGAVMTFPEDTEVTGLPSSVRYNPDSDEFEGYYENGGWLSLGGGGIRWETLPYAPSSNLLEGRSYLINNTTGASTVVLPSPTRIGDSVTICDAYGKFATYPLTVSPSGNNLYGSTEDMAITTDNVSATFTWSGPEQGWVITSGVGLGQGRVYSREIFTQILASETSAVTLNTPPTIVDVYADGKRLAESKYSLDGNVITFSPSLPASTELQVIEYTPIQLGNGGGSGSSTITWVYNGGSAIGGETEITLDIVVDDVPAIDINGSRQYKNLGFTFDPLTSKITLAQELDAEDEVVVIINGTPNIYNQIDYTLREVACVTNVKDTEVVYFSVGAVLSGYKVIYDKVTQRSYFIPELPNGTTAVSLSSSAVLVHSAGSVDLGALAVSREEYVTLSGSFDSGAVINVKNELLTHTDGKYRWDGALPKTVDAGSTPASTGGIGEGKWLSVGDAALRTNLASYNGFSLIGVCPDVITLRTLSVPIGKKVLLLGYHSDHPGTGGGTLYASSDTSLADDGVRVFVTSDGTRLVRETNGELYASWAGAVGDWNGTTGTDNKEAIERLIAASGTEFKWVIDLTNIGVSSVVIDNKNNWNGHINGSVINISAKPAAGAVDRKDQDGGLLPTIKITNSDGWKLTGSFVDNRYREAFYVEYCDNFELGCANLGSGINNNLAANHFRYCNHFKLNGWKVEKSGVIPLAGYYDWVQAIRMWDCSGFIIDGLTSHMNAGNGIYIASNCKDYVVTNFDITENAMSGIQLAWSGFGVMPIRGVISNGTITGNRADSIDVNNTSGIKARLDLIISGVINANNGYNSDGTVTADGSGLGTFINVSHFIVDECSSTSPARSGVAISNCSNFRVKGIIKKDQPSNSDGHGVYIENSADGEIDVDCITDSANANMYSIRTYGALENIHLSGKYVGYTLFGDDATYVNCSLDKASIISPTTVANRFPWENVNVVVSGSNAVDIKSTVNSCRFVSNNGHGGVLSSGNNDISDSEFYGTDGGLYCADNIGQVRVRGGVAQGGSAAGLRISGGEKHIIEGLTTKSTSGNSCVITNASKVIYIGNDDSANPTNFTGTTFTLQN

Physico‐chemical properties

protein length:	1109 AA
molecular weight:	117415,68620 Da
isoelectric point:	4,65912
aromaticity:	0,08476
hydropathy:	-0,12994

Domains

Domains [InterPro]

DC_1946
ATT
1–683

DC_1946 IPR006626 IPR006626 IPR006626 IPR006626 DC_0586

G3DSA:3.30.2020.50
ATT
335–420

G3DSA:3.30.2020.50 G3DSA:2.10.10.80 IPR012334 IPR006626 IPR006626

IPR040775
RBD
416–481

IPR040775 IPR011050

XCX11016.1

1 1109

Architecture

ATT

STR

RBD

ATT 1-683 | STR 684-948 | RBD 964-1109

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_1946	ATT	DC_1946	1	683	Novel HMM	DC_1946	N-terminal	Low	Positional only	273 proteins / 273 hits
G3DSA:3.30.2020.50	ATT	G3DSA:3.30.2020.50	335	420	Merged direct domain	G3DSA:3.30.2020.50	N-terminal	Low	Positional only	289 proteins / 289 hits
IPR040775	RBD	DC_0821	416	481	InterPro cluster	Tail spike TSP1/Gp66, N-terminal domain	Central	High	Text match	1281 proteins / 1285 hits
G3DSA:2.10.10.80	ATT	G3DSA:2.10.10.80	421	491	Merged direct domain	G3DSA:2.10.10.80	N-terminal	Low	Positional only	383 proteins / 383 hits
IPR012334	STR	IPR012334	527	948	Merged direct domain	Pectin lyase fold	Central	Low	Positional only	867 proteins / 867 hits
IPR011050	STR	IPR011050	618	846	Merged direct domain	Pectin lyase fold/virulence factor	Central	Low	Positional only	572 proteins / 572 hits
IPR006626	Unmapped	-	742	764	InterPro	Parallel beta-helix repeat	-	-	-	-
IPR006626	Unmapped	-	766	787	InterPro	Parallel beta-helix repeat	-	-	-	-
IPR006626	Unmapped	-	795	817	InterPro	Parallel beta-helix repeat	-	-	-	-
IPR006626	Unmapped	-	873	907	InterPro	Parallel beta-helix repeat	-	-	-	-
DC_0586	RBD	DC_0586	964	1109	Novel HMM	DC_0586	C-terminal	Low	Positional only	14 proteins / 14 hits
IPR006626	Unmapped	-	1014	1035	InterPro	Parallel beta-helix repeat	-	-	-	-
IPR006626	Unmapped	-	1037	1059	InterPro	Parallel beta-helix repeat	-	-	-	-

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout

N-terminal

Central

C-terminal

XCX11016.1

1 1109

Domain	Start	End	Length (AA)	Confidence
N-terminal	1	579	579	0,9963
Central domain	580	1098	520	0,9941
C-terminal	1099	1109	10	0,2352

Note: Constraints were applied during segmentation.
C-terminal too short, adjusted boundary

Legend: N-terminal Central domain C-terminal

3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring

N-terminal
1-579

Central
580-1098

C-terminal
1099-1109

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Salmonella phage vB_SalA_KFSST3 [NCBI]	3234038	Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host	Salmonella typhimurium [NCBI]	90371	cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Genbank protein accession

XCX11016.1 [NCBI]

Genbank nucleotide accession

PP994976.1 [NCBI]

CDS location

range 111142 -> 114471
strand -

CDS

ATGGCCAACAAACCAACACAGCCTCTTTTCCCTTTGGGTTTAGAAACTTCTGAGTCTTCGAACATAAAAGGCTTCAACAACTCCGGCACTATTGAGCATTCCCCTGGTGCCGTAATGACATTTCCTGAAGATACTGAAGTTACAGGTCTTCCATCTTCTGTGCGTTACAATCCTGATAGTGATGAATTTGAAGGTTATTACGAAAACGGTGGTTGGTTGTCTTTGGGGGGCGGTGGAATACGCTGGGAAACGCTCCCTTACGCTCCCTCTAGCAATTTGTTAGAAGGTCGTAGCTATCTCATTAATAATACCACAGGGGCATCTACAGTGGTTCTCCCTTCCCCTACGCGTATTGGGGATTCCGTTACTATTTGTGATGCTTATGGGAAATTTGCCACTTACCCATTGACCGTGTCTCCTTCTGGAAATAATTTGTATGGCTCCACTGAAGACATGGCTATAACAACTGATAATGTTTCAGCAACGTTCACTTGGTCTGGACCTGAACAAGGTTGGGTTATCACATCCGGCGTCGGTCTTGGTCAAGGCCGTGTCTACAGTCGTGAAATCTTTACGCAAATTTTGGCGTCTGAAACAAGTGCTGTTACTCTCAATACTCCACCAACAATCGTGGACGTGTATGCTGACGGAAAACGTCTTGCGGAATCCAAATATTCACTAGATGGAAATGTAATCACTTTCAGTCCTTCTTTGCCAGCCAGCACAGAACTTCAGGTGATTGAATATACTCCTATTCAATTGGGTAATGGCGGTGGTTCTGGTTCTTCTACGATTACCTGGGTCTATAATGGGGGTTCAGCGATTGGCGGTGAAACCGAAATCACGTTAGACATCGTTGTTGATGATGTTCCGGCCATTGATATAAACGGAAGTCGCCAGTATAAAAATCTGGGGTTCACATTCGATCCATTAACCAGTAAAATCACTCTTGCGCAAGAACTGGATGCAGAGGATGAAGTTGTTGTAATTATCAATGGAACGCCAAACATCTATAATCAAATTGATTATACTTTGCGGGAAGTGGCTTGTGTAACCAATGTTAAAGATACAGAGGTCGTTTATTTTAGTGTTGGTGCTGTGTTAAGCGGGTATAAAGTTATCTATGATAAAGTAACACAGAGATCATATTTTATTCCAGAGCTACCGAATGGAACCACGGCAGTCAGCCTTAGTTCTTCGGCTGTGCTTGTGCATTCTGCTGGTAGTGTTGATCTGGGCGCATTAGCTGTATCTCGTGAAGAATATGTTACATTGTCTGGTTCATTTGATTCTGGTGCTGTCATCAATGTTAAAAATGAATTACTTACTCATACAGATGGTAAGTATCGTTGGGATGGGGCATTACCTAAAACTGTCGATGCTGGATCAACGCCTGCATCAACTGGTGGCATCGGCGAAGGGAAGTGGTTAAGCGTTGGCGATGCGGCATTACGAACTAATTTAGCTTCTTATAATGGGTTTTCCCTGATTGGTGTGTGTCCTGATGTAATCACGTTGCGAACGCTTTCCGTACCAATTGGTAAGAAAGTATTGTTGCTCGGATATCATTCAGATCATCCTGGCACTGGCGGCGGAACCCTTTACGCCTCAAGTGATACATCACTAGCTGATGATGGTGTACGTGTTTTTGTCACATCAGATGGAACCCGTTTGGTAAGAGAGACTAATGGGGAGTTATATGCCTCATGGGCAGGTGCTGTTGGTGACTGGAACGGAACTACTGGCACAGATAATAAGGAAGCAATAGAACGGCTTATCGCAGCATCAGGGACTGAATTTAAATGGGTTATTGATTTAACGAATATTGGCGTAAGTTCTGTCGTTATTGATAACAAAAATAACTGGAATGGGCATATAAACGGCAGTGTAATCAATATTTCAGCTAAGCCAGCTGCCGGTGCCGTAGACAGAAAAGATCAGGATGGTGGATTGCTACCAACCATTAAAATTACAAACTCTGATGGCTGGAAATTAACAGGTTCTTTTGTCGACAATCGTTATCGTGAGGCTTTCTATGTAGAATACTGCGATAACTTTGAACTAGGCTGCGCAAACCTTGGTAGTGGAATTAACAATAATCTTGCGGCTAACCATTTCAGATACTGTAACCATTTTAAGTTAAATGGATGGAAGGTTGAAAAGTCGGGGGTTATTCCACTTGCAGGTTATTACGATTGGGTTCAAGCTATAAGGATGTGGGACTGCTCTGGATTTATCATTGATGGATTAACATCACACATGAATGCAGGTAATGGTATTTATATCGCCAGTAACTGCAAAGACTATGTTGTTACTAACTTTGACATAACAGAAAACGCCATGTCAGGAATACAGCTCGCTTGGTCAGGTTTTGGTGTAATGCCAATTAGAGGTGTTATCTCTAACGGAACCATCACTGGAAACAGGGCTGACAGTATAGACGTTAACAATACCAGCGGTATCAAAGCGAGACTTGATCTGATAATTTCCGGTGTTATAAATGCAAACAATGGTTACAACTCTGACGGAACGGTAACTGCCGACGGTTCTGGTTTGGGTACATTTATTAATGTTTCCCATTTCATAGTTGACGAGTGCTCTTCAACATCGCCAGCCCGCTCTGGAGTAGCTATAAGTAACTGCTCCAATTTCAGAGTAAAAGGTATTATAAAAAAAGACCAGCCATCTAATAGTGATGGACATGGGGTATACATTGAAAACAGCGCTGATGGTGAAATAGACGTTGACTGTATTACTGACTCTGCTAACGCAAACATGTACTCCATACGAACTTACGGGGCGCTTGAAAACATACACCTTTCAGGCAAATATGTTGGATATACCTTGTTTGGAGATGATGCAACTTATGTTAACTGCTCTCTTGATAAAGCGTCAATAATTTCCCCGACTACAGTCGCAAATCGTTTCCCATGGGAAAATGTGAACGTAGTTGTTTCTGGTTCAAATGCTGTTGATATCAAATCAACAGTGAATAGTTGCCGATTTGTTTCTAACAATGGTCATGGGGGTGTGTTGTCTTCAGGTAACAACGATATTTCTGACTCAGAATTCTATGGAACAGATGGTGGACTTTACTGTGCTGACAACATTGGTCAGGTTAGGGTTAGAGGTGGTGTAGCCCAGGGTGGCTCAGCAGCAGGACTACGAATTAGTGGTGGTGAAAAGCATATCATTGAAGGGTTAACCACAAAATCAACATCAGGCAACTCCTGTGTTATCACCAATGCTTCCAAAGTGATATACATTGGAAATGATGACTCTGCTAACCCAACAAACTTTACAGGAACAACATTTACACTTCAGAACTAA

Genome Context

Tertiary structure

PDB ID

b01546764120bd1edb33af6351f7af2e2969d04397990bc5d2f5458086bf6da0

ESMFold

Source ESMFold

Method ESMFold

Resolution 0,7682

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

3D Structure with Domain Coloring

Domain Coloring

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence