Genbank accession
YP_001700581.1 [GenBank]
Protein name
putative bacteriophage host-specificity protein; Lambda gpJ homolog
RBP type
TSP
Evidence RBPdetect
Probability 0,81
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MGKGGGSSKTPHEAPDDLKSSQMLTVVDAICEGPIEGPVDGLKSVRINKTPVLDSDGNAMVHGVTVVYRVGEDEQSAMEGFEDSGAETLLGVEVKKSEPVTRTITTKTVDRLRFTFGVQSLVSTSTKGDRNPTSVQMLIQFRRDGQWQVERDITITGKTTTQFLASVVIDDLPPRPFEVRMMRITDDSTSDLLQNKTVWSGYTEIIDVKQCYPNTAVIGVKVDAEQFGSQQVTRNYLLRGRIVPVPSNYDPVKRTYTGIWDGTFKPAWTDNPAWCVLDMLTHPRYGMGNRIGVADVDKWALYAIAQYCDQPVPDGFGGTEPRITCNAYLTDQRKAWDVLGDFCSLMRCMPVWNGSTLTFVQDRPSDKVWTYTQSNVVMPADGAPFVYSFSALKERHNAAEVRYTDPNNGWETSTELVENDAAIRRYGRNVLKMDAFACTSRGQAHRAGLWAITTELLETQTVDFSVGAEGLRHVPGDIIEVCDSDYAGVTVGGRVLSVDSLSRTLTLDREVDIPAGGNVVLNLVGSNGQPVTVAVTAHPAPDRVTVSQLPDGVAAYSVWGLKLPDLRQRLFRCVAIRENDDGTYAITAVQHVPEKESIVDNGAKFDPLPGTSITNTPPAVQHLTTEILAEEGQYQARARWDTPRVVKGVNFSLRLTVKAEDDSDRLASSLTLTETEHTFRNLTPGRYTLSVRAVNSQGQQGDPASTQFSISAPAAPSFIELTPGYFQITATPRQAVYDPTVQYEFWFSDAQITDIHQVENAARYLGTALYWIAASVNIRPGRDYYFYIRAVNRVGKSAFVEATGQASNDAAGYLDFFKGQITESHLGKELLEKVDLTEDNASKLQQFSKEWQDANGKWNAMWGVKIEQTEDGRHYVAGLGLSMEDTPDGKISQFLVAADRIAFINPQNGNQTPGFVMQGDQIFMNEAFLKYLSAPTITSGGNPPAFSLTPDGRLTAKNADISGHINAISGALNNVVIAEDCTIQGTLRAERILGDIVKAVGKEFPYFREPATGAKRYASGTLTVQIDDDQSFDRQIIIPPINFQGSYYGRNDTWDTCTLEVRRNGALIYSGTSSSVPESYGATLDMPAGGGIVTLTFSVSTRGNSTGWPNSRISDLILMVVKKSTAGIRIS
Physico‐chemical
properties
protein length:1131 AA
molecular weight: 123954,63690 Da
isoelectric point:5,14941
aromaticity:0,08488
hydropathy:-0,30106

Domains

Domains [InterPro]
IPR053171
Unmapped
1–839
DC_0014
STR
1–1125
IPR036116
STR
614–719
IPR003961
STR
617–700
IPR003961
STR
617–706
IPR013783
STR
646–713
YP_001700581.1
1 1131
Architecture
STR
ATT
STR
ATT
STR
ATT
STR
STR 1-85 | ATT 86-207 | STR 208-329 | ATT 330-495 | STR 496-714 | ATT 715-817 | STR 818-1131
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
YP_001700581.1
1 1131
Domain Start End Length (AA) Confidence
N-terminal 1 102 102 0,8797
Central domain 103 323 222 0,0373
C-terminal 324 1131 807 0,1548
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-102
Central
103-323
C-terminal
324-1131

Taxonomy

  Name Taxonomy ID Lineage
Phage Salmonella phage Fels-1
[NCBI]
128975 Viruses >
Host Salmonella enterica subsp. enterica serovar Typhimurium str. LT2
[NCBI]
99287 Bacteria > Proteobacteria > Gammaproteobacteria > Enterobacteriales > Enterobacteriaceae > Salmonella

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
YP_001700581.1 [NCBI]
Genbank nucleotide accession
NC_010391 [NCBI]
CDS location
range 33052 -> 36447
strand +
CDS
ATGGGTAAGGGTGGTGGCAGCAGTAAGACGCCGCATGAGGCTCCTGACGACCTGAAATCCAGTCAGATGCTGACCGTTGTTGATGCCATTTGCGAGGGGCCGATCGAAGGCCCGGTGGACGGGCTGAAAAGTGTCAGAATAAACAAAACCCCGGTCCTCGACAGTGACGGTAACGCGATGGTTCACGGTGTCACCGTGGTTTACCGCGTGGGCGAGGATGAGCAGTCTGCGATGGAGGGGTTTGAAGATTCCGGCGCTGAAACCCTGCTGGGTGTGGAGGTCAAAAAGTCAGAGCCGGTGACCCGCACCATTACCACCAAAACGGTGGACCGCCTGCGCTTTACCTTTGGTGTGCAGTCGCTGGTCAGTACCAGTACCAAAGGCGACCGCAACCCGACCAGTGTACAGATGCTGATCCAGTTTCGCCGTGATGGCCAGTGGCAGGTGGAACGGGATATTACCATTACGGGTAAAACGACCACGCAGTTTCTGGCGTCCGTGGTGATCGATGATTTGCCGCCCCGGCCGTTTGAAGTCCGCATGATGCGCATCACTGATGACAGTACGTCAGACCTGCTGCAGAACAAAACGGTGTGGTCGGGCTATACCGAAATCATTGATGTGAAACAGTGCTACCCGAACACCGCTGTTATCGGGGTAAAAGTGGATGCGGAACAGTTTGGCAGCCAGCAGGTCACGCGAAACTACCTTCTGCGCGGGCGTATTGTGCCGGTCCCGTCGAATTACGATCCGGTAAAACGGACATATACGGGAATATGGGACGGGACGTTTAAACCTGCCTGGACAGATAATCCGGCCTGGTGTGTGCTGGATATGCTGACTCACCCGCGCTATGGCATGGGAAACCGCATTGGTGTTGCCGATGTGGACAAGTGGGCGCTGTATGCCATTGCGCAATACTGTGATCAGCCCGTTCCGGACGGCTTCGGCGGGACAGAGCCGCGCATCACCTGCAATGCGTATCTGACGGACCAGCGTAAAGCGTGGGACGTGCTGGGGGATTTCTGTTCCCTGATGCGCTGCATGCCAGTGTGGAACGGCAGTACCCTGACGTTTGTGCAGGACCGGCCCAGCGATAAAGTCTGGACCTACACGCAGAGCAATGTGGTGATGCCCGCTGATGGAGCGCCATTCGTCTACAGCTTCAGCGCGCTGAAAGAGCGCCATAATGCCGCCGAGGTCCGCTACACCGACCCGAACAACGGCTGGGAAACCTCCACCGAACTGGTGGAAAATGACGCTGCCATCCGGCGCTACGGGCGCAACGTCCTTAAAATGGATGCGTTCGCCTGTACCAGTCGTGGGCAGGCGCACCGCGCAGGACTGTGGGCCATCACCACCGAATTACTGGAAACGCAGACGGTGGATTTTTCCGTGGGGGCAGAAGGGCTGCGTCACGTTCCCGGCGATATCATCGAGGTCTGTGACAGTGATTATGCCGGCGTGACCGTTGGCGGACGCGTCCTGTCAGTCGACAGCCTTTCCCGTACGCTTACGCTGGATCGTGAGGTGGATATACCGGCAGGCGGCAATGTGGTGCTGAACCTGGTGGGCAGTAATGGCCAGCCTGTTACCGTCGCGGTCACCGCGCACCCCGCCCCGGACCGCGTTACCGTCAGCCAGTTACCCGATGGCGTGGCGGCGTACAGCGTGTGGGGGCTGAAATTACCGGACCTGCGCCAGCGCCTGTTTCGCTGCGTGGCTATACGGGAAAACGATGACGGAACGTATGCCATCACCGCTGTGCAGCATGTCCCGGAGAAAGAGAGCATCGTGGACAACGGAGCGAAGTTTGACCCGTTGCCCGGAACCAGCATCACGAATACACCGCCCGCCGTGCAGCATCTCACTACGGAGATTCTGGCAGAAGAGGGACAGTATCAGGCGCGGGCGCGCTGGGATACCCCGCGCGTGGTGAAGGGGGTTAACTTCTCCCTGCGCCTGACAGTGAAAGCGGAAGATGACAGCGACCGCCTGGCCAGCAGCCTGACCCTGACCGAAACGGAGCATACCTTCCGCAACCTGACGCCGGGGCGCTACACCCTGTCCGTCAGGGCGGTGAACAGCCAGGGACAACAGGGAGACCCGGCCAGCACACAGTTCAGCATCTCCGCGCCGGCGGCACCATCATTTATCGAACTCACCCCTGGCTATTTCCAGATTACAGCCACACCGCGTCAGGCGGTATACGACCCGACGGTGCAGTATGAGTTCTGGTTTTCAGACGCGCAGATTACGGATATCCATCAGGTGGAAAACGCCGCACGATATCTGGGAACAGCGCTGTACTGGATAGCGGCCAGCGTGAATATCAGGCCCGGCAGGGATTACTATTTTTATATCCGGGCGGTAAATCGGGTCGGTAAATCCGCATTCGTGGAGGCGACCGGGCAGGCCAGCAACGATGCCGCAGGCTATCTGGATTTTTTCAAAGGGCAGATAACTGAAAGTCACCTGGGTAAGGAGCTGCTGGAAAAAGTAGATCTGACGGAGGATAACGCCAGCAAACTGCAGCAGTTTTCGAAGGAGTGGCAGGACGCGAACGGTAAGTGGAATGCCATGTGGGGCGTCAAAATAGAGCAAACCGAGGACGGCAGGCATTATGTGGCTGGTCTGGGCCTGAGCATGGAGGATACGCCGGACGGGAAGATAAGCCAGTTTCTGGTAGCAGCGGACCGCATTGCATTCATTAACCCGCAAAACGGAAACCAGACGCCCGGATTCGTCATGCAGGGTGATCAGATATTCATGAACGAGGCATTCCTGAAATACCTGAGCGCGCCGACCATCACCAGTGGCGGGAATCCTCCTGCGTTTTCCCTGACGCCGGACGGTCGTCTTACTGCGAAAAATGCGGACATCAGTGGGCATATTAATGCTATTTCGGGGGCGCTGAATAACGTCGTTATTGCTGAGGACTGCACGATTCAGGGGACGTTGCGGGCCGAACGTATCCTCGGCGATATAGTCAAAGCGGTGGGTAAAGAGTTCCCGTATTTCAGGGAGCCAGCCACCGGAGCAAAGCGTTACGCCAGTGGCACACTGACCGTTCAGATAGATGACGACCAGTCATTTGACCGCCAGATTATTATCCCCCCCATCAATTTTCAGGGGAGTTATTACGGACGCAATGATACGTGGGATACGTGTACGCTGGAAGTGCGCCGCAATGGCGCGCTGATTTACAGCGGAACGAGCAGCAGCGTTCCTGAGTCATACGGCGCCACGCTGGATATGCCCGCCGGAGGCGGCATTGTCACACTGACATTTAGTGTCAGTACCAGGGGGAACAGCACAGGATGGCCGAATTCCAGAATAAGCGATCTGATTCTGATGGTTGTTAAAAAATCCACTGCAGGGATTCGTATCAGTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
9c8a02814760d1e08d8c38e5aec585456c99f53646fabef3ad6388ca69687ccd
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,2898
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Complete genome sequence of Salmonella enterica serovar Typhimurium LT2 McClelland,M., Sanderson,K.E., Spieth,J., Clifton,S.W., Latreille,P., Courtney,L., Porwollik,S., Ali,J., Dante,M., Du,F., Hou,S., Layman,D., Leonard,S., Nguyen,C., Scott,K., Holmes,A., Grewal,N., Mulvaney,E., Ryan,E., Sun,H., Florea,L., Miller,W., Stoneking,T., Nhan,M., Waterston,R. and Wilson,R.K. 6858 11677609 GenBank
Refined annotation of the phage genomes integrated into the Salmonella typhimurium LT2 genome Lingohr,E.J., Villegas,A. and Kropinski,A.M. 2010-11-24 GenBank