Protein
View in Explore- Genbank accession
- UMO75436.1 [GenBank]
- Protein name
- central tail fiber
- RBP type
-
TFTSPTF
- Protein sequence
-
MGKGSSKGHTPREAKDNLKSSQMLSVIDAISEGPVEGPVDGLKSVLLNSTPVLDSEGNTNIFGVTVVFRAGEQEQTPPEGFESSGSETVLGTEVKYDTPITRTITSANIDRLRFTFGVQALVETTSKGDRNPSEVRLLVQIQRNGGWVTEKDITIKGKTTSQYLASVVVDNLPPRPFNIRMRRMTPDSTTDQLQNKTLWSSYTEIIDVKQCYPNTALVGVQVDSEQFGSQQVSRNYHLRGRILQVPSNYNPQTRQYSGIWDGTFKPAYSNNMAWCLWDMLTHPRYGMGKRLGAADVDKWALYVIGQNCDQSVPDGFGGTEPRITCNAYLTTQRKAWDVLSDFCSAMRCMPVWNGQTLTFVQDRPSDKVWTYNRSNVVMPDDGAPFRYSFSALKDRHNAVEVNWIDPDNGWETATELVEDTQAIARYGRNVTKMDAFGCTSRGQAHRAGLWLIKTELLETQTVDFSVGAEGLRHVPGDVIEICDDDYAGISIGGRVLAVNNQTRTLTLDREITLPSSGTTLISLADGQGNPVSVEVQSVTDGVKVKVSRVPDGVAEYSVWGLKLPTLRQRLFRCVSIRENDDGTYAITAVQHVPEKEAIVDNGAHFDGDQSGTVNGVTPPAVQHLTAEVTADSGEYQVLARWDTPKVVKGVSFMLRLTVAADDGSERLVSTARTTETTYRFRQLAPGNYRLTVRAVNAWGQQGDPASVSFRIAAPAAPSQIELTPGYFQITATPHLAVYDPTVQFEFWFSEKRIADIRQVETTARYLGTALYWIAASINIKPGHDYYFYIRSVNTVGKSAFVEAVGQPSDDASGYLNFFKGEIGKTHLAQELWTQIDNGQLAPDLAEIRTSITGVSNEITQTVNKKLEDQSAAIQQIQKVQVDTNNNLNSMWAVKLQQMQDGRLYIAGIGAGVENTPDGMQSQVLLAADRIAMINPANGNTKPMFVGQGDQIFMNEVFLKYLTAPTITSGGNPPTFSLTPDGRLSAKNADISGNVNANSGTLNNVTINQNCRILGKLSANQIEGDIVKTVGKAFPRNGSYASGTITVTVYDDQAFDRQIVVPPVLFRGGKHENFNSNNQQSYWYSTCKLQVLKNGQEIFQQPATDVSRVFSSVIDMPAGHGHVTLTFNVSSYGANNWTPTTSISDLLVVVMKKSTAGISIS
- Physico‐chemical
properties -
protein length: 1160 AA molecular weight: 127282,30940 Da isoelectric point: 5,69711 aromaticity: 0,08190 hydropathy: -0,33147
Domains
Domains [InterPro]
IPR053171
Unmapped
1–837
Unmapped
1–837
DC_0014
STR
1–1157
STR
1–1157
IPR055385
ATT
86–207
ATT
86–207
IPR055383
STR
610–714
STR
610–714
IPR036116
STR
617–717
STR
617–717
IPR003961
STR
618–701
STR
618–701
IPR003961
STR
618–710
STR
618–710
IPR003961
STR
620–715
STR
620–715
1
1160
Architecture
STR 1-85 | ATT 86-207 | STR 208-330 | ATT 331-498 | STR 499-715 | ATT 716-818 | STR 819-1160
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1160
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 1021 | 1021 | 0,9167 |
| Central domain | 1022 | 1149 | 129 | 0,1731 |
| C-terminal | 1150 | 1160 | 10 | 0,9876 |
Note: Constraints were applied during segmentation.
Fixed 50 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Fixed 50 C-terminal predictions appearing before Central domain|Sequence started with non-N-terminal domain|C-terminal too short, adjusted boundary
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-1021
1-1021
Central
1022-1149
1022-1149
C-terminal
1150-1160
1150-1160
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Escherichia phage 21 [NCBI] |
2910191 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Escherichia coli [NCBI] |
562 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
UMO75436.1
[NCBI]
Genbank nucleotide accession
OL657228.1
[NCBI]
CDS location
range 15693 -> 19175
strand +
strand +
CDS
ATGGGTAAAGGCAGCAGTAAGGGGCATACCCCGCGCGAAGCGAAGGACAACCTGAAATCATCCCAGATGCTGAGCGTGATAGACGCCATCAGCGAAGGGCCGGTTGAAGGTCCGGTGGATGGATTAAAAAGCGTGCTGCTGAACAGTACGCCGGTGCTGGACAGTGAGGGGAATACCAATATATTCGGCGTCACGGTGGTGTTCCGGGCCGGTGAGCAGGAGCAGACACCGCCGGAGGGATTTGAATCCTCCGGCTCCGAGACGGTGCTCGGTACAGAAGTGAAATATGACACGCCGATCACCCGGACCATCACGTCGGCAAACATTGACCGTCTGCGTTTTACTTTCGGCGTGCAGGCACTGGTGGAAACCACCTCAAAGGGGGACAGGAATCCATCGGAAGTCCGCCTGCTGGTTCAGATTCAACGTAACGGTGGCTGGGTGACGGAAAAAGACATCACCATTAAGGGCAAAACCACGTCGCAGTATCTGGCCTCGGTGGTGGTGGATAACCTGCCGCCGCGCCCGTTTAATATCCGGATGCGCAGGATGACGCCGGACAGCACCACAGACCAGTTGCAGAACAAAACGCTCTGGTCGTCATACACCGAAATCATCGATGTGAAACAGTGCTACCCGAACACGGCACTGGTCGGCGTACAGGTGGACTCGGAGCAGTTCGGCAGCCAGCAGGTGAGCCGTAATTATCATCTTCGCGGGCGCATTCTGCAGGTGCCGTCGAACTATAACCCGCAGACGCGGCAATACAGCGGTATCTGGGACGGAACGTTTAAGCCAGCATACAGCAACAACATGGCCTGGTGTCTGTGGGATATGCTGACCCATCCGCGCTACGGCATGGGGAAACGTCTTGGTGCGGCAGATGTGGATAAATGGGCGCTGTATGTCATCGGCCAGAATTGCGACCAGTCAGTGCCGGACGGCTTTGGCGGCACGGAGCCGCGCATCACCTGTAATGCGTACCTGACCACACAGCGCAAGGCGTGGGATGTGCTCAGTGATTTTTGCTCGGCGATGCGCTGTATGCCGGTATGGAACGGGCAGACGCTGACATTCGTGCAGGACCGACCGTCGGATAAGGTGTGGACCTATAACCGCAGTAATGTGGTGATGCCGGATGATGGCGCGCCGTTCCGCTACAGCTTCAGCGCCCTGAAAGACCGCCATAATGCCGTTGAGGTGAACTGGATTGACCCGGATAACGGCTGGGAGACGGCGACAGAGCTTGTGGAGGACACGCAGGCCATTGCCCGTTACGGTCGTAACGTCACGAAGATGGATGCCTTTGGCTGTACCAGCCGGGGGCAGGCACACCGCGCCGGGCTGTGGCTGATTAAAACGGAGCTGCTGGAAACGCAGACCGTGGACTTCAGCGTGGGTGCAGAAGGGCTTCGCCATGTACCGGGCGATGTCATTGAAATCTGTGATGATGACTATGCGGGGATCAGCATCGGCGGGCGCGTGCTGGCGGTGAACAACCAGACGCGGACACTGACGCTCGACCGTGAAATCACGCTGCCATCCTCCGGCACCACGCTGATAAGCCTGGCTGACGGACAGGGGAATCCGGTCAGCGTGGAGGTCCAGTCCGTCACCGACGGCGTGAAGGTAAAAGTGAGCCGTGTTCCTGACGGCGTTGCAGAATACAGCGTGTGGGGGCTGAAGTTGCCAACGTTGCGCCAGCGCCTGTTCCGCTGTGTGAGTATCCGTGAGAACGATGACGGCACGTATGCCATCACTGCCGTGCAGCATGTACCGGAAAAAGAGGCCATCGTGGATAACGGGGCGCACTTTGACGGCGACCAGAGCGGCACGGTGAATGGTGTCACGCCGCCAGCGGTGCAGCACCTGACTGCCGAAGTCACCGCAGACAGCGGGGAATATCAGGTGCTGGCGCGCTGGGACACGCCGAAGGTGGTGAAGGGGGTGAGCTTTATGCTTCGCCTGACCGTGGCAGCGGATGACGGCAGTGAGCGGCTGGTCAGCACGGCCCGGACGACGGAAACCACATACCGCTTCAGGCAACTGGCGCCAGGGAACTACAGGCTGACAGTCCGGGCGGTAAATGCGTGGGGGCAGCAGGGCGATCCGGCATCGGTATCGTTCCGGATTGCCGCACCGGCAGCGCCGTCGCAGATTGAGCTGACACCGGGGTATTTTCAGATAACCGCCACGCCGCATCTTGCGGTTTATGATCCGACGGTACAGTTTGAGTTCTGGTTCTCGGAAAAGCGGATTGCGGATATCAGGCAGGTTGAAACCACAGCACGCTATCTTGGCACGGCGCTGTACTGGATAGCCGCCAGTATCAATATCAAACCGGGCCATGATTATTATTTTTACATCCGCAGTGTGAACACCGTTGGCAAATCGGCATTTGTGGAGGCTGTTGGCCAGCCGAGTGATGATGCATCCGGCTATCTGAATTTTTTCAAAGGAGAGATAGGGAAAACCCATCTGGCTCAGGAGTTGTGGACGCAGATTGATAACGGTCAGCTTGCGCCTGACCTGGCTGAAATCAGGACGTCCATTACGGGTGTCAGCAATGAAATCACGCAGACCGTCAATAAGAAACTGGAAGACCAGAGTGCAGCGATCCAGCAGATACAGAAGGTTCAGGTTGATACAAATAATAACCTGAACAGCATGTGGGCTGTGAAGCTGCAGCAGATGCAGGACGGACGCCTTTATATCGCGGGTATTGGTGCCGGTGTTGAGAATACTCCTGACGGTATGCAGAGTCAGGTGCTGCTGGCGGCGGACAGGATTGCGATGATTAATCCTGCGAATGGCAACACAAAGCCGATGTTTGTTGGGCAGGGCGATCAGATATTCATGAACGAAGTGTTCCTGAAATATCTGACGGCTCCCACCATTACCAGCGGTGGCAATCCCCCAACGTTTTCACTGACACCTGATGGTCGACTTTCTGCGAAAAATGCGGATATCAGCGGTAACGTGAACGCGAACTCCGGGACGCTCAACAACGTCACGATTAATCAGAACTGTCGGATTCTGGGAAAACTGTCAGCTAACCAGATTGAAGGTGATATTGTCAAAACGGTGGGAAAAGCCTTTCCGAGAAATGGCAGTTATGCCAGCGGTACAATAACGGTCACTGTGTACGATGACCAGGCTTTTGACCGTCAGATAGTAGTCCCCCCCGTTCTGTTTCGTGGGGGTAAGCATGAAAACTTCAACAGCAACAACCAACAGTCATACTGGTATTCAACCTGTAAGCTGCAGGTACTGAAGAACGGACAGGAAATCTTTCAGCAACCCGCGACGGATGTCAGCAGGGTATTTTCATCAGTCATTGATATGCCTGCCGGACACGGCCATGTCACCCTGACTTTCAATGTTTCTTCATATGGTGCTAATAACTGGACGCCAACGACCAGTATCAGCGACCTTCTTGTTGTTGTGATGAAGAAATCTACAGCCGGTATCAGTATCAGTTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
b62d0e2d2cc5b8e58aaeec1a47f3cefbe0743e66395957fe15b63473bab8e226
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50
Literature
| Title | Authors | Date | PMID | Source |
|---|---|---|---|---|
| The complete genome sequences of lambdoid phages 21, 434, and 434B | Feiss,M., Young,R., Ramsey,J., Adhya,S., Georgopoulos,C.P., Hendrix,R.W., Hatfull,G.F., Gilcrease,E.B. and Casjens,S.R. | — | — | GenBank |