Genbank accession
URC22436.1 [GenBank]
Protein name
central tail fiber J
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,63
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MMKTERFEVIDGSKGGGGSSHTPVESPDSLQSLAKARILLALSEGEVQGIDPANLAKQVYLDGTVVENADGSRNFEDVRLEFRSGTNDQEPIAGFNAVENEIGIGVDLKASAAWTRAVTNRNIDAVNIRIGFPQLTTQEDNGDINGGDVHYQIALQTDGGAFSVVADLHATGKTTTLYERTHRIDLPRANTGWQLRVTRLTPDSTSAKVVNPTRIQAFTEIVDAKLRYPLTALLFVEYNAKSFQNVPKASIKMKGRVIRVPNNYDPIARTYSGQWDGQFKWAWSNNPAWIWYDFCLGERFGLGRKIKPEMLDKWELYDIAQRCDQRVPDGRGGTGTEPRFTLDLYVQGRAQAWQLMKDIAAVFAGMTYWGQGMLNMVSDRPAEVENVVTRASVLDGKFTYSSGDKKNRYNAYTVSYSDPLNHYADVVTADSVQELVQRYRGVNALEITALGCTSEREAKARGLWALLSNNYDRMFEFSLGFDGVNFLPGDVIGIMDDRLSRKADGTPAVYGGRMGNVVNTTQMVLDRATDGKVGDTFMVRTLGGRLEKRVIQSVSADRMTVTVAPGFAARPQPNAVWVIDAVGQMTVQLARVVSMAPDEDASTYKIAAISYNASKYDAVDNGTRIDERPISLMPPSVQAPPASVSITGHDQLWQGMTMQTASITWPAADGAQSYDVQWRRNNSDWINVPRTNGTGIDLPGIYAGDYIARVRAVNSVGFSSVWTTSPTVTLTGKIGTPTAPLNFMGEPLIGGIHLKWAFPNGSDDLSHTEVIYRIPGDPTEYPLFNVAYPGAGFDHMGMNPSTYREYRARCVDKLGNVSPWTDWITASSSDDIGGYMDGIVDGFLGSDAGQNLVEKIDISGEAILQNALANHADIQQRLLVDGQNRAQVLQIQTTVSDQNQTMASLEQQVSAQRTILDEQGNKLDEVGAAVNQKMQATVNYDGSASAQYSLKAGVMWNGKLYDAGMVLGVQQSGGVVKSMFGVKADQFVVLNGDNNVYSSPFLIDNGNTFINSAYIKDASITNAKIGNYIQSNNYHWDDDPNKRTGWAINKNGDAVFASAQVSGGIYARWGVMDNVTINDTCVINGTLSANNIRGDIFAARGNGWWLQKINTGAGAYQRWYICAVELYPEFERKLAFRGGLWAEASGGSGTGGGAKIWCGGLLLQQVGGYPGYNGPVRIDVSDMEFTLPAGTGQHMIYVEIQSGFNDRTDFYLQIGDWDHPAQGGLPSGNPSNQSRPKVGGGLTIEVTKLNNNVVSPLPLNRWPQGF
Physico‐chemical
properties
protein length:1266 AA
molecular weight: 138229,19950 Da
isoelectric point:5,26655
aromaticity:0,09163
hydropathy:-0,32622

Domains

Domains [InterPro]
DC_0014
STR
1–1165
IPR053171
Unmapped
2–912
IPR003961
STR
640–734
IPR003961
STR
640–729
IPR036116
STR
660–826
URC22436.1
1 1266
Architecture
STR
ATT
STR
ATT
STR
STR 1-97 | ATT 98-224 | STR 225-349 | ATT 350-500 | STR 501-1165 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
URC22436.1
1 1266
Domain Start End Length (AA) Confidence
N-terminal 1 511 511 0,8731
Central domain 512 1027 517 0,0454
C-terminal 1028 1266 238 0,6525
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-511
Central
512-1027
C-terminal
1028-1266

Taxonomy

  Name Taxonomy ID Lineage
Phage Serratia phage vB_SmaM-Susuwatari
[NCBI]
2943837 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host Serratia marcescens
[NCBI]
615 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
URC22436.1 [NCBI]
Genbank nucleotide accession
ON287371.1 [NCBI]
CDS location
range 35389 -> 39189
strand +
CDS
ATGATGAAGACAGAACGTTTTGAAGTAATCGACGGGTCAAAGGGCGGGGGCGGCAGCTCCCACACCCCTGTAGAATCCCCGGACAGCCTGCAGTCGCTGGCGAAGGCGCGCATCTTGCTGGCGCTTTCCGAGGGCGAGGTGCAGGGCATCGACCCGGCCAACTTGGCCAAACAGGTCTACCTCGACGGGACGGTGGTCGAGAACGCCGACGGCTCGCGCAACTTTGAAGACGTCCGGCTAGAGTTCCGCTCAGGCACGAACGACCAAGAGCCGATCGCCGGGTTCAACGCCGTCGAGAACGAGATCGGAATCGGCGTCGACCTGAAAGCCTCGGCCGCGTGGACTCGCGCCGTGACCAACCGCAACATTGACGCGGTAAACATCAGAATCGGCTTCCCGCAGCTGACCACGCAGGAGGACAACGGCGACATTAACGGCGGCGACGTCCACTATCAGATCGCCCTGCAGACTGACGGAGGCGCGTTCAGCGTCGTGGCCGACCTGCACGCGACTGGCAAGACGACCACGCTTTACGAGCGCACCCATCGGATTGACTTGCCGAGGGCTAACACCGGGTGGCAGCTCCGGGTTACTCGCCTGACGCCGGACAGCACCAGCGCCAAGGTTGTAAACCCAACGCGCATTCAGGCATTCACGGAAATTGTGGACGCCAAGCTGCGCTACCCGCTCACCGCGCTGCTGTTCGTCGAGTACAACGCCAAATCGTTCCAGAACGTGCCGAAGGCATCGATCAAGATGAAAGGCCGTGTTATCCGCGTGCCTAACAACTATGACCCGATCGCCCGCACCTACTCTGGCCAGTGGGATGGGCAATTTAAATGGGCGTGGAGCAATAACCCGGCGTGGATTTGGTATGACTTCTGCCTTGGCGAGCGGTTCGGCCTTGGCCGCAAGATCAAGCCTGAAATGCTGGACAAGTGGGAGTTGTACGACATTGCCCAGCGTTGCGACCAGCGCGTGCCAGACGGCCGAGGCGGCACCGGGACAGAGCCACGCTTCACGCTTGACCTGTACGTTCAGGGCCGGGCGCAGGCATGGCAGCTCATGAAGGACATTGCAGCCGTCTTTGCCGGGATGACCTATTGGGGGCAGGGCATGCTGAACATGGTTTCAGACCGTCCTGCAGAGGTAGAAAACGTCGTGACGCGCGCCAGCGTGCTGGACGGTAAATTTACCTACAGCTCAGGCGACAAAAAGAACCGCTATAACGCCTACACCGTCAGCTACAGCGACCCGCTGAACCATTACGCCGACGTTGTCACGGCTGACAGCGTTCAGGAGTTAGTTCAGCGCTACCGCGGCGTAAACGCACTGGAGATTACCGCGCTGGGCTGTACCAGTGAGCGAGAAGCCAAGGCGCGCGGACTCTGGGCGTTGCTGTCGAACAACTACGATCGGATGTTCGAGTTCTCCCTGGGCTTCGACGGCGTCAACTTCCTGCCGGGCGACGTGATCGGCATCATGGACGACAGGCTATCCCGCAAGGCTGACGGCACTCCTGCAGTATACGGCGGCCGCATGGGCAACGTGGTGAACACCACGCAAATGGTTCTCGATCGGGCAACCGACGGGAAAGTCGGCGATACGTTCATGGTTCGCACTCTGGGCGGCCGCCTTGAGAAACGCGTCATCCAGAGCGTCAGCGCTGACCGCATGACCGTGACCGTTGCGCCGGGATTCGCAGCTCGTCCGCAACCGAACGCGGTTTGGGTGATCGACGCCGTTGGCCAGATGACTGTCCAGCTGGCGCGCGTGGTATCCATGGCGCCGGACGAAGACGCGTCAACGTACAAGATTGCGGCCATCAGCTACAACGCGAGCAAATACGATGCGGTCGACAACGGGACGCGCATCGACGAGCGCCCGATCTCACTGATGCCGCCCAGCGTTCAGGCTCCCCCGGCTTCCGTGTCCATCACCGGCCACGATCAGCTCTGGCAGGGTATGACCATGCAGACGGCTTCGATCACTTGGCCGGCCGCTGACGGCGCGCAGAGCTATGATGTGCAATGGCGCCGCAATAACAGCGACTGGATCAATGTGCCTCGCACCAATGGCACCGGGATTGACCTGCCGGGCATCTATGCCGGTGACTACATCGCCCGCGTGCGTGCGGTCAACTCCGTGGGCTTCTCGTCCGTGTGGACGACGTCGCCAACTGTTACCCTGACCGGGAAGATCGGCACGCCTACGGCGCCGTTGAACTTCATGGGAGAGCCGTTGATCGGCGGCATTCATCTGAAATGGGCCTTCCCGAATGGTAGCGATGACCTGTCACACACCGAGGTTATCTACAGAATCCCCGGCGACCCGACAGAGTATCCGCTCTTTAACGTGGCCTATCCGGGCGCAGGCTTCGACCACATGGGCATGAACCCGTCGACCTATCGCGAGTACCGCGCGCGCTGCGTGGACAAGCTGGGCAACGTGTCGCCGTGGACTGACTGGATCACCGCCAGCTCGTCCGACGACATTGGCGGCTACATGGATGGCATTGTCGATGGCTTCCTTGGCTCAGACGCTGGCCAGAACCTCGTCGAGAAGATCGACATTAGCGGCGAGGCAATCCTGCAGAACGCGCTGGCCAACCACGCCGACATTCAGCAGCGCCTGCTGGTAGACGGCCAGAACCGGGCGCAGGTGCTGCAGATTCAGACCACTGTCAGCGACCAGAATCAGACCATGGCCAGCTTGGAGCAGCAGGTTAGCGCGCAGCGCACGATCTTGGACGAGCAGGGCAACAAGCTGGACGAGGTGGGCGCAGCGGTTAATCAGAAGATGCAGGCGACCGTGAACTATGACGGCAGCGCATCGGCTCAATACTCGCTGAAAGCTGGCGTTATGTGGAATGGAAAACTCTATGACGCTGGCATGGTGCTGGGCGTTCAGCAGAGTGGTGGCGTGGTTAAGTCCATGTTCGGCGTGAAGGCTGACCAGTTCGTCGTATTGAACGGGGATAATAACGTTTACTCGTCCCCGTTCCTGATCGATAACGGTAATACGTTCATCAACTCGGCCTATATCAAGGACGCGTCGATCACCAACGCCAAGATTGGGAACTATATTCAGTCGAATAACTACCATTGGGACGATGACCCGAATAAGCGGACAGGTTGGGCCATCAACAAGAACGGCGACGCAGTATTTGCCAGCGCTCAGGTCTCGGGCGGCATCTATGCGCGCTGGGGCGTGATGGACAACGTGACCATTAACGACACCTGCGTGATCAATGGCACCCTGTCGGCGAACAATATCCGCGGTGACATTTTCGCAGCGCGCGGCAATGGTTGGTGGCTGCAAAAGATTAACACCGGCGCAGGCGCATATCAGCGTTGGTATATTTGCGCGGTTGAGCTTTACCCGGAATTCGAGAGAAAACTGGCTTTTCGTGGTGGTTTGTGGGCGGAGGCTTCTGGCGGCTCAGGCACTGGCGGCGGAGCTAAAATCTGGTGCGGCGGCCTCCTGCTGCAGCAAGTTGGCGGATATCCGGGTTATAACGGCCCTGTGCGCATCGATGTGTCTGATATGGAATTCACGCTGCCAGCTGGCACCGGGCAACACATGATTTACGTTGAAATCCAATCCGGGTTTAACGACCGCACGGACTTCTACCTGCAGATCGGCGACTGGGATCACCCGGCGCAAGGCGGCCTACCGTCTGGCAACCCGTCGAACCAATCCCGGCCGAAGGTTGGCGGCGGTTTGACTATCGAAGTGACGAAGCTCAATAATAACGTTGTCTCGCCGCTGCCTCTCAACCGATGGCCGCAAGGCTTCTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
83f0bbb1adf28d389ead67879fc9f4833e103b1560c7935065ac03ba3a2b020a
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,2781
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50