Protein
View in Explore- Genbank accession
- WCZ66306.1 [GenBank]
- Protein name
- long tail fiber proximal subunit
- RBP type
-
TF
- Protein sequence
-
MADLIKQKFRATFGLDAGGEKVINVAKADKEILSDGVNVEYFYEQNTIQHYDETRGYDQHFAVIFDNRIYYSLEEIASPAGAFTESKWQSLRVDPKWIYTPMTPPTGLALKPGTYISADTRNNDLLFTLPPNPQDGDTLYIKEIGGNTGYKELKIKKTNQRIHAYGNQVDEILITRPYSQVLMIFSNRLWQLYITEREETGRIISPAMGESRIQSGDKVYRRSSLGKITIALPKNAVQGDVIELFDLDGRTPVNHLIIKVTNQDHSIGDLTIKEQEVRTSGNGRLVFDASDKLWRVWEGDLRTRLRIIREDINLLPNDAVMVFGANNAESKTINITLPASVAIGDSIDISLNYMRKGQKVNIIAGNGDTIATNKNLLQFPKRSEYPPDVEWVQVKSVQFDGALDYVPFLRLSYIEDRQAKTQYWVITESNPTVERVDSKTNETRKRVGVIALASQEQANANHEDTPEKELAITPETLANRTATETRRGIARLATSKEMTLDTVADHLDDVIVTPKKFNECTATETRRGVAEVATQVETNEGKDDTTIVTPKKLDARRATEGLAGIAPLVASGGVAGKDRDTVGTGIYERTEHTKQVTPKVLFENKATPTAQGGVYLATEVETISAPKDIPAFPLAVTPEQLHKKTATEDRIGFSELATQEETNKGEDDFRIVTPKKLNDRTANEKLTGIARITTQEEFDLGEHDRVIATPKKIKTHFNDLGRTEVVDASGLVEEGTLWDHYKLDIKEASEDQRGTAKTATQLQVDKGLDAKTIVTPATLQKKKATEEVEGIVQIATSTETIEGTVGNKAVSPKNLINVIQTEKTWEATETRRGPVTLSEDALTWVGNDTDGSTKLDEEYEHEGYSISPREMNKTLRHYLPKLGKAFDSGKLGGQTPDKYIRRDIDQEVKGKLTLTNDTIVKAPITSSSTAAFTDVTASKSITAGTNDATVTGVINIKGEGNSWTSTAPAKTETLVFGSDTPVLTLKKGGDVKVEQSLSAGNKVNADKAFTLADVVVIQDKAGSITIGSVSQPTVIQTKDASDIKVTDQNGTSTVITTKNFETQVGTKFVKLAGDTMTGSLTLENASVLSKRVPVNSSAVPTAPTLGFWSAEIKDKAVYDTYPGAWTRKVNGEKDAEYKGPGTLTQFGNTLDTVYQDWVVKAPEVKNPARYTRSWDNKAKSWSTWARVYSDLDRPSASEVGAVPSTDATFKDLTIIDWLRIGNVKIYPDEATRTVKFEWIDD
- Physico‐chemical
properties -
protein length: 1241 AA molecular weight: 136841,87010 Da isoelectric point: 5,45816 aromaticity: 0,06688 hydropathy: -0,50629
Domains
Domains [InterPro]
DC_1946
ATT
1–211
ATT
1–211
IPR048391
ATT
1100–1188
ATT
1100–1188
1
1241
Architecture
ATT 1-211 | STR 345-1099 | ATT 1100-1188 | STR 1189-1230 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Yersinia phage MHG19 [NCBI] |
3025402 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host |
Yersinia pestis [NCBI] |
632 | cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
WCZ66306.1
[NCBI]
Genbank nucleotide accession
OQ331036
[NCBI]
CDS location
range 78613 -> 82338
strand -
strand -
CDS
ATGGCCGATTTAATTAAGCAAAAATTCAGAGCCACGTTCGGTCTGGATGCAGGCGGTGAGAAAGTAATTAACGTCGCTAAAGCTGATAAAGAAATTCTATCAGATGGCGTGAACGTTGAATATTTCTACGAACAAAATACAATCCAGCACTACGATGAAACTCGTGGATACGATCAGCACTTCGCTGTTATCTTTGATAACCGTATCTATTACTCATTAGAAGAAATCGCTTCTCCTGCGGGCGCTTTCACAGAATCAAAATGGCAGTCACTGCGTGTTGACCCTAAATGGATTTACACTCCAATGACTCCACCTACCGGGTTAGCATTAAAACCAGGTACTTATATTTCTGCAGATACTCGTAACAACGATCTTCTGTTCACTTTACCACCAAATCCACAGGATGGTGATACTCTTTATATTAAAGAAATCGGCGGTAACACAGGTTATAAAGAACTAAAAATTAAGAAGACTAATCAGCGCATTCATGCATATGGTAATCAAGTTGATGAAATTCTGATCACTCGTCCATATTCTCAAGTGTTGATGATCTTTAGTAACCGTTTGTGGCAGCTGTACATCACTGAGCGTGAAGAAACTGGACGAATCATTTCTCCAGCTATGGGTGAATCCCGTATTCAGTCAGGTGATAAAGTTTATCGTCGTTCATCACTAGGAAAGATCACAATTGCTCTTCCTAAAAACGCTGTACAAGGCGATGTGATTGAACTGTTTGACTTGGATGGTCGTACTCCAGTAAACCACTTAATTATTAAAGTTACCAATCAAGATCATTCAATTGGCGATCTGACTATTAAAGAACAAGAAGTTCGTACTTCAGGTAATGGTCGTTTGGTGTTTGATGCTTCTGATAAATTGTGGCGTGTATGGGAAGGTGACCTTCGTACTCGCCTGCGTATTATTCGCGAAGATATCAATTTGCTTCCAAACGATGCAGTGATGGTATTTGGTGCTAATAACGCTGAAAGCAAAACTATCAACATCACTTTACCCGCTTCAGTAGCTATCGGTGATTCAATCGATATTTCTCTGAACTATATGCGTAAAGGTCAGAAAGTCAATATCATTGCTGGTAATGGCGATACGATTGCTACTAATAAGAATCTGTTGCAATTCCCTAAACGTTCAGAATATCCACCTGACGTTGAATGGGTACAGGTTAAATCAGTACAGTTCGACGGTGCATTGGATTATGTTCCATTCTTGCGTCTTTCTTATATAGAAGATCGTCAAGCTAAAACTCAGTACTGGGTAATTACTGAATCTAATCCTACAGTAGAACGTGTTGACTCTAAAACGAATGAAACCCGTAAACGTGTAGGTGTTATTGCTCTTGCTTCTCAAGAACAAGCTAACGCGAACCATGAAGACACGCCAGAAAAAGAATTGGCAATCACTCCAGAGACTTTAGCAAATCGTACCGCTACTGAAACTCGTCGCGGTATTGCTCGTTTGGCTACATCTAAAGAAATGACTTTAGACACTGTAGCAGATCATCTGGACGATGTCATCGTTACTCCTAAGAAGTTCAACGAATGCACTGCTACTGAAACTCGTCGTGGTGTCGCTGAAGTTGCTACTCAAGTTGAAACTAACGAAGGTAAAGATGATACCACAATAGTTACTCCTAAGAAATTAGATGCACGACGTGCTACTGAAGGCTTAGCTGGTATCGCTCCGTTGGTTGCTTCAGGTGGTGTTGCAGGTAAAGATCGTGATACCGTTGGTACTGGAATCTACGAACGTACTGAACACACCAAGCAAGTTACGCCTAAAGTCCTGTTTGAAAATAAGGCAACCCCTACTGCACAAGGTGGTGTTTACTTAGCAACTGAAGTAGAAACTATTTCTGCTCCTAAGGATATTCCTGCGTTCCCACTGGCAGTAACTCCTGAACAGCTGCATAAGAAAACTGCTACTGAAGATCGCATCGGTTTCTCTGAACTTGCTACACAAGAAGAGACCAACAAAGGTGAAGATGATTTCCGAATCGTTACTCCTAAGAAGCTGAATGACCGTACAGCTAACGAGAAGTTGACTGGTATTGCTCGAATCACCACACAAGAAGAATTTGATCTTGGTGAACATGACCGAGTAATTGCTACTCCTAAAAAGATCAAGACTCATTTCAATGATCTTGGTCGTACCGAAGTAGTTGATGCGTCCGGCTTAGTAGAAGAAGGAACCTTGTGGGACCATTATAAACTTGATATCAAGGAAGCGTCTGAAGATCAACGCGGCACCGCTAAAACGGCGACACAATTACAAGTTGATAAAGGATTAGATGCCAAGACGATTGTAACTCCTGCTACTCTTCAGAAGAAAAAAGCTACTGAAGAAGTTGAAGGTATCGTTCAGATCGCTACATCAACTGAAACGATTGAAGGAACTGTCGGTAATAAAGCTGTATCTCCTAAGAATTTGATCAATGTTATTCAGACTGAGAAAACTTGGGAAGCTACTGAAACTCGTCGTGGTCCTGTTACTTTATCTGAAGATGCATTAACTTGGGTTGGTAACGATACTGATGGATCGACAAAGCTAGACGAAGAATACGAGCATGAGGGATATAGTATTTCTCCTCGTGAAATGAATAAGACTCTTCGTCATTATTTACCTAAACTTGGTAAAGCTTTCGACTCTGGTAAGTTAGGTGGTCAAACTCCTGATAAGTATATCCGTCGTGATATCGATCAAGAAGTCAAAGGTAAGTTAACTCTGACTAATGACACGATTGTTAAGGCTCCTATCACCTCGAGCTCCACTGCGGCATTTACTGATGTCACTGCTAGTAAATCTATTACTGCTGGAACGAATGACGCCACGGTCACTGGCGTGATCAATATCAAAGGTGAAGGTAACTCTTGGACTTCAACCGCGCCGGCTAAAACTGAGACTTTGGTATTTGGTTCTGATACTCCAGTGTTGACCTTGAAGAAAGGTGGCGATGTTAAGGTTGAACAATCTCTTTCTGCTGGTAATAAAGTAAACGCTGATAAGGCATTCACTTTGGCAGATGTTGTTGTTATCCAAGACAAAGCTGGTTCAATTACGATTGGTTCAGTATCTCAGCCAACTGTTATCCAGACTAAAGACGCTTCTGATATCAAAGTTACTGATCAGAACGGAACTTCTACTGTTATCACCACTAAGAACTTTGAAACACAAGTTGGTACTAAGTTCGTTAAATTAGCTGGTGACACAATGACTGGTTCATTGACTTTAGAAAATGCTTCTGTACTTTCTAAACGAGTTCCAGTTAATTCAAGTGCTGTTCCAACTGCACCCACGCTTGGTTTCTGGTCAGCTGAAATCAAAGATAAAGCAGTTTATGACACTTACCCAGGCGCCTGGACCCGTAAAGTGAACGGTGAGAAAGATGCCGAATACAAAGGTCCTGGTACTCTTACCCAGTTTGGTAACACTCTGGATACAGTTTATCAAGATTGGGTAGTTAAAGCTCCTGAAGTTAAAAACCCTGCGCGATACACTCGTTCGTGGGACAACAAGGCTAAGTCTTGGTCAACTTGGGCTCGTGTTTATTCTGATCTGGATCGTCCATCAGCTTCAGAAGTTGGCGCAGTACCAAGCACCGATGCTACCTTTAAAGATTTAACGATCATTGATTGGCTGCGTATCGGTAACGTCAAGATTTATCCTGATGAAGCTACACGTACTGTTAAATTCGAATGGATTGACGATTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
93f7558dd7bc03db4278effe248b3ff9dcb4e4521b559853384dd6fb05f3c5e4
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50