Protein
View in Explore- Genbank accession
- QWY83949.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TF
- Protein sequence
-
MADWGVGNRGTLRITDDGSVVRFYVLCSDPQTYVGSYNWGGTVNGVGVGGTVTLNRGFGSRELGAWGVGYTQNVGISQAATGTSGLGGAAGPFWVTIYRATVPSPPTGVAVDSATATSLRYRFSGNSDGGSPIREWQIGYGTSPSTVQYTVGSSGTSTIGGLSEHTTWYFWSRGRNDVGWSGWSNRLQGNTLGHPTAPQNPSTTASTGVTGRVAVQWTAPATTGAGGIVGYNVFRDGVQIATTTGTGTSYVDNGLTPYSSYSYTIAARNAYSTSVGGTGPKSAATTAIAPGPPSAPRNLSGVSSTTVPGEVQLTWQAPVNTGAGGITGYTIRLADDTPIGTTTGTGLTFTASGLTPGLDYTFKVAARNSLADVEGSLSPWSNQVVVTPIGEPGAPTGVTVAPSSTTSNRLVVSWNAPSGVLSGYSIFQQINGAGAYVLVKKITENHTSFTVDDQPAGVTQRFHIRARTIYTDTLNDGYPGNWGGPPSANVAGVATVNNTQTAPALAAITSVTNAVFNGTYTISQVTANTIRYTKVAANIPSAASGGTVTNITNALFNGTFTMTAASTPTTVTYAKTAGNVASLATSGGLVTDTTNVGFNGTFVVTAVNVGANTLSYANTGGALTRAVPLNAPPGQSGIVTNLSNAIFNGTGKVITAITESTLSYAQTNADVAESNAAGAVINATNRDIFNGTYLVAAIPAFNVVQYAKTAANVAKRVWLNPNGLVSRGISPSSLEVRFRSGWSG
- Physico‐chemical
properties -
protein length: 744 AA molecular weight: 75927,89670 Da isoelectric point: 9,31022 aromaticity: 0,08602 hydropathy: -0,04556
Domains
Domains [InterPro]
DC_2133
ATT
1–100
ATT
1–100
IPR036116
STR
94–200
STR
94–200
IPR013783
STR
95–193
STR
95–193
IPR050964
Unmapped
99–289
Unmapped
99–289
IPR003961
STR
103–191
STR
103–191
IPR003961
STR
103–181
STR
103–181
IPR003961
STR
104–188
STR
104–188
IPR003961
STR
105–194
STR
105–194
1
744
Architecture
ATT 1-100 | STR 101-499 | RBD 500-744
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Microbacterium phage A3Wally [NCBI] |
2836046 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QWY83949.1
[NCBI]
Genbank nucleotide accession
MZ150783.1
[NCBI]
CDS location
range 60337 -> 62571
strand +
strand +
CDS
ATGGCAGATTGGGGCGTAGGTAATCGCGGTACGCTGCGAATTACAGATGACGGCTCCGTAGTACGTTTCTACGTGCTATGTTCTGACCCTCAGACCTATGTCGGGTCGTACAACTGGGGTGGAACCGTCAACGGCGTGGGTGTCGGTGGTACCGTCACCCTGAACCGTGGATTCGGTTCTCGCGAGCTTGGTGCGTGGGGTGTTGGCTACACGCAGAACGTGGGTATCAGTCAGGCCGCTACCGGTACCTCCGGTCTTGGTGGCGCTGCGGGTCCGTTCTGGGTCACGATTTACCGTGCAACCGTCCCTTCGCCCCCTACCGGTGTCGCTGTTGACTCGGCCACAGCTACTTCGCTGCGCTACCGCTTCTCTGGAAACAGTGATGGTGGATCGCCTATCCGTGAGTGGCAGATCGGATACGGTACCAGCCCGTCTACGGTCCAGTACACCGTAGGTTCTAGTGGTACCTCTACCATCGGTGGTCTGTCCGAACACACCACCTGGTACTTCTGGTCTCGTGGTCGCAACGACGTGGGATGGTCTGGATGGTCTAACCGACTCCAGGGAAACACCCTAGGACATCCAACAGCGCCTCAGAACCCTAGCACTACAGCTAGCACCGGAGTTACCGGTCGTGTGGCTGTGCAGTGGACTGCCCCTGCCACCACAGGCGCTGGAGGTATTGTAGGGTACAACGTCTTCCGTGACGGTGTGCAGATTGCTACGACCACTGGTACGGGGACCTCGTACGTTGACAATGGCCTAACGCCCTACTCATCGTACTCCTACACCATTGCTGCCCGCAACGCCTACTCAACGTCTGTAGGCGGTACAGGACCTAAGAGCGCAGCGACTACAGCTATTGCTCCGGGACCGCCTAGCGCGCCTCGAAACCTTTCTGGAGTGTCTTCTACCACCGTACCTGGTGAAGTCCAGCTCACCTGGCAGGCCCCTGTCAACACGGGTGCTGGCGGTATTACCGGCTACACAATTCGACTCGCTGATGATACTCCTATCGGCACAACGACCGGCACCGGGCTTACCTTTACGGCTTCGGGACTAACCCCTGGTCTGGACTACACATTCAAGGTTGCTGCTCGAAACTCCCTGGCAGACGTAGAAGGCTCTCTAAGCCCCTGGAGCAACCAAGTCGTCGTCACGCCCATCGGTGAGCCTGGAGCGCCTACAGGGGTCACTGTGGCCCCGTCCTCGACCACTTCTAACCGACTGGTGGTTTCATGGAACGCACCTAGCGGCGTTCTTTCGGGATACTCGATCTTCCAGCAGATCAATGGTGCGGGTGCATACGTCCTCGTCAAGAAGATCACAGAGAACCACACGAGCTTTACTGTTGATGATCAGCCTGCGGGTGTCACGCAGCGATTCCACATTCGCGCGCGTACAATCTACACCGACACGCTGAATGACGGTTACCCGGGTAACTGGGGTGGACCGCCCTCGGCTAACGTGGCGGGTGTGGCTACGGTCAACAACACGCAGACTGCACCTGCACTTGCGGCGATTACATCGGTCACTAACGCCGTGTTCAATGGCACCTACACCATCAGCCAGGTCACCGCCAACACGATTCGCTACACCAAGGTTGCGGCGAATATTCCGAGCGCGGCATCCGGTGGTACGGTCACGAACATCACTAACGCGCTGTTCAATGGTACCTTCACGATGACAGCGGCATCTACGCCTACGACAGTCACCTACGCTAAGACAGCGGGAAATGTGGCATCGCTGGCCACATCTGGTGGACTCGTGACAGACACTACGAACGTCGGATTCAACGGAACCTTCGTTGTAACCGCTGTAAACGTCGGTGCCAACACGCTGAGCTATGCCAACACTGGAGGCGCACTTACCCGAGCCGTGCCTCTCAACGCGCCGCCCGGTCAGTCAGGTATTGTGACCAACCTTTCCAACGCTATCTTCAACGGCACCGGGAAGGTCATCACCGCGATCACCGAAAGCACGCTGAGCTATGCGCAGACGAATGCGGACGTAGCGGAGAGTAACGCGGCGGGTGCGGTTATCAACGCCACCAACCGTGATATCTTCAACGGTACATACCTCGTAGCCGCGATTCCCGCATTCAACGTGGTACAGTACGCCAAGACGGCTGCGAATGTGGCTAAGCGTGTCTGGCTCAACCCCAACGGTCTCGTATCCCGAGGTATCTCCCCGTCCAGCCTGGAAGTGCGCTTCCGTTCAGGGTGGTCTGGATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
d050091a7752d0198a7624d61a17205a492496d5006a86762010b9ca210bcf7e
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50