Protein
View in Explore- Genbank accession
- CAB4220966.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TF
- Protein sequence
-
MLSSDPTSNELMECVVTLKSLELLESFYDDMETPGGDLYIPNRQVSVYMRRPMSVNTHYMLSAEEINSLRLDPRVVAVNPANLIRQSKKLTRILTGVTNSGSNYDKRGYPTAIDSLSTNWALLRCTLGTQISNWGDDNATGGLVNTGAYSIANTTTTSVTNPGNKISSSFISALSFAGTANQWLKCVSPSMNVALGTSNWCMECWFRQTETKNRYSQIIGLRATNGSPTYVGQYAPISIGTQSGKLLVASSSTGTGWNISSPDIYQIPETIVNAQWYHVAAVRNGNLLDIYLNGVSVLRKNVTGVNYTQTPLPFMIGGSDFLSEDPFKGQITNVRVTRSTPVYTNNFTVPTSPLNTITGTVLLIKEAIADVSGISSTITNHNNVTLITVTPGPFGDNGTPPAPPLPPAPASGIKPVRIEPTGQHVDVIIVDGMSGVPDHPEFARVRDGTGGSRYVQFDWHQLNTIAASLDDDSATLLTGSYSYAKATNAHNANHGSHTAGSVAGNSQGWAVDANIYQIDPVSGTIDSLIIWDYIRAFHNSKPINPATGLRNPTICNCSYGSSLTHSTSAIGGIGPIIEGTRRGSKIGVWTQNTPLTQTQLTNLGIYASSNGTATIPILWDDEAADVQQAIADGIIVVGAAGNESQYIDKVGGLDYNNSYYFRYTGGASPVAFLLNYHRGTSPGAAVGAICVGSVDANRTERKAYYSNTGPRLDVFAPGTWIISSVSDISGEGYGTSVDARSNSYFIGKSIGTSMAAPQVTGVLACVLQRYPRMSPTKALKYITYHSKTNQMSSPTVGTSPTWVTNQYHLQGANNRYLFMPYERPLTGMVYPKKNYWIRLDNESGRVYPRPKKYVRV
- Physico‐chemical
properties -
protein length: 856 AA molecular weight: 92337,53990 Da isoelectric point: 8,34770 aromaticity: 0,08645 hydropathy: -0,22745
Domains
Domains [InterPro]
DC_1824
ATT
1–154
ATT
1–154
G3DSA:2.60.120.200
STR
137–340
STR
137–340
IPR013320
STR
170–350
STR
170–350
PF13385
LEC
193–336
LEC
193–336
IPR036852
STR
420–789
STR
420–789
IPR000209
ENZ
471–790
ENZ
471–790
IPR015500
Unmapped
490–503
Unmapped
490–503
IPR023828
Unmapped
751–761
Unmapped
751–761
1
856
Architecture
ATT 1-154 | STR 155-350 | STR 407-810 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
uncultured Caudovirales phage [NCBI] |
2100421 | Uroviricota > Caudoviricetes > Peduoviridae > Maltschvirus maltsch > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
CAB4220966.1
[NCBI]
Genbank nucleotide accession
LR797503.1
[NCBI]
CDS location
range 64440 -> 67010
strand +
strand +
CDS
ATGCTGTCAAGTGATCCTACATCAAACGAATTAATGGAGTGTGTAGTTACATTGAAATCATTGGAACTATTAGAGTCATTCTATGATGATATGGAAACGCCCGGCGGCGATTTGTACATTCCTAATAGGCAAGTTTCAGTGTATATGCGCAGACCTATGAGCGTAAATACTCATTATATGTTATCAGCAGAAGAAATTAATTCGTTAAGATTGGACCCTAGGGTTGTGGCAGTTAATCCGGCAAATTTAATCCGTCAAAGTAAAAAGTTAACACGGATACTAACAGGAGTAACCAATTCTGGATCTAATTATGATAAACGCGGTTACCCTACAGCAATCGATAGTTTATCTACAAACTGGGCGTTATTAAGGTGTACATTAGGAACACAAATATCAAATTGGGGTGACGATAATGCAACAGGAGGATTAGTAAACACAGGTGCTTACAGCATTGCTAATACTACTACTACATCAGTTACAAATCCAGGTAACAAAATTAGTTCGTCATTTATATCGGCACTATCTTTTGCTGGGACTGCTAACCAATGGTTAAAGTGTGTATCTCCATCGATGAATGTTGCACTAGGTACAAGCAACTGGTGTATGGAATGCTGGTTTAGGCAAACAGAAACCAAAAACAGGTATAGTCAGATCATAGGACTAAGAGCCACCAATGGCAGCCCTACGTATGTAGGTCAATATGCCCCAATTAGTATAGGAACACAGTCGGGAAAATTACTAGTAGCATCATCATCAACCGGGACCGGTTGGAATATTTCCAGTCCCGACATATATCAAATACCCGAAACCATTGTTAACGCTCAATGGTATCATGTTGCAGCAGTTAGAAATGGAAATTTGTTAGACATTTATTTAAATGGTGTGTCAGTATTAAGAAAAAACGTAACAGGAGTAAATTATACACAAACCCCATTGCCATTTATGATTGGCGGTAGTGACTTTTTAAGCGAAGATCCTTTTAAAGGACAGATAACTAATGTAAGAGTCACTAGATCTACGCCAGTATATACCAACAATTTTACTGTACCAACTAGTCCATTGAATACTATTACTGGTACCGTATTACTGATTAAAGAAGCAATTGCAGATGTATCAGGAATATCTAGTACTATTACTAATCACAACAATGTAACGTTAATTACAGTTACTCCTGGCCCATTTGGTGATAATGGCACACCGCCTGCACCACCTCTGCCACCAGCACCTGCTAGTGGCATAAAACCAGTCAGAATAGAACCCACTGGGCAACACGTTGATGTTATTATAGTAGACGGTATGTCCGGAGTTCCGGATCACCCAGAGTTTGCTCGTGTTCGTGATGGTACCGGCGGTTCTAGATATGTTCAATTTGATTGGCACCAATTAAATACTATTGCAGCAAGTTTAGATGACGACAGTGCTACTTTATTGACAGGATCTTACTCGTATGCAAAAGCAACCAATGCACATAATGCCAATCACGGCTCACATACAGCAGGATCCGTGGCAGGTAATAGCCAAGGGTGGGCTGTTGATGCTAACATTTATCAAATTGATCCGGTGTCGGGTACAATTGATTCATTAATTATATGGGATTACATCAGGGCATTTCATAACTCTAAACCAATAAATCCGGCTACCGGACTTCGTAATCCCACTATATGTAATTGTAGTTATGGTAGCTCTTTAACACACAGCACTTCGGCGATCGGCGGGATTGGTCCTATCATTGAAGGAACTCGCAGAGGAAGCAAGATTGGTGTCTGGACTCAAAATACACCGTTAACTCAAACACAATTAACAAATTTAGGTATATATGCTAGTTCCAATGGTACAGCAACTATACCCATATTATGGGACGACGAGGCTGCAGATGTACAGCAAGCAATTGCCGACGGTATAATTGTTGTTGGCGCTGCCGGAAATGAAAGTCAATATATTGACAAGGTTGGTGGATTAGATTATAATAATTCTTACTACTTTAGATACACCGGTGGTGCATCACCAGTTGCATTTCTATTAAATTATCATAGAGGCACTTCCCCGGGTGCGGCCGTGGGAGCAATTTGTGTTGGATCAGTCGATGCAAATAGAACGGAACGTAAAGCCTATTACAGTAATACAGGCCCTAGACTCGATGTGTTTGCTCCGGGCACCTGGATTATTAGTTCAGTGTCAGACATCAGCGGCGAGGGGTATGGTACTTCAGTGGATGCACGGTCTAACAGTTATTTCATTGGAAAAAGTATAGGTACTAGTATGGCTGCGCCACAGGTGACAGGAGTATTGGCTTGTGTGTTGCAAAGATACCCAAGAATGAGCCCAACAAAAGCGTTAAAGTATATAACTTATCATAGTAAAACTAATCAAATGTCTAGCCCAACTGTCGGTACCAGTCCAACTTGGGTAACAAATCAATATCACTTACAGGGTGCAAATAATAGATATTTGTTTATGCCTTACGAAAGACCGTTGACTGGTATGGTATATCCTAAGAAAAACTATTGGATCAGACTCGATAACGAAAGTGGAAGAGTATATCCTAGACCAAAGAAATATGTAAGGGTATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
e44d921ef40ff58b54a9219757abf721b344c6224bc3cc8faae60445e25e7abf
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50