Genbank accession
QIG59130.1 [GenBank]
Protein name
transferase
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MADDIKRYNPKTGTWDISSSGKATGIIVEDPRLINPEVAEEGVTGESLNDVLVRHEQELKKQGGYIAWLAEHGGGGSGGGGGTTGDKVTLTNGNIVKEGNINYLYSTVTTNIKLEYLITSSKNNKRYFITVTLDGNNIIEGKEGWTNTPGVLTIPQLDKFSSNSNHSVVITASDTDGFSAKSYLLNIVEASIKLASSVSGNTATVGIDYFFTYSITSKIIGSDVNLVVTNVTNGASKTIELGKTTSTAPRQVNVNLWDLGSIIAGSSYTIQAQAFTSMNGQTVQSDKVTNRVVVEDGVNLVVLVEGITSKAEVDSGVERTKFSQSGNISFAFTPYLAGVSLIYYAVRIEHNSIVKDIGYFDEGNYNDNQYVQRGKQQVFSYAIPTEGEVLGNWNITLRCWSEKGDPITDTVLACEVVSSSQALIADQNPNNSRYASWHIRQESFPQVSTTKVWTSNEPSFTVPGAIEPSGAITELNVYNTNGVLSGFLTKNGQSMLRISGEAYGVIDVQPFKDDTTTLNNWSRQGFGISCTFKSDRHPFSNRTVFFIGDYNTDEQFSEGIKIGLEDITWSYTDGNIKKTMSCKIQQDVINTVDFIVNKNPGKMVVAIFINGILNTAREIKNDFTWRTSSKIYLGCDISNAGQIQNFADVNFYDIKLFRVPANDKQIVINAMNSKARATLLADGSIDFTEYNRMKLRNFFSTSDSEPNSTLWDDINQTYANVNFNSLISDTTRVLPVDIMLINCANTGFTRAIFEEIGGQNNNWYSGCTISYFSPTSGKSSSEYTTDVSVSKQGTSTLNNLIKNLEIRFDKMLKDDDGANLDYELFQPRETWFPERQFTLKADVVDSAHANNASIGKWINDNSDFLFEKTPPMEQLESHRPVDTRDRTVKDKVTIKQTLEGFPIILLIQFDGEETQTMLGIYSFNLGRGAYYNMGFRFMKDFTTKIKNTAGEYVDNKLPAFVTSYHTYAQDELFGNIDQRKVYSYEFGENANIIVDGEKILPLALFMQDDLSIIKHVGEFKYNGGNWLEPSAAVTDDNIWRALQELFSIFAQMTSSTVKKYIWNETSGGYEETAGEYPAQSSWSTLAAELDTKFSIKNAYSYLLTCVKYGLVDSLGKNLTLVCYDVGGANKWFIRFYDMDTGNGLDNVALESVAKTAWLDTFSNNDNNDVNSLVITKNAADGGYDTYSSRMWDVLRDTIFANTGVFDSSLETLWDLWRNNATICKDINDYIDNYFAAQTKDCGELLFNYDYNVKYLTAYVGESGGQPSYANIEFLHGTRVEYVRDWMKKRVWFFDGVFKYSNVANIQPYNNKGTFSAGGAEATNPKLIITSNCPAIFVVNIGNTTDTRYFLEEGKPTEIRLSPISSFNTQVTINNTPQINDIEGLGGMRFQRFMSSMKLPSFSKLDLSSIDTLSDSPISFETIFVNDEDFSDVQHIDLSNTKFWSGNAGQSTFTVNIEKYTKLKDLNISNSVVTSVSLPNASLSSLNITNSTVENISLVNQPFLEILDFSGCKRLKTVTIDSCDKITELNLSNLEDLHTIKITSCPNLKSIVCTNNGNLTTFNVSNCNNVETINISSCTNRNLIVYIVGAPNIKTLNMSNTNTANDIQAASELPKLRTLNITNSQVEAIQYGNAAIPTYNGNKIFDVSQLIDLQFSVQNAKGVHYFKFNNNKEHPFNVGSAFFVGCSNLKRVFGHISLNGNGVFNQCSKFYIHEPKEKVEGITPDYNGEWFGPDTNTEQGYVDWRNHIDLSTNFSIGTTDCTSMFRATNCSIYDVYYFLYKCDNVTTLNSCFAIAKNVKWDLLDSPNRDMFNHCTKVVTMNSLFWGLQAQDFKILTSTYDYGSTEHNGLFSPLVDLQAMDNIFYFDGTRYTSPAFLAKFKGNVPSKLKRLSSFSTGTIKFVDNINNCPSDSTIDEHLVSADCGTLLANLPDLEYLNNMFNNSNIYFNQITDEDVEDGVKYCPLFYKNTKLRYIHSSFKGLVNSTGSLYNIFGGTVKNKTQVRFPTTLYGIYDSFSLGSGSNVIFPIHNSMFSRLRNTLKYITGQQPINQSTLGSFQGFTKQFLKEGEEAFPYDVFTGCNVIVEIPGFFANLVLPANTVVELPLNSFKTNYNLTNISYLYYDMKNCKYSLTGKGFSNCKLINVHRCFSEIETSFVKKGFIPYGLFYMEQTSNVSYKGWNEVDAANQNITENYGIDSDGNWIESAEMPVEITYSKQRTLPRKTIVNMSYCLERFQSTEAQGYTMNYGNLTPSNYGDIIVPNEKYNPVKYILNPNYDPREWLDDEHTMPNYNRDIHRVILNKDFDKYELAWNEYCVDGLSGLEDIVRDSALYSAISTGSINCSPVIPNRFKDNAGSFAPPSDANANKKVLNYICSPDLFYYCTNGNDMQVNGVFFGSGRVDGVVGYDYLDYGLRGRIPPHLFYPISNAIDLSYTFYRIPLLNPYKWNVTNGEDGEFYSADTFSKLTKLISLSNMFYFCIIPANINLPVDSYVNCIQLQDISSMFLSAQFESTSAMRQQVDGNLFSKNVNLRNISYAFASGQNQGDWSDRSPKKISSTLFNANKHKQLTNVTGVFYNATSTTGSVPEFWNWLNSLSSVNRANVFYAMRKANLTNGNSVPSGWDTGMV
Physico‐chemical
properties
protein length:2622 AA
molecular weight: 293361,71990 Da
isoelectric point:5,08041
aromaticity:0,11861
hydropathy:-0,31350

Domains

Domains [InterPro]
DC_0619
STR
580–1392
IPR050715
Unmapped
1399–1661
QIG59130.1
1 2622
Architecture
ATT
STR
RBD
ATT 1-512 | STR 519-1704 | RBD 1710-2622
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
QIG59130.1
1 2622
Domain Start End Length (AA) Confidence
N-terminal 1 10 10 0,2266
Central domain 11 283 274 0,3735
C-terminal 284 2622 2338 0,0610
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-10
Central
11-283
C-terminal
284-2622

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacteroides phage crAss002
[NCBI]
2709317 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QIG59130.1 [NCBI]
Genbank nucleotide accession
MN917146 [NCBI]
CDS location
range 20783 -> 28651
strand +
CDS
ATGGCAGATGATATTAAAAGGTATAATCCCAAAACTGGTACTTGGGATATAAGTTCTTCTGGAAAAGCTACCGGTATTATTGTTGAAGACCCTCGTCTTATCAACCCTGAAGTAGCAGAAGAAGGAGTAACTGGCGAAAGTCTTAATGACGTTCTTGTTCGTCATGAACAAGAACTAAAGAAGCAAGGTGGATATATTGCTTGGCTTGCCGAACACGGTGGTGGCGGAAGCGGTGGCGGTGGTGGAACTACTGGTGATAAGGTTACTCTTACTAATGGTAATATAGTAAAAGAAGGTAATATTAATTATCTTTATTCTACTGTTACTACTAATATTAAGTTAGAGTATCTTATTACTTCTAGTAAGAATAATAAAAGATATTTTATTACTGTTACTCTTGATGGTAATAATATTATCGAAGGAAAAGAAGGTTGGACTAATACTCCCGGAGTTCTTACTATTCCGCAACTAGATAAATTCTCTTCTAATAGTAATCACTCTGTTGTAATTACAGCTAGTGATACAGACGGATTCTCTGCTAAATCTTATTTGCTTAATATAGTAGAAGCAAGTATTAAACTCGCTAGTTCTGTATCAGGAAATACTGCAACTGTTGGTATTGATTACTTTTTTACTTATAGTATTACTAGTAAGATTATTGGTTCAGATGTTAATCTTGTAGTTACTAATGTAACTAATGGTGCTAGTAAAACTATTGAATTAGGTAAAACTACTTCTACTGCTCCTAGACAAGTTAATGTTAACTTATGGGATTTAGGAAGTATTATTGCTGGTAGTTCTTATACTATACAGGCACAAGCGTTTACTTCAATGAATGGACAGACTGTTCAATCAGATAAAGTAACTAATCGTGTAGTAGTTGAAGATGGTGTAAATCTAGTAGTACTTGTAGAAGGCATTACTAGTAAGGCAGAAGTAGATTCAGGAGTTGAAAGAACTAAGTTCTCTCAAAGTGGTAATATATCATTTGCGTTCACTCCGTATCTTGCAGGAGTAAGTCTTATCTATTATGCTGTTAGAATAGAACATAATAGTATTGTTAAAGATATAGGTTACTTTGATGAAGGAAATTATAATGATAACCAATATGTTCAACGTGGCAAACAACAAGTATTTAGTTATGCTATTCCAACTGAAGGAGAAGTATTAGGTAATTGGAATATAACTCTTCGTTGTTGGTCTGAAAAGGGCGACCCTATTACCGATACTGTTTTAGCTTGTGAAGTTGTATCTAGTTCTCAAGCACTTATTGCTGACCAAAATCCTAATAACAGTAGATATGCTAGTTGGCATATTCGCCAAGAAAGTTTTCCACAAGTATCTACTACTAAAGTTTGGACAAGTAATGAACCTTCATTCACAGTTCCTGGTGCTATTGAACCTAGTGGTGCTATAACTGAACTAAATGTATATAATACTAATGGTGTTCTTTCAGGCTTCTTAACAAAGAACGGACAATCAATGTTACGTATATCAGGAGAAGCCTATGGAGTAATTGATGTACAACCATTTAAAGATGATACTACTACTCTTAATAACTGGTCAAGACAAGGTTTCGGTATATCATGTACATTCAAGTCAGATAGACATCCTTTCTCAAATAGAACAGTCTTCTTTATAGGGGATTACAATACAGATGAGCAATTCTCGGAAGGTATTAAAATAGGTCTTGAAGATATTACTTGGTCTTATACTGACGGTAATATTAAAAAGACTATGAGTTGTAAGATACAACAAGATGTTATTAATACTGTTGATTTTATAGTTAATAAGAATCCAGGAAAGATGGTTGTTGCTATCTTTATTAATGGTATTCTTAATACAGCTCGTGAAATAAAGAATGACTTTACTTGGAGAACTAGTTCAAAGATATATCTAGGTTGTGATATTAGTAATGCTGGACAAATTCAGAATTTTGCTGATGTTAACTTCTATGATATTAAGTTGTTCCGTGTTCCTGCGAATGATAAACAGATTGTTATCAATGCAATGAACTCAAAAGCTAGAGCAACTCTACTAGCTGACGGTAGTATAGATTTTACAGAATACAATAGAATGAAGTTAAGAAACTTCTTCTCTACTTCTGATTCTGAACCAAATTCAACACTTTGGGACGATATTAATCAGACTTATGCTAATGTTAACTTTAATAGTCTTATTTCTGATACTACTAGAGTATTACCAGTCGATATAATGTTGATTAATTGTGCTAATACTGGTTTTACTCGTGCTATATTTGAAGAGATTGGAGGTCAGAATAATAATTGGTATAGTGGTTGTACTATAAGTTACTTTAGTCCAACTTCGGGAAAGTCTAGCTCTGAATATACTACTGATGTTTCTGTTTCTAAGCAAGGTACTTCTACTTTGAACAATCTTATTAAGAACTTAGAGATAAGATTCGATAAGATGCTTAAAGATGATGATGGCGCTAATCTTGATTATGAGCTATTCCAACCTAGAGAGACATGGTTTCCTGAAAGACAGTTTACACTTAAAGCTGACGTTGTTGACAGTGCTCATGCAAATAATGCTTCTATTGGTAAATGGATTAATGATAACTCGGATTTCTTATTCGAGAAAACTCCGCCTATGGAACAACTTGAATCTCATCGTCCAGTAGATACTCGTGATAGAACTGTAAAAGATAAAGTTACTATCAAACAAACGCTTGAAGGTTTTCCTATTATTCTTCTTATTCAGTTTGATGGGGAAGAAACTCAAACTATGCTTGGTATATATAGTTTTAACTTAGGTCGTGGAGCTTATTATAATATGGGATTCCGATTTATGAAAGACTTTACTACTAAGATAAAGAATACAGCAGGTGAGTATGTTGATAATAAACTTCCTGCTTTTGTTACTTCTTATCATACTTATGCACAAGATGAACTATTCGGAAACATAGACCAAAGAAAAGTTTATTCTTATGAGTTTGGGGAAAATGCAAATATTATTGTAGATGGAGAAAAGATATTACCATTAGCATTGTTTATGCAAGACGATTTATCTATTATCAAACATGTAGGTGAATTTAAATATAATGGTGGCAATTGGTTAGAACCTAGTGCAGCTGTTACTGATGATAATATTTGGAGAGCATTACAAGAGTTATTCTCTATCTTTGCTCAAATGACTTCATCGACAGTTAAGAAATACATTTGGAACGAGACTTCCGGTGGTTATGAAGAAACTGCTGGTGAATATCCTGCACAGTCTAGTTGGTCTACGCTTGCTGCTGAACTTGATACTAAGTTCTCAATTAAGAATGCTTACTCTTACTTATTAACGTGTGTAAAGTATGGGCTTGTTGATTCATTAGGTAAGAACTTAACTTTAGTCTGTTATGATGTTGGTGGGGCTAATAAGTGGTTTATCAGATTCTATGATATGGATACTGGTAATGGTCTTGATAACGTAGCTCTTGAATCTGTTGCTAAAACTGCTTGGTTAGATACATTTAGTAATAATGATAATAATGATGTTAACTCATTAGTTATTACTAAAAACGCTGCCGATGGTGGATATGATACTTATAGTTCTCGTATGTGGGACGTATTAAGAGATACTATCTTTGCTAATACTGGAGTATTCGATAGTTCTCTTGAAACTCTTTGGGACTTATGGAGAAACAATGCTACTATTTGTAAAGATATTAATGATTATATAGATAATTACTTTGCAGCTCAAACTAAAGATTGTGGAGAGCTTCTGTTTAATTATGATTATAATGTTAAGTATCTTACTGCTTATGTTGGTGAATCAGGTGGACAACCTTCTTATGCTAATATTGAATTTCTACATGGTACTCGTGTTGAGTATGTTCGAGATTGGATGAAGAAGAGAGTTTGGTTCTTTGACGGAGTATTTAAGTATAGCAATGTTGCTAATATTCAACCTTATAATAATAAGGGTACATTTTCCGCAGGTGGTGCAGAAGCTACTAATCCTAAACTCATTATTACGTCTAATTGTCCTGCAATATTTGTGGTTAATATTGGTAATACTACTGATACTAGATATTTCTTAGAAGAAGGCAAACCTACTGAAATTAGATTATCTCCTATTAGTTCTTTCAATACACAAGTTACTATCAATAATACTCCTCAAATTAACGATATAGAAGGATTAGGTGGAATGAGATTCCAAAGATTCATGTCTAGTATGAAACTTCCTAGTTTCTCTAAACTAGACTTATCATCTATTGATACTCTTAGTGATTCTCCTATTTCATTTGAAACTATATTCGTTAACGATGAAGACTTCTCTGATGTTCAACATATTGATTTAAGTAATACTAAGTTTTGGAGTGGCAATGCTGGACAAAGTACATTTACAGTTAATATAGAAAAATATACTAAGTTGAAAGACTTGAATATATCTAATTCTGTTGTAACTTCTGTATCTTTACCTAATGCTTCTCTTTCATCTTTGAATATTACTAATTCAACAGTTGAAAATATTAGTCTTGTTAATCAGCCGTTCTTGGAAATACTGGATTTCTCTGGATGCAAACGATTAAAGACAGTTACTATTGATTCTTGTGATAAGATTACTGAATTGAATCTTAGTAATCTAGAAGACTTACATACTATTAAGATTACTTCATGTCCTAACTTAAAATCTATTGTATGTACAAATAATGGTAACTTAACTACATTCAATGTATCTAATTGTAATAATGTCGAAACAATTAATATATCGTCATGTACAAACAGAAATCTTATTGTTTATATTGTAGGTGCTCCTAATATTAAGACACTTAATATGTCTAATACTAATACGGCTAACGATATTCAAGCTGCATCTGAACTTCCTAAACTTAGGACATTGAATATAACTAATAGTCAAGTTGAAGCTATACAATATGGTAATGCTGCAATTCCTACTTATAATGGTAATAAGATATTTGATGTTAGTCAATTAATCGACTTACAATTCAGTGTTCAAAACGCTAAAGGTGTACACTACTTTAAATTTAATAATAATAAGGAACATCCTTTTAATGTAGGTTCTGCGTTCTTTGTTGGTTGTTCTAACTTAAAGAGAGTATTTGGGCATATTAGTCTTAATGGTAATGGTGTATTCAATCAATGCTCTAAATTCTATATTCATGAACCCAAAGAAAAGGTAGAAGGTATTACCCCTGATTATAATGGTGAATGGTTTGGTCCAGATACTAATACTGAACAAGGCTATGTTGATTGGAGAAATCATATTGATTTATCTACTAACTTTAGTATTGGCACTACTGATTGTACTAGTATGTTTAGAGCTACTAATTGTAGTATATATGACGTTTATTATTTCTTATATAAATGTGATAATGTTACAACTCTTAATAGTTGTTTTGCTATTGCTAAGAATGTTAAATGGGATTTATTAGATAGTCCTAATAGAGACATGTTTAATCATTGTACTAAAGTAGTTACAATGAACTCACTATTTTGGGGATTACAGGCACAAGACTTTAAAATATTAACTAGTACTTATGATTATGGCTCTACTGAACATAATGGATTATTTAGTCCTCTTGTTGATTTACAAGCTATGGATAATATATTTTATTTCGATGGTACTAGATATACAAGTCCTGCTTTCTTAGCTAAGTTTAAAGGAAATGTTCCTTCTAAACTTAAAAGACTAAGTAGTTTTAGTACTGGAACTATTAAGTTTGTAGATAATATTAATAATTGTCCTAGTGATAGTACTATTGATGAGCATCTTGTTAGTGCTGATTGTGGAACACTTCTTGCTAATCTTCCTGATTTAGAATATTTAAATAATATGTTTAATAATTCTAATATATACTTTAATCAAATAACAGATGAAGATGTAGAAGATGGAGTAAAGTATTGTCCTTTATTCTATAAGAATACTAAACTTAGATATATTCACAGTTCATTTAAAGGACTTGTTAATTCTACTGGTTCTTTATATAATATATTTGGTGGTACTGTTAAGAATAAGACACAAGTAAGATTCCCGACAACTTTGTATGGTATCTATGATTCATTTAGTTTAGGTTCAGGTTCTAATGTTATTTTCCCAATCCACAACTCAATGTTCAGTAGATTAAGAAACACATTGAAGTATATAACAGGACAGCAACCTATTAATCAATCTACATTAGGTAGTTTCCAAGGTTTTACTAAACAGTTTCTTAAAGAAGGAGAAGAAGCATTCCCTTATGATGTATTTACTGGTTGTAATGTTATTGTTGAAATACCAGGATTCTTTGCTAATCTTGTTCTTCCTGCTAATACAGTAGTTGAGCTTCCTCTTAATTCATTTAAGACTAATTACAATCTTACTAATATATCATATCTATATTATGATATGAAGAATTGTAAGTACTCGCTTACTGGTAAGGGCTTCTCTAATTGTAAACTAATTAATGTTCATAGATGCTTCTCTGAAATAGAAACTAGCTTCGTTAAGAAAGGTTTTATTCCTTATGGACTATTCTATATGGAACAAACTTCTAATGTTAGCTATAAAGGTTGGAATGAAGTAGATGCAGCTAATCAGAATATTACAGAGAACTATGGTATAGATAGTGACGGTAATTGGATTGAAAGTGCTGAAATGCCAGTAGAGATTACTTATAGTAAACAACGAACTCTTCCTAGAAAGACAATAGTTAATATGTCTTATTGCTTAGAAAGATTTCAAAGTACAGAAGCACAAGGTTATACTATGAATTATGGTAATCTTACTCCTAGTAATTACGGAGATATAATAGTCCCTAATGAAAAGTATAATCCAGTTAAGTATATTCTTAATCCAAATTATGACCCTAGAGAATGGTTAGATGACGAACATACTATGCCTAACTACAATAGAGATATTCATAGAGTTATCTTGAATAAAGATTTCGATAAGTATGAACTTGCTTGGAACGAATATTGTGTCGATGGTCTTAGTGGATTAGAAGATATAGTTAGAGACAGTGCTCTTTATAGTGCAATTAGTACAGGAAGTATTAATTGTTCTCCTGTTATACCTAATAGATTTAAAGATAACGCTGGTTCTTTTGCTCCACCTTCTGATGCTAATGCTAATAAGAAAGTACTTAACTATATATGTTCTCCTGACTTATTCTATTATTGCACTAATGGTAATGATATGCAAGTAAATGGAGTGTTCTTTGGTAGTGGTAGAGTTGATGGAGTAGTTGGATATGATTATCTTGATTATGGATTAAGAGGACGTATTCCGCCACATTTATTCTATCCTATTAGTAACGCTATTGATTTGTCTTATACATTCTATCGTATACCATTATTGAATCCATATAAATGGAATGTTACTAATGGAGAAGACGGAGAGTTCTACTCGGCAGATACGTTCTCTAAGTTAACTAAATTAATATCGTTATCTAATATGTTCTACTTTTGTATTATTCCTGCAAATATTAACTTACCTGTTGATTCTTATGTAAACTGCATACAGTTACAAGATATATCTTCGATGTTCTTATCTGCACAGTTTGAATCAACATCTGCAATGAGACAACAAGTAGACGGAAACTTATTTAGTAAGAATGTTAATCTAAGGAATATTAGTTATGCTTTTGCTAGTGGGCAAAACCAAGGAGACTGGTCAGATAGAAGTCCTAAGAAGATTAGTTCTACATTGTTTAATGCTAATAAACATAAACAACTTACTAATGTTACTGGTGTGTTCTATAATGCGACTTCTACTACTGGTAGTGTTCCTGAATTTTGGAATTGGCTAAATAGTCTATCCTCTGTTAATAGAGCGAACGTATTCTATGCTATGCGTAAGGCTAATCTTACTAATGGTAATAGTGTTCCTAGTGGATGGGATACAGGTATGGTATAA

Genome Context

Genome Context

Tertiary structure

PDB ID
737864ba72a825638b363707aae87f086570cd9287c15aed06848e35e6fa4589
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,6189
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
PhicrAss002; a novel member of the crAss-like phage family isolated from the human gut following selective antibiotic enrichment Guerin,E., Shkoporov,A.N., Stockdale,S.R., Khokhlova,E.V., Clooney,A.G., Daly,K.M., Draper,L.A., Ross,P.R. and Hill,C. 2021-04-12 — GenBank