Protein

View in Explore

Genbank accession

CAM0050093.1 [GenBank]

Protein name

tail fiber protein

RBP type

Evidence Phold

Probability 1,00

Protein sequence

MPRKQSTNRNVGNVQKFVGTSYDEMKALYDNLDALLALETGVQYTLRYLGPSAGDAPSTREDGSPIQDGDYFFDTDADALVYYDAVDDIWFAVDPSEVIQARDEAIAASIVAGQAKDNAELAANNARLSENTAKVYETNAEASKDAAGLSEMSAGLSATDAATYAAQSAIDASNTAADVMTTNADVVTTTDNAATTSTHAINAKNSETAAALSAQQAEQAFDSFDDRYLGTFSTPPTTDNDGDPLVKGATYYNSVELAVYYWNGAVWEAPDKSASDSADAAAASAATATTKAGEASNAATTALNAQTAAKSSENAAQSSQNAAEAAEVGAELAESNAATSEANAAESETVARASENNAANSAASAKENADRSEQHAAGGKGLTLAIRDALRAQRKREYTGSGFTEWGNQYDYNDGDPVQHGLWTYYGSTGSANELGLGADPSVDPNNLQGESRTDYPIANVDGVEMSLIGSTTSTPAYKNANKILFPTAPDGSKTLNESTGEVRKYHDLAGVGTPYEAHTVDFDGSTYIDLVASPYVMPVGSKVEFKFKLNDVSGYQYLFDTQNLTRVYIYKTTGTNNLLWGGFGSTIKVNGVDISTNTFAVEAGVEYHIEATTNATSNIDRIGAKSAGGVLSDFARGQIWDITLASSEDGVEPITYNTVTTQPKDDAAPVVSEIDAGDNPDMPTGYMPFYQDAGYVTIPEFPLADSMNISMVMRPDNDTELMVFGQNPEGQTMRLYWYNDTSSGLFRIAAGSGTSLTFDPLVAGRVYVTEVQIRKNVGASDYTVTAQVNGVIKTQSNVTFGHNTFDSFTLGSEEGVKNNNRWDGAIFGFGIEYPDAPDLNRTYGSVEVDDPAGRLTVEDDLGFGTEDWTPEFDGFNNVIVPPVMNFTGIARELEMTVVPDNVGSSWRIGQTFSKDGEVNRFYLRYDASGTITAGIGNATIQSVLNMTVGETYNFKFICDNSLNIELFVNGVSTITGTTSFRADFVLDNFYLGAAGTADSGPSEHLNGKLTNVRITDPNSVANSRHYPLVINQPTQPDTLIAEDAGYDKDTAPFYTPSYSNTDGWVEIPEITLGSGDAIKLKFQWEDEGKAYDGILDNASVPSLHLRIHNDGRLRWTNHGTLRVNGTVYTDGSFYPVSGEVYEVEIALDRNLTLARIGRLYNGNHWSGKIWDIEFTDNTDPTNSRYYPSVDYRVDGDTSGTVLDETHGLLSDSFSDGRWVESAAGTINGESLTITSSFGSGRVGTFPSPAINGVDVTVSFDVVSYSGTTNGGRVIVYRNGSQDGNLGTFDSSDVGTRVTLTANPTGNYGSDGNDVVFYVDASGISFEVANVEVSANNNGTLVNFPSGSEWTLAQVDGASDGTLENFTAGLEWNNDLPITDGTMVGFAQPWHHETGRYIGSIIGETTQAVWDVQDSQKAFHDVKYNADFHVITSRKDLVFLETWLEKVEGFVRPYGNVQFGGSSHDGVTLVPVTNFKAQGYSAFGEWDENTVGKVADWDAMTPTQKSVWASNPKNNLVFNPEDNEYYQDSYRIRTVEGLGDEWACVRPTIASTGTPTWLGYAQSGTNSRYIVQRGQREDTRDWYKDNTVSGTIFGGTNRSGFNDDEPTIFQNTEGANTSSANGKCFAMPIALVQRLNQGAYHPTYNPQGCDGFISSGGGSLARWYVSTLFRDATTTENCFRLRVGYPAIDGFRYGHGFIGSAGGSGRADQYKYYDAIYAGQVEDLRLNANKQDKQELLTDAVRRGVRGETRGKGKVPFTTVQTADQAATGSPTSAFDGIDTSHITVGDMCWAEDAAGDYQRRTITYAGSNGTISFNETIQGRKSDSKLIHERELSAEYDSLPWVDLIGDPERIAATFPDGVVGQWIPDLTTGNSDRDLNRKGIVLTGTLFTENDGASWTVESKAINSTTNTVNTFLDSSLLRLYLLTYEALSDFTESDDNLAVVGDLGDVYNAKFYTIERGNRIAPSLLGVILKDNRDPTHHQLRVNSYSIHPANGDLDGGSGYLPIHEPIRLPAPANDSDAVKALPHLVEKDGLLYVQWHGTQLFYDAAGTVGNEWGDTFAGTTFTNAYGKISIVDGEDTKPDENGNTVKVVTHTETIPIGIANHNQDI

Physico‐chemical properties

protein length:	2109 AA
molecular weight:	227468,22870 Da
isoelectric point:	4,42141
aromaticity:	0,09768
hydropathy:	-0,42632

Domains

Domains [InterPro]

DC_0849
ATT
74–191

DC_0849 DC_1387 IPR013320

DC_1387
STR
922–2109

DC_1387

CAM0050093.1

1 2109

Architecture

ATT

STR

ATT 74-191 | STR 223-516 | STR 880-2109

Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Domains [InterPro]

Domain ID	Category	Cluster	Start	End	Layer	Name	Pref Zone	Confidence	Evidence	Support
DC_0849	ATT	DC_0849	74	191	Novel HMM	DC_0849	N-terminal	Low	Positional only	30 proteins / 30 hits
DC_1387	STR	DC_1387	223	516	Novel HMM	DC_1387	Central	Low	Positional only	53 proteins / 53 hits
IPR013320	STR	IPR013320	880	1017	Merged direct domain	Concanavalin A-like lectin/glucanase domain superfamily	Central	Low	Positional only	237 proteins / 237 hits
DC_1387	STR	DC_1387	922	2109	Novel HMM	DC_1387	Central	Low	Positional only	53 proteins / 53 hits

Taxonomy

	Name	Taxonomy ID	Lineage
Phage	Vibrio phage D471 [NCBI]	3105237	No lineage information
Host	No host information

Coding sequence (CDS)

Genbank protein accession

CAM0050093.1 [NCBI]

Genbank nucleotide accession

OZ196415.1 [NCBI]

CDS location

range 2364 -> 8693
strand +

CDS

ATGCCACGTAAACAGTCAACCAACAGAAATGTTGGTAATGTACAAAAATTCGTAGGGACATCCTACGATGAAATGAAAGCCCTTTACGATAATCTTGATGCGTTGTTGGCATTGGAAACAGGTGTCCAGTACACATTACGTTACTTAGGCCCATCTGCCGGAGATGCTCCGTCAACTCGTGAAGATGGTTCACCAATCCAAGATGGTGATTATTTCTTTGATACAGATGCGGATGCCTTGGTGTACTACGATGCAGTTGATGACATTTGGTTTGCAGTTGACCCAAGTGAAGTTATTCAAGCTCGTGATGAAGCTATTGCTGCATCTATCGTTGCAGGCCAAGCAAAAGACAATGCAGAATTAGCGGCAAACAATGCACGCTTATCTGAAAATACTGCAAAAGTGTACGAGACCAATGCTGAAGCATCAAAGGATGCAGCAGGGTTGTCTGAAATGTCTGCAGGCTTGAGCGCAACAGATGCCGCTACATATGCAGCACAATCAGCAATTGACGCGTCAAATACTGCCGCAGATGTCATGACAACAAATGCAGATGTGGTGACTACAACAGATAACGCTGCGACAACTTCTACCCATGCAATCAATGCAAAAAATTCTGAGACGGCTGCAGCTCTTTCAGCTCAACAAGCAGAACAGGCATTTGATAGTTTCGATGACCGTTACCTGGGTACGTTTTCTACCCCGCCTACAACAGACAATGATGGTGACCCTCTAGTAAAAGGCGCTACTTACTACAACTCTGTGGAATTAGCGGTGTACTACTGGAATGGTGCTGTATGGGAGGCACCTGATAAGTCTGCATCTGATTCGGCTGATGCGGCAGCAGCGAGTGCAGCCACAGCTACAACTAAAGCCGGTGAAGCGTCAAACGCAGCAACTACAGCTTTAAATGCACAGACAGCGGCAAAGTCTTCTGAAAATGCAGCGCAGTCTTCACAGAATGCAGCGGAAGCGGCAGAAGTGGGCGCAGAACTTGCTGAGAGTAACGCAGCAACAAGTGAAGCCAATGCTGCTGAATCAGAAACTGTTGCTCGTGCAAGCGAAAACAACGCGGCTAATTCGGCTGCTTCTGCCAAGGAAAATGCTGACCGTTCTGAACAACATGCTGCGGGTGGTAAAGGTTTGACTTTAGCCATACGTGACGCACTTCGTGCCCAACGTAAGCGTGAATACACAGGTTCAGGTTTCACGGAGTGGGGTAATCAGTACGATTACAACGATGGAGACCCTGTACAACACGGGCTATGGACGTACTACGGTAGTACGGGTTCAGCAAATGAACTGGGTTTAGGTGCAGACCCTTCAGTTGACCCTAATAACTTACAAGGGGAGTCTAGAACTGATTACCCTATTGCAAACGTTGATGGTGTGGAAATGAGCCTCATCGGTTCAACTACATCTACACCTGCGTATAAAAATGCAAATAAAATCTTATTCCCAACAGCACCAGACGGTTCTAAGACACTAAACGAAAGCACAGGTGAAGTACGTAAGTACCATGACCTAGCAGGTGTGGGTACTCCATACGAAGCTCATACGGTTGACTTCGACGGCTCTACTTACATTGACCTAGTAGCCTCGCCTTACGTGATGCCTGTAGGTTCTAAGGTTGAGTTTAAGTTTAAGTTAAATGATGTGAGTGGCTATCAATATCTATTTGATACGCAAAATTTAACGCGAGTTTACATCTACAAAACAACAGGAACTAATAATCTTTTATGGGGTGGTTTTGGTTCTACCATAAAGGTTAACGGCGTAGATATTTCAACTAATACATTTGCTGTAGAGGCTGGTGTTGAATACCATATTGAAGCAACTACAAACGCTACATCAAACATAGACCGTATTGGCGCTAAATCAGCAGGTGGCGTATTAAGTGATTTTGCGCGTGGTCAAATCTGGGATATCACTCTAGCTTCTAGCGAAGATGGTGTTGAACCGATTACGTACAACACAGTAACTACTCAACCTAAAGATGATGCAGCTCCTGTAGTGTCTGAGATTGATGCAGGTGACAATCCTGACATGCCGACTGGTTACATGCCTTTCTATCAGGACGCTGGTTACGTAACTATTCCAGAGTTCCCACTGGCTGATAGCATGAATATTAGTATGGTTATGCGACCTGATAACGACACTGAACTGATGGTATTCGGTCAGAACCCTGAAGGACAAACAATGCGTTTGTATTGGTACAACGATACATCATCAGGGTTATTCAGAATTGCAGCAGGTTCAGGGACAAGTTTAACTTTTGACCCTCTGGTGGCAGGTCGTGTTTACGTTACAGAGGTACAGATTCGTAAGAATGTAGGTGCAAGTGACTACACGGTTACAGCACAAGTAAATGGGGTTATTAAAACTCAGTCCAATGTTACGTTTGGTCATAACACATTTGATTCGTTTACCCTAGGTTCAGAAGAAGGTGTCAAGAACAATAACCGTTGGGACGGTGCTATCTTCGGATTTGGTATTGAATACCCTGATGCTCCAGACCTTAACCGTACCTACGGTTCAGTTGAAGTTGATGACCCTGCGGGACGATTGACTGTAGAAGATGACTTAGGTTTTGGTACGGAAGATTGGACACCTGAATTTGATGGTTTTAATAACGTAATTGTACCACCAGTAATGAACTTTACTGGTATAGCACGGGAACTTGAAATGACAGTAGTTCCCGATAATGTCGGTTCATCATGGCGTATAGGTCAAACGTTTTCTAAGGATGGTGAAGTTAACCGTTTTTATCTCCGTTATGACGCATCTGGAACGATTACAGCGGGTATTGGTAACGCAACAATACAGTCAGTTCTTAATATGACTGTTGGTGAAACATATAACTTTAAGTTCATATGCGATAATTCACTTAATATTGAACTGTTTGTTAATGGAGTTAGTACCATAACAGGTACTACATCATTCCGTGCAGACTTTGTTCTTGATAATTTCTATCTGGGTGCTGCGGGTACAGCAGATAGTGGTCCGTCAGAACACTTAAATGGTAAACTTACGAATGTACGTATTACTGACCCCAATTCAGTTGCTAACAGTCGTCACTATCCACTAGTAATCAATCAGCCTACACAGCCTGATACATTGATTGCAGAGGATGCGGGTTACGATAAAGACACAGCACCTTTCTATACCCCTTCTTATTCTAACACTGATGGTTGGGTAGAAATTCCAGAGATTACACTGGGTTCAGGCGATGCTATTAAACTGAAATTCCAATGGGAAGATGAAGGTAAGGCATATGATGGCATTTTAGATAATGCAAGCGTACCTTCATTGCACTTAAGAATACACAATGATGGTAGATTACGATGGACTAATCACGGCACGTTACGTGTTAATGGCACTGTGTATACAGATGGTTCATTTTATCCAGTATCTGGTGAAGTGTATGAAGTAGAAATTGCACTTGATAGAAACCTTACACTTGCAAGAATAGGAAGACTTTACAATGGTAATCATTGGTCTGGTAAAATCTGGGATATCGAGTTCACAGATAACACAGACCCTACGAACTCACGTTATTACCCATCAGTAGATTACCGTGTAGACGGTGATACTTCTGGTACTGTTTTGGATGAGACTCACGGTTTACTGTCTGATTCATTCTCAGACGGTCGTTGGGTAGAAAGTGCAGCAGGAACTATTAACGGTGAATCATTAACAATTACATCTTCTTTTGGTTCAGGTAGAGTGGGCACATTCCCATCCCCTGCGATAAATGGTGTTGATGTTACAGTCTCATTTGACGTAGTTAGTTACTCAGGCACTACGAACGGTGGACGTGTCATCGTGTACCGTAATGGTTCTCAAGATGGCAACCTAGGCACATTTGATAGTTCGGATGTAGGTACTCGCGTCACACTTACAGCGAACCCTACTGGTAACTATGGCTCTGATGGTAATGATGTTGTTTTCTATGTAGATGCTTCTGGTATTTCTTTTGAAGTAGCTAATGTAGAGGTATCAGCAAATAACAACGGTACTCTAGTTAACTTCCCAAGCGGTTCAGAATGGACACTTGCTCAAGTAGACGGTGCTTCAGATGGTACGTTAGAGAACTTCACAGCAGGTTTAGAGTGGAACAATGACCTACCTATTACTGACGGTACAATGGTTGGCTTTGCACAACCTTGGCATCACGAAACAGGTCGTTACATTGGCTCCATAATTGGTGAAACTACTCAAGCAGTATGGGACGTTCAAGACTCTCAGAAAGCTTTCCACGATGTGAAATACAATGCCGACTTCCACGTGATTACATCACGTAAGGACTTGGTGTTCTTGGAAACTTGGTTAGAGAAAGTAGAAGGGTTTGTTCGACCTTACGGTAACGTACAGTTCGGTGGCTCTAGTCATGATGGTGTTACCCTGGTTCCGGTTACTAACTTCAAAGCTCAAGGCTACTCAGCGTTTGGTGAGTGGGACGAGAACACAGTTGGTAAGGTTGCTGATTGGGATGCAATGACCCCAACACAGAAATCTGTATGGGCAAGCAACCCTAAGAACAACTTAGTGTTCAACCCAGAAGACAACGAGTACTATCAAGACTCATATCGTATTCGTACAGTAGAAGGTTTAGGTGATGAATGGGCTTGTGTTAGACCAACAATTGCATCAACAGGTACACCTACATGGCTTGGTTACGCCCAATCAGGTACAAATAGTCGATACATAGTTCAACGTGGACAACGTGAAGATACTCGTGATTGGTATAAGGACAATACAGTATCGGGTACTATTTTTGGGGGTACTAACCGTTCTGGATTTAATGATGATGAACCAACCATTTTCCAGAATACAGAGGGTGCAAACACTTCTTCTGCTAACGGTAAGTGTTTTGCTATGCCCATCGCACTAGTGCAGCGTTTGAACCAAGGTGCTTACCATCCAACGTATAACCCACAAGGCTGTGATGGGTTTATAAGTTCAGGGGGCGGTAGTTTAGCACGGTGGTACGTTAGTACTTTATTCAGAGATGCAACCACTACTGAAAACTGTTTTCGTTTACGTGTCGGCTACCCTGCAATAGATGGTTTCCGTTATGGGCATGGCTTCATCGGTTCAGCGGGTGGTTCAGGACGTGCAGACCAATACAAATACTACGATGCTATCTACGCAGGACAGGTTGAAGACTTACGTTTGAATGCTAACAAGCAGGATAAACAAGAGTTGTTAACTGATGCAGTACGTAGAGGTGTTAGAGGTGAAACTCGTGGTAAGGGTAAAGTTCCTTTTACTACTGTTCAGACAGCAGACCAAGCGGCAACGGGTAGCCCTACTTCGGCATTTGATGGTATAGACACCTCACATATAACTGTAGGTGATATGTGTTGGGCTGAAGATGCAGCAGGTGATTATCAAAGACGTACTATTACCTATGCAGGTTCTAACGGAACTATATCGTTTAACGAAACTATCCAAGGGCGCAAATCGGATTCTAAGTTAATCCATGAACGTGAACTATCAGCAGAATACGATTCGTTACCTTGGGTAGATTTGATTGGAGACCCTGAACGAATTGCTGCAACGTTCCCTGATGGTGTAGTTGGTCAGTGGATTCCTGATTTAACAACTGGTAACTCAGATAGAGACTTAAACAGAAAGGGTATTGTCCTTACTGGAACTCTATTCACTGAAAATGATGGTGCAAGTTGGACAGTAGAGAGTAAGGCTATAAATTCTACTACTAATACGGTAAATACTTTCTTAGATTCAAGTTTGTTAAGATTGTATCTTCTAACTTACGAAGCACTATCAGACTTCACAGAGTCAGATGATAACCTTGCAGTAGTCGGTGACTTGGGTGATGTTTACAATGCTAAGTTCTATACAATAGAACGTGGTAATCGTATTGCACCTTCTTTATTGGGTGTAATACTAAAAGATAACCGCGACCCAACGCATCATCAGTTGAGAGTTAACAGTTACTCTATACATCCTGCTAATGGTGATTTGGATGGCGGTTCTGGTTACTTACCAATACATGAGCCTATTAGATTACCAGCACCTGCCAATGACTCTGATGCAGTTAAAGCACTTCCTCACTTAGTTGAGAAAGATGGTTTACTGTACGTTCAGTGGCATGGTACTCAGTTGTTCTACGATGCAGCAGGTACAGTAGGTAATGAGTGGGGAGACACCTTCGCAGGTACAACCTTCACGAATGCTTACGGTAAAATCTCTATTGTAGATGGTGAAGACACCAAGCCTGATGAGAACGGGAACACTGTTAAAGTGGTAACACACACTGAGACAATTCCAATTGGTATCGCGAACCATAATCAAGATATCTAA

Genome Context

Tertiary structure

PDB ID

d09e9a5b1dba69ff2e674c6e09bea0853090fb9eb34db9d1d776ef0546f748f8

ColabFold

Source ColabFold

Method ColabFold

Resolution 0,5281

Oligomeric State monomer

Download PDB

Model Confidence

Very high
pLDDT > 90

High
90 > pLDDT > 70

Low
70 > pLDDT > 50

Very low
pLDDT < 50

Protein

Domains

Domains [InterPro]

Domains [InterPro]

Taxonomy

Coding sequence (CDS)

Coding sequence (CDS)

Genome Context

Genome Context

Tertiary structure

Predicted Aligned Error (PAE)

Model Confidence