UniProt accession
W8CZE1 [UniProt]
Protein name
Putative tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TF
Evidence RBPdetect
Probability 0,75
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MNTEYTMANGQTPVQGSIMSMPVLADWTGQEYVPVVDETGNNKRVLLEDLKGRDAYEVAKEAGYTGTLQEWLASLKGEKGDKGDKGDNGADGKSNYDLAVEQGYQGDLASWLLTQKGADGNDGKDGVDGMLPDFTPVAVETDHVTEADFLTLMTAAVNGAKPADVTSKMLMIDHEGAVGESSLGGWTIYPTESGRYVYVFGRNALGNGQQGNYSAYMPDGGSPQFLSWSASEKGEQGIQGIDGKPGISVVPKGTTPSQVALPVASESNAGWMFTNDGSVTASDKGTLYVSDGTQWVIQGNILGPQGLKGDKGDKGDKGDTGTAGKNAVGMQIVGIVDKEEDLPPVADFTAGDTYVVGTHLWTKVGTEWVDIGDFTGPDGLSAYQVAKANGFVGTEAEWLSSLKGADGIGLKIIGSLPSKDNLPEVGEKSGDAYIINSVMWVWDTVQWSPVGQVGPQGKSAYQSALDTGYVGTEAAWIASLKGNKGDKGDKGDQGEKGEKGDNAAAVMLRGEKADEASLPSTGNTVSDAWLVGGNMFVWTGTAWFDAGPIQGPQGIKGDKGDKGDTGDTGKSAFEVAVAGGFSGTQTQWLASLVGNAVKAKGTLADFANLAGVVSPEAGWAYNITGGASAGHQFIYDGATWVDMGDVRGAKGEKGDQGIKGDTGDAGVDGATAYEIAQGAGFTGTEAEWLKSLIGPGLVAKGHVTDSADLLNVTNPVAGWVYNVLSGDDAGHQFIYNGSDWIDMGNVRGDQGIQGDKGDKGDKGDTGATGNAVNYRGTVATSDLLPSSGNQVSDAYFVGVNLWVWNGTTWIDNGSFQGPQGLKGDKGDKGDKGDTGTTGKSAYQSAVDSGFSGTESAWVTSLKGTTGKSAYQSAVDGGYAGTEAQWVASLKGTNGTNGTSLVPKGTVADLTALNAVANPVAGWLYNMTSTGHAYVYSGSAWVDQGDWRGLQGIQGLTGDQGIKGDTGDGYRYKGTVATTGDLPTTGQVKGDTYFVGTNMKVWNGTGWDDGGNFQGPQGIQGEKGDIGAGIKILGKKDTEEDLPATADAAGDGYMVGTNFWVWDGTAFVNVGAIQGPKGDQGLRGIQGLKGDKGDKGDKGDTGDKGTAWVVLARPPAAADGRIGDYYLNSSTLQFFVKTSDVLWGPLGYLGGGNVYDGPQDGKAYARKDGTWVLVDVLEAPDDGKQYVRKGKAWVSFDHYDMPLITVTAGAVDASKGNAYKLDATVNTTIAFSNLPANRVQTLVLTMMGKGGNLTWPAALKWSNAKAPTLGTTLTNIVVYWDGTNLTGSVGQTV
Physico‐chemical
properties
protein length:1292 AA
molecular weight: 134027,00400 Da
isoelectric point:4,51707
aromaticity:0,08669
hydropathy:-0,37895

Domains

Domains [InterPro]
IPR050149
Unmapped
76–1104
W8CZE1
1 1292
Architecture
ATT
RBD
STR
RBD
ATT
RBD
ATT 5-181 | RBD 256-461 | STR 462-970 | RBD 971-1149 | ATT 1150-1196 | RBD 1197-1292
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Erwinia phage PhiEaH1
[NCBI]
1401669 Uroviricota > Caudoviricetes > Chimalliviridae > Iapetusvirus EaH1 >
Host Erwinia amylovora
[NCBI]
552 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AGX01802.1 [NCBI]
Genbank nucleotide accession
KF623294 [NCBI]
CDS location
range 66573 -> 70451
strand +
CDS
GTGAATACGGAGTACACGATGGCTAACGGTCAAACCCCTGTACAGGGTAGCATCATGTCGATGCCGGTACTCGCCGACTGGACGGGACAGGAGTACGTCCCGGTCGTTGATGAGACTGGCAACAACAAACGTGTTCTTCTCGAAGACCTGAAAGGGCGTGACGCATACGAGGTAGCCAAGGAAGCGGGCTACACGGGCACTCTCCAAGAGTGGCTGGCGTCCCTGAAAGGTGAGAAGGGCGATAAAGGCGATAAGGGCGATAACGGAGCCGACGGTAAGTCGAACTACGACCTCGCCGTGGAACAGGGTTATCAGGGCGACCTGGCATCCTGGCTGCTCACGCAAAAAGGCGCGGACGGTAACGACGGTAAAGACGGTGTTGATGGCATGTTGCCAGACTTCACTCCGGTGGCTGTTGAAACCGACCACGTCACCGAAGCTGACTTCCTGACATTGATGACCGCTGCGGTCAACGGTGCGAAGCCAGCAGATGTCACCAGCAAGATGCTGATGATTGACCATGAAGGCGCGGTGGGTGAAAGCTCACTGGGCGGTTGGACCATTTACCCTACCGAATCCGGTCGTTACGTTTACGTCTTCGGTCGTAATGCGCTGGGTAACGGTCAGCAAGGTAACTATTCAGCCTACATGCCGGATGGCGGTAGTCCGCAATTCCTGTCCTGGTCCGCTTCTGAAAAGGGCGAACAGGGTATCCAGGGTATTGACGGTAAGCCGGGTATCTCCGTCGTACCGAAAGGTACCACCCCTTCTCAGGTAGCTTTGCCGGTTGCAAGTGAGTCTAACGCAGGTTGGATGTTCACGAACGACGGTAGCGTAACTGCTTCTGATAAAGGTACGCTCTACGTCTCCGACGGTACTCAGTGGGTAATCCAGGGGAACATCCTGGGTCCGCAGGGCCTGAAGGGAGACAAAGGCGATAAAGGCGACAAAGGTGATACCGGTACAGCCGGTAAGAACGCCGTCGGGATGCAGATTGTTGGCATCGTTGACAAAGAAGAAGACCTGCCTCCGGTCGCAGACTTCACCGCGGGTGATACCTACGTAGTAGGCACACACCTCTGGACGAAAGTCGGCACTGAGTGGGTCGACATCGGCGACTTCACTGGCCCTGATGGTCTGTCTGCGTACCAGGTTGCGAAAGCGAACGGGTTCGTGGGTACCGAAGCTGAATGGCTGTCAAGCCTGAAAGGTGCTGACGGTATCGGTCTGAAAATCATCGGTTCTCTGCCGTCAAAGGATAACCTCCCAGAAGTGGGCGAGAAGTCTGGTGATGCTTACATCATCAACTCCGTCATGTGGGTGTGGGATACCGTTCAGTGGTCCCCGGTAGGTCAGGTTGGCCCGCAAGGTAAATCTGCTTACCAGTCTGCGCTCGACACCGGCTATGTCGGTACTGAAGCGGCCTGGATTGCCTCCCTGAAAGGGAACAAAGGCGATAAAGGCGATAAAGGCGACCAGGGTGAAAAAGGTGAGAAGGGCGATAACGCTGCCGCAGTCATGCTGCGTGGCGAGAAGGCCGACGAAGCATCGCTGCCTTCTACCGGTAACACCGTCTCTGACGCGTGGCTGGTTGGCGGTAACATGTTCGTCTGGACCGGTACTGCCTGGTTCGATGCAGGTCCTATCCAGGGCCCTCAGGGCATCAAGGGCGATAAGGGTGATAAAGGCGACACCGGTGACACCGGTAAGTCTGCATTCGAAGTTGCCGTTGCTGGCGGTTTCTCCGGTACCCAAACCCAATGGTTGGCGTCTCTCGTAGGCAATGCTGTTAAGGCGAAAGGTACACTGGCTGACTTCGCTAACCTGGCGGGTGTGGTTTCTCCGGAAGCCGGTTGGGCCTACAACATCACTGGCGGCGCATCTGCTGGCCATCAGTTCATCTACGACGGGGCAACCTGGGTAGACATGGGTGATGTTCGCGGAGCCAAAGGCGAGAAAGGTGACCAAGGTATTAAAGGTGATACCGGCGATGCCGGTGTAGACGGTGCAACCGCTTACGAAATCGCCCAAGGTGCTGGCTTTACTGGTACCGAAGCTGAATGGCTGAAGTCCCTGATTGGTCCGGGTCTGGTAGCGAAAGGTCACGTAACCGATTCTGCTGACCTGTTGAACGTCACTAACCCAGTTGCGGGTTGGGTCTACAATGTTCTCTCCGGCGACGATGCCGGTCACCAATTCATCTACAATGGTTCCGATTGGATTGACATGGGCAACGTCCGTGGCGACCAGGGTATCCAGGGTGATAAAGGTGATAAAGGGGACAAGGGCGACACGGGTGCAACCGGTAATGCGGTTAACTACCGTGGTACTGTAGCCACCTCTGACCTGCTGCCTTCCAGCGGTAACCAGGTTTCCGATGCGTACTTCGTGGGTGTAAACCTGTGGGTATGGAACGGTACCACCTGGATTGACAACGGTAGCTTCCAAGGCCCACAAGGTCTGAAAGGCGATAAGGGTGACAAAGGGGATAAAGGTGATACTGGTACTACCGGTAAATCTGCGTACCAGTCCGCCGTTGATTCCGGGTTCTCTGGCACTGAATCTGCGTGGGTAACCTCGCTGAAAGGTACCACTGGTAAGTCCGCTTATCAGTCTGCGGTTGACGGCGGTTACGCTGGCACCGAAGCACAGTGGGTTGCTTCCCTGAAAGGGACCAACGGTACTAACGGTACGTCACTGGTTCCGAAAGGAACTGTTGCTGACCTGACCGCACTGAACGCAGTGGCTAACCCGGTTGCTGGCTGGCTGTACAACATGACCTCTACGGGTCACGCGTACGTCTACAGCGGTAGCGCATGGGTCGACCAGGGCGATTGGCGTGGCCTCCAGGGCATCCAAGGTCTGACTGGTGACCAAGGTATTAAAGGTGATACCGGCGACGGCTATCGCTATAAAGGTACCGTGGCAACGACTGGCGACCTGCCAACCACCGGCCAAGTGAAAGGTGACACCTACTTCGTAGGCACCAACATGAAGGTCTGGAACGGCACTGGCTGGGATGACGGCGGTAACTTCCAGGGTCCGCAAGGTATCCAGGGTGAAAAAGGTGACATTGGTGCGGGCATCAAGATTCTCGGTAAGAAAGACACCGAAGAAGACTTGCCAGCAACTGCCGATGCAGCCGGTGACGGTTACATGGTAGGCACCAACTTCTGGGTGTGGGACGGCACGGCATTCGTGAACGTCGGCGCAATCCAGGGGCCGAAAGGTGACCAAGGTCTCCGCGGTATCCAGGGCCTGAAAGGTGATAAAGGTGACAAGGGTGATAAGGGTGACACCGGTGACAAAGGCACCGCGTGGGTTGTCCTGGCACGTCCCCCAGCTGCGGCTGATGGTCGTATCGGTGACTACTACCTGAACTCCTCTACTCTCCAGTTCTTCGTGAAAACCTCTGACGTTCTGTGGGGCCCTCTGGGTTACCTCGGCGGCGGTAACGTGTACGACGGTCCTCAGGACGGTAAAGCGTACGCCCGTAAAGACGGTACATGGGTTCTCGTTGACGTTCTGGAAGCCCCAGACGACGGTAAGCAGTACGTACGTAAAGGTAAAGCGTGGGTTAGCTTCGACCATTACGACATGCCGCTGATTACGGTCACTGCGGGTGCGGTAGATGCGAGCAAAGGTAACGCCTATAAGCTCGATGCCACCGTGAACACCACGATTGCGTTCAGTAACCTCCCAGCCAACCGCGTGCAGACTCTGGTCCTCACGATGATGGGCAAAGGTGGTAACCTGACGTGGCCAGCAGCACTCAAGTGGTCGAATGCGAAAGCACCGACTCTGGGTACTACGCTGACCAACATCGTGGTTTACTGGGACGGCACGAACCTGACCGGCTCTGTTGGTCAGACCGTGTAA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0031012 extracellular matrix Cellular Component IEA:TreeGrafter (UniProt)
GO:0005615 extracellular space Cellular Component IEA:TreeGrafter (UniProt)
GO:0030020 extracellular matrix structural constituent conferring tensile strength Molecular Function IEA:TreeGrafter (UniProt)
GO:0030198 extracellular matrix organization Biological Process IEA:TreeGrafter (UniProt)

Tertiary structure

PDB ID
3c9ff4b6a9a310b54e26cb95534aa037a06d9df0b4eca13aedd36ee95318d98f
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6464
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50