UniProt accession
A0A3P4A8T5 [UniProt]
Protein name
Putative tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,51
Protein sequence
MAIYRQGQASMDAQGYVTGYDTKWREQLTLIRPGATIFFIDAPFQAAVISEVISDTQIRAITTGGSEIARSNYIILLHDSITVDGLAQDVAETLRYYQSKETQIEEAIEFFRNFDLQKLIDLRDETVRNAASAAQSEQNAQTWAGQSFNHAESAKGYMQQTQQIKDSAVAEINSARDKGVLTVNQTKDQAVVEMNQIKSDTSSLKNQAIEAKTGAESARDQAANHSANALQQANRAEMEADRAHQAVVGYQGWKYERTVNAPAGAEDAKYYPVIFQEKNVGDMTKLGVFFQISTSNRNGDYPYNSASFAGYARTSGWSDGVDSVYGNFTIYQKDERTIDSILMPAKATQKAFAVYIRGGAFPVSIHCESNVDVVVPTSDYAPDGFVENATVFKFGATDPAAECTEVRAMVLTNTGFYAINDYVIRDILLFRDGLGLGERQTPRFSELDLVRQYAGAAELSGILNLHAKGDDGVSRGYSRVYAEKQGGLWKTIIHTANNEGDKHGYLQFDENSKLSGLNHVEINGTGGLYSNGWITAKQAMRVGCGTAEGGNKDIYLTNASGDGGAYGWVNLLQGNWYGGFWQFGAVRGGAADIAHVKVLINNQGSDVKEFRFHNDYGGYMTAQRGFNGQCVQGAWGLEWDHMGAPYYANSVTNNDSGWSPVVSGGSLSTGGYHMRVGLGVASNGNAAWPDVALKLNGDGRSHRAYHFTYDGDITTWEQGFGGGAFIFAKNPTSDRDLKHDIKYTDGKESYDRVMQWLPAMFKYNGSDVQRFGLIAQDLLKIDPQYVKLVPGSPVFEDVIGVDENGEEYIDRQIETDRNDDTLALDSNVMLTDMACAMVYMGGKIEKMEKEIDDLRKAVAKLINNPTDTD
Physico‐chemical
properties
protein length:869 AA
molecular weight: 95451,67500 Da
isoelectric point:4,97997
aromaticity:0,10242
hydropathy:-0,43867

Domains

Domains [InterPro]
DC_0313
STR
1–869
Coil
Unmapped
158–178
IPR030392
CHP
733–787
A0A3P4A8T5
1 869
Architecture
STR
STR 1-869
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
A0A3P4A8T5
1 869
Domain Start End Length (AA) Confidence
N-terminal 1 247 247 0,9672
Central domain 248 455 209 0,8570
C-terminal 456 869 413 0,8189
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-247
Central
248-455
C-terminal
456-869

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage vB_Eco_mar001J1
[NCBI]
2419760 Uroviricota > Caudoviricetes > Drexlerviridae > Warwickvirus > Warwickvirus mar001J1
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
VCU43646.1 [NCBI]
Genbank nucleotide accession
LR027388 [NCBI]
CDS location
range 37785 -> 40394
strand +
CDS
ATGGCAATTTACAGACAAGGCCAAGCGTCTATGGACGCGCAAGGTTATGTAACTGGTTACGACACAAAATGGCGTGAGCAATTAACCTTGATTCGCCCAGGTGCGACAATATTTTTTATTGACGCCCCTTTTCAGGCGGCGGTAATCAGTGAGGTTATTAGTGATACGCAAATCCGCGCCATCACAACTGGCGGATCTGAAATTGCGCGAAGCAATTACATCATTTTACTGCATGACTCGATCACTGTTGACGGTCTGGCGCAAGATGTAGCTGAAACGCTGCGCTACTATCAAAGCAAGGAAACGCAGATAGAGGAAGCAATTGAATTTTTCAGGAACTTTGATCTGCAAAAGCTGATTGACTTACGTGATGAAACAGTGAGAAATGCGGCATCAGCAGCACAAAGCGAACAAAACGCGCAAACATGGGCTGGTCAATCTTTTAATCATGCTGAATCAGCAAAAGGCTACATGCAACAAACGCAACAGATCAAAGATTCAGCGGTAGCTGAAATTAACTCGGCGCGAGATAAGGGTGTGCTGACTGTAAACCAGACTAAAGATCAAGCTGTTGTTGAAATGAATCAGATTAAAAGCGACACATCGTCGCTAAAAAATCAGGCGATTGAGGCTAAAACAGGCGCAGAAAGTGCGCGAGATCAGGCTGCTAACCATTCAGCCAACGCATTGCAGCAAGCAAACCGCGCCGAAATGGAAGCTGATAGAGCGCATCAAGCGGTTGTAGGTTATCAGGGCTGGAAATACGAAAGAACTGTAAACGCTCCAGCGGGTGCGGAAGATGCAAAATATTACCCTGTGATCTTCCAAGAAAAGAACGTTGGTGATATGACTAAATTAGGCGTTTTCTTCCAGATCTCAACTAGTAATAGGAATGGTGATTATCCTTATAATTCAGCGTCATTTGCTGGCTATGCTCGTACTTCTGGATGGTCTGACGGCGTTGATAGCGTTTATGGTAATTTCACCATCTATCAGAAAGATGAAAGAACTATTGATTCTATTTTGATGCCAGCGAAAGCAACACAAAAGGCGTTTGCAGTTTACATTCGAGGCGGCGCATTTCCTGTTAGCATTCACTGTGAAAGCAATGTTGATGTTGTTGTCCCAACATCAGATTATGCGCCAGATGGTTTTGTTGAAAACGCAACAGTTTTTAAGTTTGGTGCGACAGATCCTGCCGCTGAATGTACAGAAGTAAGGGCAATGGTTTTAACTAACACAGGATTCTATGCGATTAATGATTATGTTATCCGCGATATTCTTTTGTTTAGGGATGGTCTTGGATTGGGTGAGAGACAAACACCAAGATTTTCCGAACTAGATCTTGTTCGTCAATATGCTGGAGCTGCTGAGCTTAGTGGAATCTTGAATTTACACGCAAAGGGTGATGATGGTGTTTCTCGGGGTTATTCTCGGGTATACGCTGAAAAGCAAGGCGGATTATGGAAAACAATAATACATACAGCAAACAATGAAGGAGACAAGCACGGATACCTGCAATTTGATGAAAACTCAAAGTTATCAGGTCTAAATCATGTTGAAATCAATGGAACTGGTGGGCTTTACTCTAACGGGTGGATTACTGCAAAACAGGCAATGCGAGTTGGCTGCGGAACTGCCGAAGGAGGTAATAAAGATATTTACCTGACAAACGCATCAGGAGATGGTGGAGCTTATGGATGGGTAAACCTTCTACAAGGCAACTGGTACGGTGGATTCTGGCAATTTGGCGCTGTAAGAGGCGGCGCTGCTGATATAGCCCATGTAAAAGTATTGATTAATAATCAAGGATCTGACGTTAAAGAGTTTAGATTCCACAATGATTACGGTGGATACATGACTGCGCAGCGTGGTTTTAATGGTCAGTGTGTACAAGGCGCATGGGGTCTTGAATGGGATCACATGGGGGCGCCATACTACGCAAACTCAGTTACAAACAATGACTCTGGTTGGAGTCCTGTTGTTTCTGGTGGCTCTTTATCAACTGGCGGTTATCATATGCGAGTTGGGCTTGGTGTTGCATCAAACGGAAATGCCGCGTGGCCTGATGTAGCGCTAAAGTTAAATGGTGATGGTCGTTCTCATCGTGCTTATCATTTTACATATGATGGTGACATTACTACATGGGAGCAAGGTTTCGGCGGAGGTGCTTTTATTTTCGCAAAAAACCCAACGTCCGATCGTGATTTGAAACACGACATTAAATACACAGACGGAAAGGAAAGCTACGATCGCGTAATGCAATGGTTGCCTGCTATGTTTAAATATAACGGATCTGATGTTCAACGTTTTGGCCTGATAGCTCAAGATCTGTTAAAAATCGATCCACAATATGTAAAGCTAGTTCCAGGCTCGCCGGTATTTGAGGATGTGATTGGAGTTGATGAAAATGGTGAGGAATACATTGATCGTCAGATTGAAACTGACAGAAATGATGACACATTGGCGCTAGATAGCAATGTTATGCTAACAGATATGGCTTGCGCTATGGTCTACATGGGGGGAAAAATTGAGAAAATGGAGAAAGAGATAGATGATCTAAGAAAAGCGGTAGCGAAATTAATCAACAATCCAACAGATACAGACTAA

Genbank protein accession
VCU43660.1 [NCBI]
Genbank nucleotide accession
LR027385 [NCBI]
CDS location
range 8810 -> 11419
strand +
CDS
ATGGCAATTTACAGACAAGGCCAAGCGTCTATGGACGCGCAAGGTTATGTAACTGGTTACGACACAAAATGGCGTGAGCAATTAACCTTGATTCGCCCAGGTGCGACAATATTTTTTATTGACGCCCCTTTTCAGGCGGCGGTAATCAGTGAGGTTATTAGTGATACGCAAATCCGCGCCATCACAACTGGCGGATCTGAAATTGCGCGAAGCAATTACATCATTTTACTGCATGACTCGATCACTGTTGACGGTCTGGCGCAAGATGTAGCTGAAACGCTGCGCTACTATCAAAGCAAGGAAACGCAGATAGAGGAAGCAATTGAATTTTTCAGGAACTTTGATCTGCAAAAGCTGATTGACTTACGTGATGAAACAGTGAGAAATGCGGCATCAGCAGCACAAAGCGAACAAAACGCGCAAACATGGGCTGGTCAATCTTTTAATCATGCTGAATCAGCAAAAGGCTACATGCAACAAACGCAACAGATCAAAGATTCAGCGGTAGCTGAAATTAACTCGGCGCGAGATAAGGGTGTGCTGACTGTAAACCAGACTAAAGATCAAGCTGTTGTTGAAATGAATCAGATTAAAAGCGACACATCGTCGCTAAAAAATCAGGCGATTGAGGCTAAAACAGGCGCAGAAAGTGCGCGAGATCAGGCTGCTAACCATTCAGCCAACGCATTGCAGCAAGCAAACCGCGCCGAAATGGAAGCTGATAGAGCGCATCAAGCGGTTGTAGGTTATCAGGGCTGGAAATACGAAAGAACTGTAAACGCTCCAGCGGGTGCGGAAGATGCAAAATATTACCCTGTGATCTTCCAAGAAAAGAACGTTGGTGATATGACTAAATTAGGCGTTTTCTTCCAGATCTCAACTAGTAATAGGAATGGTGATTATCCTTATAATTCAGCGTCATTTGCTGGCTATGCTCGTACTTCTGGATGGTCTGACGGCGTTGATAGCGTTTATGGTAATTTCACCATCTATCAGAAAGATGAAAGAACTATTGATTCTATTTTGATGCCAGCGAAAGCAACACAAAAGGCGTTTGCAGTTTACATTCGAGGCGGCGCATTTCCTGTTAGCATTCACTGTGAAAGCAATGTTGATGTTGTTGTCCCAACATCAGATTATGCGCCAGATGGTTTTGTTGAAAACGCAACAGTTTTTAAGTTTGGTGCGACAGATCCTGCCGCTGAATGTACAGAAGTAAGGGCAATGGTTTTAACTAACACAGGATTCTATGCGATTAATGATTATGTTATCCGCGATATTCTTTTGTTTAGGGATGGTCTTGGATTGGGTGAGAGACAAACACCAAGATTTTCCGAACTAGATCTTGTTCGTCAATATGCTGGAGCTGCTGAGCTTAGTGGAATCTTGAATTTACACGCAAAGGGTGATGATGGTGTTTCTCGGGGTTATTCTCGGGTATACGCTGAAAAGCAAGGCGGATTATGGAAAACAATAATACATACAGCAAACAATGAAGGAGACAAGCACGGATACCTGCAATTTGATGAAAACTCAAAGTTATCAGGTCTAAATCATGTTGAAATCAATGGAACTGGTGGGCTTTACTCTAACGGGTGGATTACTGCAAAACAGGCAATGCGAGTTGGCTGCGGAACTGCCGAAGGAGGTAATAAAGATATTTACCTGACAAACGCATCAGGAGATGGTGGAGCTTATGGATGGGTAAACCTTCTACAAGGCAACTGGTACGGTGGATTCTGGCAATTTGGCGCTGTAAGAGGCGGCGCTGCTGATATAGCCCATGTAAAAGTATTGATTAATAATCAAGGATCTGACGTTAAAGAGTTTAGATTCCACAATGATTACGGTGGATACATGACTGCGCAGCGTGGTTTTAATGGTCAGTGTGTACAAGGCGCATGGGGTCTTGAATGGGATCACATGGGGGCGCCATACTACGCAAACTCAGTTACAAACAATGACTCTGGTTGGAGTCCTGTTGTTTCTGGTGGCTCTTTATCAACTGGCGGTTATCATATGCGAGTTGGGCTTGGTGTTGCATCAAACGGAAATGCCGCGTGGCCTGATGTAGCGCTAAAGTTAAATGGTGATGGTCGTTCTCATCGTGCTTATCATTTTACATATGATGGTGACATTACTACATGGGAGCAAGGTTTCGGCGGAGGTGCTTTTATTTTCGCAAAAAACCCAACGTCCGATCGTGATTTGAAACACGACATTAAATACACAGACGGAAAGGAAAGCTACGATCGCGTAATGCAATGGTTGCCTGCTATGTTTAAATATAACGGATCTGATGTTCAACGTTTTGGCCTGATAGCTCAAGATCTGTTAAAAATCGATCCACAATATGTAAAGCTAGTTCCAGGCTCGCCGGTATTTGAGGATGTGATTGGAGTTGATGAAAATGGTGAGGAATACATTGATCGTCAGATTGAAACTGACAGAAATGATGACACATTGGCGCTAGATAGCAATGTTATGCTAACAGATATGGCTTGCGCTATGGTCTACATGGGGGGAAAAATTGAGAAAATGGAGAAAGAGATAGATGATCTAAGAAAAGCGGTAGCGAAATTAATCAACAATCCAACAGATACAGACTAA

Genome Context

Genome Context

Gene Ontology

Description Category Evidence (source)
GO:0098015 virus tail Cellular Component IEA:UniProtKB-KW (UniProt)

Tertiary structure

PDB ID
77f3ca234dcfdde5c5dc560da138eb4c89ef15627b8c6978ca2d78ad90673d7e
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5858
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50