Genbank accession
APU89256.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MNEDKKFARSLKSLLRQDRNAEIPAFLGNLSGVVSTGETGRVYVTLFDGEVLAVFNGKVQNVPRLPVLIGYGGTERLQVLRSRDVYDSPPFPEVGPHGFLHTFPNPDTVPVRAEQFIPLLVEPESGLTVRIHRGSYELTDGWHPLPNQTLDLTDYVPASGAIFVLIEVDVDGALSVTEGSAVESRAMLEFSDIPAADAAKFSLAAVKLYAAQTSFIFLPSDTDIVDLRFGRQGGGSGTPGGSDGDVQYNASGAFGGDANFHYDAATNSLEIGGHVLDLTLLEGMINSITEGDSNGRMLFTFSDDITDGSFITFVRAKGTKASPTAVTDGTVIGYVRGRAWQQSGESFGNATDTQVEIQLVADGDWDVDDNPTRLEIYTTPAGSGTKALRMTIGSDGQITYHNYGDGTFEDTPAYFLGVDADGKVIEVDPADVADGWTAYSAVVPTRIASSLDGTFTVTIASPAVVTKNGHGLYLGQRLQLTTTGALPTGLATGTDYYVIYVDANTFRLATSLANAKAGTAINTSGTQSGTHSIVCNLDPAYRIQFAGVDLSSTLQESMPIKWTQNSIVRYGWICSAPTYSGGNTTFHVLTRCDSTSADYDVLDTGTYAISEFHYGLPKQPGTGFPALPEYWTMEMTDTGNQLASGATAGVDYNPAGLSLWVSIGTWKITGNHITWVEFTGTNLRFSVIGKVSDGISDIIGTYYFLATSTSLIANGGYDLSKHVRLTSPRTYHNLVQCGTSSPTALRVRGDISTTRINAVCAYL
Physico‐chemical
properties
protein length:763 AA
molecular weight: 81536,81710 Da
isoelectric point:4,70407
aromaticity:0,09567
hydropathy:-0,09148

Domains

Domains [InterPro]
IPR029047
ATT
99–177
IPR023366
STR
455–530
APU89256.1
1 763
Architecture
ATT
STR
ATT 99-177 | STR 448-530 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
APU89256.1
1 763
Domain Start End Length (AA) Confidence
N-terminal 1 510 510 0,5286
Central domain 511 709 200 0,1106
C-terminal 710 763 53 0,9989
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-510
Central
511-709
C-terminal
710-763

Taxonomy

  Name Taxonomy ID Lineage
Phage Virus Rctr41k
[NCBI]
1924549 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
APU89256.1 [NCBI]
Genbank nucleotide accession
KX853513 [NCBI]
CDS location
range 33388 -> 35679
strand +
CDS
ATGAATGAAGATAAGAAGTTCGCCCGCAGTCTGAAAAGCCTCCTCCGCCAGGATCGAAACGCGGAGATCCCCGCCTTTCTGGGGAATCTCTCCGGCGTGGTTTCGACCGGCGAGACCGGCAGGGTGTACGTCACCCTCTTCGACGGCGAAGTGCTCGCAGTCTTCAACGGGAAGGTGCAAAACGTTCCGCGCCTGCCGGTCCTGATCGGTTATGGGGGAACGGAGAGATTGCAGGTTTTGCGCTCGCGGGATGTGTATGATTCGCCTCCCTTCCCGGAGGTCGGACCTCACGGCTTCCTGCATACCTTTCCCAACCCCGATACCGTCCCCGTGCGCGCCGAGCAGTTCATCCCGCTCCTGGTCGAGCCGGAGAGCGGTCTCACCGTGCGGATCCACAGAGGCAGTTACGAACTGACGGACGGCTGGCATCCCCTTCCCAACCAAACCCTTGACCTGACGGATTACGTCCCCGCCAGCGGCGCGATCTTCGTGTTGATCGAAGTGGATGTGGACGGCGCGCTCTCCGTCACCGAAGGCTCGGCGGTGGAGTCGCGTGCCATGCTCGAGTTCAGCGACATCCCCGCCGCCGATGCGGCAAAGTTCAGCCTTGCCGCGGTCAAACTCTACGCCGCGCAGACCTCCTTCATTTTTCTGCCCAGCGACACCGACATCGTCGATCTGCGCTTCGGTCGTCAAGGCGGCGGAAGCGGCACGCCGGGCGGGAGTGATGGAGATGTTCAATACAATGCAAGCGGCGCGTTTGGAGGAGATGCGAATTTCCATTACGACGCAGCAACCAATTCGCTTGAAATCGGCGGTCATGTCCTGGATTTGACTTTACTGGAAGGGATGATAAATTCCATCACCGAGGGCGATTCCAATGGGCGAATGCTATTTACTTTCTCGGATGACATTACAGACGGAAGTTTTATAACCTTTGTCAGAGCAAAGGGAACAAAGGCATCCCCGACTGCCGTGACAGATGGAACAGTCATCGGATATGTTCGCGGGCGGGCATGGCAACAGTCCGGCGAAAGTTTTGGCAATGCAACCGACACACAGGTTGAAATTCAACTAGTCGCAGACGGAGATTGGGATGTTGACGATAATCCCACACGTTTGGAAATATATACAACCCCAGCAGGGTCAGGAACCAAGGCATTGAGAATGACCATCGGGAGCGACGGGCAGATAACCTATCACAATTACGGAGACGGAACGTTTGAGGACACACCCGCTTATTTTCTCGGCGTGGATGCGGATGGAAAAGTCATCGAAGTTGACCCGGCAGATGTGGCAGACGGATGGACAGCCTATTCTGCCGTCGTTCCAACACGGATTGCATCCTCACTTGATGGAACATTTACAGTGACGATTGCATCACCCGCCGTTGTGACTAAAAACGGACATGGACTGTATTTGGGTCAGAGACTACAACTCACCACCACAGGCGCATTGCCGACAGGATTGGCAACGGGGACAGATTATTATGTGATTTACGTGGACGCAAACACATTCCGGCTGGCAACAAGTTTGGCGAACGCCAAAGCGGGGACGGCTATCAATACATCCGGGACTCAATCCGGGACTCATTCCATTGTCTGCAACCTAGACCCCGCGTATCGTATCCAGTTTGCGGGAGTGGATTTGTCCTCCACATTGCAAGAAAGTATGCCGATCAAATGGACGCAGAACAGCATTGTCAGATATGGCTGGATCTGCTCCGCGCCCACGTATAGCGGCGGAAATACGACATTCCACGTCCTGACCCGTTGCGATAGCACAAGCGCAGATTATGATGTGTTGGACACTGGAACTTATGCAATATCAGAATTCCATTACGGGCTTCCCAAACAGCCGGGAACAGGTTTCCCCGCATTGCCGGAATACTGGACAATGGAAATGACGGACACAGGCAACCAACTTGCATCCGGGGCAACTGCCGGTGTTGACTACAATCCCGCAGGGTTATCGTTATGGGTTTCCATAGGGACGTGGAAAATCACCGGCAACCATATCACCTGGGTGGAATTCACGGGTACAAATCTAAGGTTTTCGGTTATTGGAAAAGTCTCCGACGGCATTTCAGATATTATCGGAACGTATTATTTCCTTGCAACATCAACTTCATTGATTGCGAATGGCGGATACGACCTGTCAAAACACGTCCGACTGACGAGTCCGAGAACGTATCATAACCTTGTGCAATGCGGCACATCAAGTCCGACCGCCTTGCGGGTTAGAGGTGACATATCCACCACAAGAATCAATGCCGTATGTGCATATTTGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
1ce1f6faeb1109b4eb8705901e56313c3ceb25dedb60309d986c4476828ea889
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6330
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50