Genbank accession
AAN01638.1 [GenBank]
Protein name
hypothetical protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
Protein sequence
MGAELAKEYIDAWISYVSPAGQVFYLAGPQAPVAGAQNGFVLQEIRGVQAPITHLTSKGARQDGDTWNDSIYESAELDFTVEASGVTTQDTRREVRSWVDAWTPKKLGKFSWFTPENGEWWMDVRQHKNVPDVLSHVRSKRQVFTWTAVNNDAFWKSFDSVSAFGMTYEDETDEFDRVDHTGLGDGYIQTYTGDEDAGVCGTDGTVMRWYPGSSKGTRYVHNLFIADKPSSDNVIVSFTYSGIQRFPFPAPAVNELWARCGVVDDGEGGQAWDGSGIRMQLVGQNVSISVFKDHEMIHTWIRPLLIAPLWGEKWTLVCGSAKNGRQYRVLRGDPGFEVLSYTEPKTESYMDEDHRYTGHGMKATAGLLNTQVLPAEIHRFSFADNLQAGQSGHLALSNRGDQDGWPRYLCYGPGTFKFSNGPGAEPTITFGPLLEGQVVMLTTLPRLRSVIDLSPNQPTEQQLSAFQDLIKDLISFATNNNVPPLLQQFESWFGILPPQGNLYELLDGRFTVPIPPKPEDGPPETSFISVSISGATIDSKVVAALTPLRKWPE
Physico‐chemical
properties
protein length:553 AA
molecular weight: 61393,94810 Da
isoelectric point:4,98378
aromaticity:0,11212
hydropathy:-0,37251

Domains

Domains [InterPro]
IPR055681
STR
150–386
AAN01638.1
1 553
Architecture
ATT
STR
RBD
ATT 1-155 | STR 156-395 | RBD 396-553
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
AAN01638.1
1 553
Domain Start End Length (AA) Confidence
N-terminal 1 343 343 0,6132
Central domain 344 542 200 0,1618
C-terminal 543 553 10 0,6898
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-343
Central
344-542
C-terminal
543-553

Taxonomy

  Name Taxonomy ID Lineage
Phage Mycobacterium phage Cjw1
[NCBI]
2907830 Uroviricota > Caudoviricetes > Kostyavirus >
Host Mycobacterium
[NCBI]
1763 cellular organisms > Bacteria > Bacillati > Actinomycetota > Actinomycetes > Mycobacteriales
Host Mycobacterium sp.
[NCBI]
1785 cellular organisms > Bacteria > Bacillati > Actinomycetota > Actinomycetes > Mycobacteriales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AAN01638.1 [NCBI]
Genbank nucleotide accession
AY129331 [NCBI]
CDS location
range 18857 -> 20518
strand +
CDS
ATGGGGGCGGAGCTGGCGAAGGAATACATCGACGCATGGATTTCCTACGTCAGCCCAGCCGGTCAGGTGTTCTACCTGGCCGGTCCCCAGGCTCCCGTCGCGGGAGCGCAGAACGGCTTTGTCCTCCAAGAGATTCGGGGCGTGCAAGCCCCCATCACCCACCTGACAAGCAAGGGTGCTCGCCAAGACGGCGACACCTGGAACGACTCCATCTATGAATCCGCCGAGCTCGACTTCACTGTCGAGGCATCCGGCGTCACCACCCAGGACACCCGGCGCGAGGTTCGCAGCTGGGTGGACGCCTGGACCCCCAAGAAGCTGGGCAAGTTCTCCTGGTTCACCCCGGAGAACGGTGAGTGGTGGATGGATGTCCGCCAGCACAAGAACGTGCCGGATGTCCTCTCCCACGTCCGCAGCAAGCGCCAGGTCTTCACCTGGACCGCGGTCAACAACGACGCCTTCTGGAAGTCCTTCGACTCGGTCAGCGCCTTCGGTATGACCTACGAGGACGAGACCGACGAGTTCGACCGGGTCGACCACACCGGCCTGGGCGACGGGTACATCCAGACCTACACGGGCGACGAGGACGCAGGCGTCTGCGGCACCGATGGCACCGTAATGCGTTGGTACCCGGGAAGTTCCAAGGGCACCCGCTACGTGCATAACCTGTTCATCGCGGACAAGCCCTCCTCCGACAACGTCATCGTCTCCTTCACCTACAGCGGCATCCAGCGCTTCCCGTTCCCCGCACCCGCGGTCAACGAGCTCTGGGCGCGCTGCGGCGTGGTCGATGACGGCGAGGGTGGGCAAGCCTGGGACGGCAGCGGCATCCGTATGCAGCTGGTCGGCCAGAACGTCTCCATCTCGGTCTTCAAGGACCACGAGATGATCCACACATGGATCAGGCCGTTGCTGATCGCCCCGCTGTGGGGTGAGAAGTGGACGCTGGTGTGCGGCTCCGCTAAGAACGGCCGCCAGTACCGCGTGCTGCGCGGTGACCCCGGCTTCGAGGTGCTGTCCTACACCGAGCCCAAGACCGAGTCCTACATGGACGAAGACCATCGCTACACCGGGCACGGCATGAAGGCCACCGCGGGCCTGCTCAACACGCAGGTGCTCCCCGCGGAAATCCACCGCTTCTCCTTCGCCGACAACCTCCAGGCCGGTCAGTCCGGGCACTTGGCGCTGTCGAACCGCGGAGACCAGGACGGGTGGCCGCGCTACCTCTGCTACGGACCCGGCACCTTCAAGTTCAGCAATGGACCCGGCGCCGAGCCCACGATCACGTTCGGACCCCTCCTGGAGGGCCAGGTCGTCATGCTCACCACGCTGCCCCGGCTGCGCTCGGTGATCGACTTGTCGCCCAATCAGCCCACAGAGCAACAGCTCTCGGCATTCCAGGACCTCATCAAGGACCTGATCAGCTTCGCCACGAACAACAACGTCCCGCCGCTCCTGCAGCAGTTTGAAAGCTGGTTCGGCATCCTGCCCCCGCAAGGCAACCTGTACGAGCTCCTGGATGGGAGGTTCACCGTGCCAATCCCGCCGAAGCCGGAAGACGGCCCGCCTGAGACCTCGTTCATCTCGGTGTCCATCTCAGGCGCGACCATCGACAGCAAGGTGGTCGCCGCCCTAACTCCGCTGCGAAAGTGGCCCGAGTAG

Genome Context

Genome Context

Tertiary structure

PDB ID
208c45db767b21e11e3f23c2bed950fed26a8a00464601fe4368c2028bf584d6
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,8318
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Origins of highly mosaic mycobacteriophage genomes Pedulla,M.L., Ford,M.E., Houtz,J.M., Karthikeyan,T., Wadsworth,C., Lewis,J.A., Jacobs-Sera,D., Falbo,J., Gross,J., Pannunzio,N.R., Brucker,W., Kumar,V., Kandasamy,J., Keenan,L., Bardarov,S., Kriakov,J., Lawrence,J.G., Jacobs,W.R. Jr., Hendrix,R.W. and Hatfull,G.F. 2003 12705866 GenBank