Genbank accession
AEO93678.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence Phold
Probability 1,00
Protein sequence
MCPSFRRSNKGIFQDNSNVLSIFHGTDAFLLEDELNESQWNHIEARAEMFRAQYTSGILSDFNLVKVDNNSSYIETKDSKPFYVLVDGYLVKIGGNQFGNILSSDSRLIFDTNLENEVDKLHFIEFWFEAINHSQDLRKFGGEDTSLITNKMLDDRIKTETSRRIQMQWKISYHQTLTLDDEIGKWIKVGDHLYKKNFNPIYDLNGNLTNPGIRYAIIVAKNSHVSGEELLIHEEARVKLKENNAFKDLNKGENGDISFTDENNLFESETLNGALDELKIQSNNIGKNRTEIVTDIIHSGFTKLGEIGEDVILDDNYLIERNNFELSESTVYINGQRISIPKRMINLSEPPENGSREDLVFLEAFWTMKNPGDAIYKNNCVEDSIERYTITYEKILEWRIRIVDGVDFAKFTMDGFTVDTDNLDSDKYNNKVILPMGKKSSPITYNTSQYDNGIIRFSNYKQNSNNDIGFYLAGNGDAESKLILDTIDGYIYAIPMFKIKRRNSKEFSANNSYGSSSVKQVIKQYIDFNNVQPNELQKLSLNSDLVQYFKTVIGRKFIYVPEKESYKFLVVSADETNNVVTIKNIGTQLIDYNDAYWVIVSSRPDEKYSDVVYRDDIIDLRHKVSFSNCDYKSLLEKNFNKLLKGKLNTKEQIKMKKEYINLQPAQIEIASSFKPVKVNQADGNSKKLVNMMSGFSNNSKSKMYWLTPPEYYGDNPLEFKWIEEENAFSATKEYFCYTHSVPVNVKINSYYLAGFKLKGGTGYFHIHETGNENSFTDITGIAENDEYQNFYLPFKTENKRSIYYEFENEKLNSGGTRIGYYETMFKDVFLYEIDEATYNLILNKNVEYVGDKLTQKFPYVSSYPTVVENLIPNLNSEIWDQYSKAKIVNGKLVLTANESEVNSFIVLDGQSFTTYILECDYISEDGKQPTIYTTSDKVDWWELGFVYRHGSIIVFYTGNWTSKIAIDFHNSNKGTFTFENFKLSKVNSYIEQYVPYGRWVLPEDLILENLNLKTNLRDDRKTISDAITLDTVVDKIEAAKTSQKHIITKQATKGIWSIGDTITIKAEKGIIGGVLNSEDILAKILTNSGGSISKVEVDDISKLTVNKSFKIFNASTNEISNTVYNVNDILVGNKQIVFSPELTIDDNDVRILVETSVSNSVPLAKAAGLIGTWEGLESKKVIFKITTPPTTNNSDIELRYVVNYQAGEGIKKVPCEIFNPIINDIEYTRDSSLELKADFRGKVIRSVIENPHVVKESITSTTLLNPLDSGWIEYDGSMIQYLNGLVRTLESNSSDKITQQIFSFDILEEVERQIGRIPKITKDEKLQWLKNNISGITSNWYGYGSSVGGYGVEFAVFAASIGWTNKVNHLKSNISKLSITSFDLQNLIDSNGLMYFTVYTINKSNTSTPSIVFTDYIELNILMKNVSETDYETFTPSIKERLLVDDPSLFKEGENMINPINILPYTSLDKSTNTVMVGLPSSYNNTNIVSDYDFTVNIKDLINNKGFSVRFMSQPNKYYTLSFDLKLIKSANGIRVGILKDNGQYSYTTYTTDGLISTTINVPKTGEVVFVVESLTNQGSFKASNLMLTPGLTSKPFVPFSKFVKRKRKLNFLNKISGSTFENPHRDLWKDGNLEQPSEFFEENEQIYYEQASKEDGTVMEYYLNTIGRYPQDLFEFDLSHLGLSLSEIRAALKKVKVRWVGFGFGDSGGKRTYGSTIYIWENNAWNNSYGLQHNSNTSAVIEKDIPFNTNKSIISDDQKIRLLSRSTYPASKNIQASTFVDYVSLEIELADWVDTVKKNVVKVRKETKEIKTIYPTVSPSTGRTDKIELFYNYVPYQGILINSINSLRTKYADNNFMYNTTLGTGNICKSGSNVESVNLPLTPNTRDFDLVPKKQSHSYNNLESKNVRFNLNNSNIGLPNYYSLVDLDFNLENSDIKIERGIYAYSSTPYGFLTIDTLDNFSLLYHPMLVEFNNQLYMIVFAYNNNHNNTLSAVDMFSIDGRPLLKEDS
Physico‐chemical
properties
protein length:2010 AA
molecular weight: 229275,17720 Da
isoelectric point:5,31617
aromaticity:0,11443
hydropathy:-0,42502

Domains

Domains [InterPro]
DC_1728
STR
1–1579
IPR060108
RBD
1635–1788
AEO93678.1
1 2010
Architecture
STR
STR
STR 1-1579 | STR 1601-1885 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Bacillus phage G
[NCBI]
2884420 Uroviricota > Caudoviricetes > Donellivirus >
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
AEO93678.1 [NCBI]
Genbank nucleotide accession
JN638751.1 [NCBI]
CDS location
range 316783 -> 322815
strand +
CDS
ATGTGTCCTTCATTTAGAAGAAGTAATAAAGGGATATTTCAAGATAATAGTAATGTTTTATCTATTTTTCATGGTACTGATGCATTTTTATTAGAAGATGAGTTAAATGAATCTCAATGGAATCATATAGAAGCTAGAGCTGAAATGTTTAGAGCTCAGTATACAAGTGGAATTCTAAGTGATTTCAATTTAGTAAAAGTAGATAATAATAGTTCTTATATAGAAACTAAAGATTCTAAACCGTTCTATGTATTAGTAGATGGTTATTTAGTGAAAATTGGTGGTAATCAGTTTGGAAATATTTTATCATCAGATAGCAGATTGATATTTGATACAAATTTAGAAAATGAAGTTGATAAACTTCACTTTATTGAATTTTGGTTTGAAGCAATTAATCATTCTCAAGATTTAAGAAAATTTGGTGGAGAAGATACTAGTCTAATAACAAATAAGATGTTGGACGATAGAATTAAGACAGAAACATCTAGAAGGATTCAAATGCAATGGAAAATAAGTTATCATCAAACATTAACTTTAGATGATGAAATAGGTAAATGGATAAAAGTTGGAGATCATTTATACAAGAAGAATTTCAATCCTATTTATGACTTAAATGGAAATTTAACGAATCCTGGAATAAGATACGCAATAATTGTTGCTAAAAACAGTCATGTATCAGGAGAAGAGTTACTAATACATGAAGAAGCTAGAGTTAAATTAAAGGAAAATAACGCATTTAAAGATTTAAATAAAGGTGAAAATGGAGATATTTCTTTTACAGATGAAAACAATTTATTTGAATCTGAAACTTTAAATGGCGCGTTAGATGAATTGAAAATTCAATCTAATAATATTGGAAAGAATAGAACTGAAATAGTAACTGATATTATTCATTCTGGTTTTACGAAGTTAGGAGAAATAGGGGAAGATGTTATTCTTGATGATAATTATCTTATAGAAAGGAACAACTTTGAACTCAGTGAATCCACTGTATATATTAATGGTCAAAGAATTTCAATTCCAAAAAGAATGATTAATCTAAGCGAGCCTCCAGAAAATGGTTCAAGAGAAGATTTAGTGTTTTTAGAGGCTTTTTGGACTATGAAAAACCCAGGTGATGCTATTTATAAAAATAACTGCGTCGAAGATAGTATTGAAAGATACACCATTACTTATGAAAAAATATTAGAATGGAGAATTAGAATTGTAGATGGAGTAGATTTTGCTAAATTTACAATGGATGGGTTCACTGTAGATACAGACAACTTAGATTCAGATAAATACAATAATAAAGTTATACTCCCAATGGGTAAAAAATCATCACCCATAACTTATAACACTTCGCAATATGATAATGGTATTATTAGATTTAGTAATTATAAACAAAATTCAAACAACGATATAGGTTTCTATTTAGCTGGTAATGGTGATGCAGAATCAAAATTAATATTAGATACTATTGATGGATATATTTATGCTATTCCAATGTTTAAAATTAAACGTAGGAACTCTAAAGAATTTAGTGCGAATAACAGCTATGGCAGTTCATCGGTTAAGCAAGTTATAAAACAATACATTGATTTTAATAATGTCCAGCCAAATGAATTACAAAAATTAAGCTTAAATAGTGATTTAGTACAATATTTCAAAACAGTTATTGGAAGAAAATTTATATATGTGCCTGAAAAAGAGAGTTATAAATTTTTAGTTGTTAGTGCTGATGAAACAAATAATGTAGTGACTATTAAGAATATTGGAACTCAATTGATTGATTACAATGATGCTTACTGGGTAATAGTTAGTAGTAGACCAGATGAGAAATATTCTGATGTAGTTTATAGAGATGATATTATTGATCTTAGACACAAGGTATCATTTTCTAATTGTGACTACAAAAGTTTATTAGAGAAAAACTTTAATAAATTATTAAAAGGTAAATTGAACACTAAAGAACAAATAAAAATGAAAAAAGAGTATATTAACTTACAGCCAGCCCAAATTGAAATTGCATCAAGTTTTAAGCCAGTAAAAGTTAATCAAGCGGATGGAAATTCCAAAAAATTAGTTAATATGATGAGTGGTTTTAGTAACAATAGTAAGAGTAAAATGTATTGGTTAACGCCACCAGAGTATTATGGAGATAACCCTTTAGAATTTAAGTGGATAGAAGAGGAAAATGCATTTTCTGCAACTAAAGAATATTTTTGTTATACTCATTCAGTACCAGTTAACGTAAAAATTAATTCTTATTACTTAGCTGGTTTTAAATTAAAAGGTGGAACGGGATATTTTCATATTCATGAAACAGGAAATGAAAATTCTTTCACTGATATAACTGGTATAGCGGAGAATGATGAATATCAAAATTTTTATTTACCATTCAAAACAGAAAACAAAAGAAGTATTTATTATGAGTTTGAAAATGAAAAATTAAATAGTGGTGGGACTCGTATTGGTTATTATGAAACGATGTTTAAAGATGTTTTTCTTTATGAAATAGATGAAGCAACATATAATCTTATTCTTAATAAAAATGTAGAATATGTTGGAGATAAATTAACTCAAAAATTCCCTTATGTAAGTAGTTATCCTACTGTCGTTGAAAACTTAATTCCTAATTTGAACAGTGAAATTTGGGATCAGTATAGTAAAGCCAAAATAGTAAATGGAAAACTAGTTTTAACTGCTAATGAAAGTGAAGTAAATTCTTTTATTGTTTTAGATGGGCAGTCTTTTACAACTTATATACTTGAATGCGATTATATTAGTGAAGATGGAAAACAACCAACGATTTATACAACTAGTGATAAAGTAGATTGGTGGGAACTAGGTTTCGTCTATCGTCATGGATCGATAATTGTTTTCTATACTGGTAATTGGACTTCTAAAATAGCTATTGACTTTCACAATTCAAATAAAGGTACATTTACTTTTGAAAACTTCAAATTATCAAAGGTAAATAGCTACATTGAACAGTATGTACCTTATGGAAGATGGGTTTTGCCGGAGGACTTAATATTAGAGAATTTAAATTTAAAAACAAATTTAAGAGACGATAGAAAAACAATATCAGACGCTATAACACTTGATACAGTTGTAGATAAAATAGAAGCTGCGAAAACATCTCAAAAACATATTATAACGAAACAAGCGACAAAAGGTATTTGGTCTATTGGTGATACTATTACTATCAAGGCTGAAAAAGGAATCATTGGAGGAGTTCTAAATAGTGAAGATATTTTAGCTAAAATATTAACTAATTCTGGTGGTTCAATTTCGAAAGTTGAAGTAGATGATATTTCTAAACTTACAGTGAATAAGAGTTTTAAAATATTCAATGCTTCAACAAATGAAATAAGTAACACAGTTTACAATGTAAACGATATTTTAGTAGGCAATAAGCAAATTGTTTTTTCACCTGAACTAACTATAGATGATAATGATGTTAGAATATTAGTAGAGACATCTGTATCTAATTCAGTACCGTTAGCCAAAGCTGCCGGTTTAATAGGCACTTGGGAAGGATTAGAATCTAAAAAAGTTATTTTCAAAATTACAACTCCTCCAACTACTAATAATAGTGATATTGAATTACGTTACGTAGTTAATTATCAAGCGGGTGAAGGAATTAAGAAAGTTCCTTGTGAAATTTTCAATCCAATAATTAATGACATTGAATATACAAGAGATTCTTCATTAGAGTTAAAAGCTGATTTTAGAGGAAAGGTTATTAGAAGTGTTATCGAAAATCCACACGTTGTAAAAGAAAGTATAACTTCTACTACTCTACTAAATCCATTAGATAGCGGGTGGATAGAGTATGATGGTTCTATGATACAATACTTAAACGGTTTAGTTAGAACATTAGAAAGTAATAGTAGTGATAAGATAACACAACAGATTTTTTCTTTTGATATTTTAGAAGAAGTTGAACGTCAAATTGGAAGAATACCTAAAATTACAAAAGATGAAAAATTGCAATGGTTGAAAAATAACATCAGCGGTATTACTAGTAATTGGTACGGTTATGGGAGTAGTGTAGGAGGGTATGGAGTTGAATTTGCGGTTTTCGCTGCTTCAATTGGCTGGACTAATAAAGTTAATCATTTAAAGTCAAACATTTCTAAATTAAGCATTACTTCTTTTGATTTACAAAATCTGATTGATTCAAATGGTTTAATGTATTTTACAGTTTACACTATCAATAAATCAAACACATCGACACCATCAATAGTATTTACTGATTATATAGAACTAAACATTTTAATGAAAAATGTTTCTGAGACTGATTATGAGACATTTACACCAAGTATTAAAGAGAGATTATTGGTTGATGACCCTTCTTTGTTTAAAGAAGGAGAAAACATGATTAATCCTATCAATATTTTGCCTTATACTTCATTGGATAAGTCTACGAATACTGTTATGGTAGGTTTACCTAGCTCTTATAACAACACTAATATTGTAAGTGATTATGACTTTACAGTTAATATCAAAGATCTAATTAACAATAAGGGTTTTAGTGTTAGATTTATGAGTCAACCAAATAAATATTACACTCTGAGTTTTGATTTAAAGTTAATTAAGTCTGCTAATGGTATAAGGGTTGGAATATTAAAAGATAATGGACAATATAGCTACACTACCTATACAACTGATGGATTGATTTCAACAACTATTAATGTTCCAAAAACTGGAGAAGTTGTTTTTGTTGTAGAAAGTTTAACAAATCAAGGAAGTTTTAAAGCAAGTAATCTAATGTTAACGCCTGGGTTAACATCGAAGCCATTTGTTCCATTTTCTAAGTTTGTAAAGAGAAAACGCAAGTTAAATTTCCTAAATAAAATATCTGGAAGTACATTTGAAAATCCCCATAGAGATTTATGGAAAGATGGTAATTTAGAACAACCTTCAGAGTTTTTCGAAGAAAATGAACAAATCTATTATGAACAAGCAAGTAAAGAAGATGGAACTGTAATGGAGTATTATTTAAATACAATAGGGAGATATCCGCAAGATTTATTTGAATTTGACTTATCTCACTTAGGATTATCACTTTCTGAAATTAGAGCTGCTCTTAAGAAAGTAAAAGTTAGATGGGTTGGCTTTGGTTTTGGTGATAGCGGTGGTAAGAGAACTTACGGTAGTACTATATATATATGGGAAAACAACGCTTGGAATAATAGCTATGGATTACAGCACAACAGTAATACTTCTGCTGTTATCGAGAAAGATATACCCTTTAATACAAATAAAAGTATTATTAGTGATGATCAAAAAATACGTTTATTGTCTCGTTCTACTTATCCAGCTAGTAAAAATATACAGGCTAGTACTTTTGTAGATTATGTTTCATTGGAAATAGAGTTAGCAGATTGGGTAGATACAGTTAAGAAGAATGTAGTGAAAGTTAGAAAAGAAACAAAAGAGATAAAAACTATTTACCCAACAGTTTCTCCTTCAACTGGTAGAACTGATAAGATTGAGTTGTTCTATAATTATGTCCCATACCAAGGGATTCTTATAAATAGTATTAATAGCTTAAGAACAAAGTATGCAGACAACAACTTTATGTATAATACCACTCTAGGAACAGGTAACATTTGTAAATCTGGAAGTAATGTTGAGAGTGTTAATTTACCATTAACTCCAAATACTAGAGATTTTGATTTAGTTCCAAAAAAACAATCGCATTCTTACAATAATTTAGAGTCTAAAAATGTAAGATTTAATCTTAATAACTCTAACATTGGTTTACCTAATTATTATTCGCTTGTTGATTTAGATTTCAATTTAGAAAATAGTGATATTAAAATTGAGAGAGGTATTTACGCTTATAGTTCAACACCTTATGGTTTCTTAACTATTGATACTTTAGATAATTTCTCATTATTATATCATCCAATGTTAGTTGAGTTTAATAATCAATTATATATGATTGTATTTGCTTACAATAACAATCATAATAATACATTGAGCGCGGTAGATATGTTTTCTATTGATGGTAGGCCTTTATTGAAGGAGGATAGTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
6f6ea2cd903be55ba073ffb29cdd3cafc168c1cb5e53ba8c8b539db8e79fb162
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,5412
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50