Genbank accession
XFA12127.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
Protein sequence
MSDPIQKLRDEQKEFTAILDGASRKMPTKQSAAAVEAAAQPAPPPPPPPPTDLVPERTELPPAQLQTPIDASSIGEGWSLGGRITEAPAPPTPQIGVTPTEILQGVVTPNVEQGLQSQFDQRAINDLEASQATQAVMPYVYQPPSLDAVQQSFGETARWSMRNIEQQNIQARANRDLQLQQQAEWSRQALEFLQSEEGKKGTTGDPFDWVKDIVGVKENGRTYLQPWNDKRGFSVPASLLYGLGVVQNSGVGAILDVKALTQFVTRSAPPWAQVDPGRLPGWAQGLLNSADKALSQTLGGANAAIPALLSGDPRRGLFRGIADWLRTPDTRIIDKKSNVIEAIRGAQYSFTDEVGTGVGIKVDRGIRVGAAPGKGFGFDVNPSVLVGFGLDVIAGNRADKIIDTGRILFSPVRGAYRMLRGKRSVEAVEQALANVPAPPSPPPVPFVPKQLELSFLPNMPQVVKKKPASEAKILEQTFSSQALAAFKKANQQQAKKIVQMKKAQAAAAAKTEQLSLDLQSVTPVRANQLELDLKVASRPLDDLPTVNVSGRRSRTPTPTKRVQVEPQQLELNFNAASDPVRAAQQVLENLPKTGNPAADAYMRGRVINSLLAEAKQTSESAQQGLDITPDIGRKFVGDAPPPPPAVNVRVGELPTVAVPDAPTFHGTRVEGLNLSVTDPVEGASRSELGTAHYLTTDPDQSRAASLAISSENLPDVEGRVINTPRFVNAQVEPSARLIDAKTPSPQITRIADAVGQEYGVRFSREPMTLIDMFDEASRQLPEVEALQFQRAVVKTLREAGYDGAVAGRTVAVYNPQVIRQAGEAIVDEAEGVIPKLAARADLEGQAVNETGAEFAKAASVDSEVRLASQVAYEAQRLADEVAGESVQANELAKLWDDLELPDTNTQVLDFGDDVFETSTEVFYKAPMHDVNAYEYFDILSSTIYKIGDPTYSSSKIAAALDIAEQSPDLAESKAFKQALGDAIEKDMGYWETGGTMSEAEDELVESVKKLFAAIDDMPLDGYPMSTTMKDLGQQSFNQFGMMSEDWWTVVHYYMNSSNSDLANDLAYKLSAFAKSADPALQNEFFNLVKLNISTINGFTPNKIMTENALLSVLTELKVGAAGDYVNAMGGDPQVAKMLADVETFAGALKTEQTILLNSLLNDFKYYYNLSPTNKSYWDDALGRLKDYWYDHKSLIQGFNAEYEVQKTIADNISVDSRRTIEALIRKYEPSFNPEPAFGSADEIRELIIKVKNPPPHVIERLNGFNRNELVIYAYTDTETYDVVNQYLRTGVAATAEPYTSMLRLLPDLDVAIRTQPTAGGTLYRGVGGLKFTDALERYKLGEEVTETMFLSTSTKQSVAQSFGAGGTHFVILDAKGYKLHSVASKFLTGESEVLLPRNTKFAVEGIDESTRTITLRQIPNHEFTSYNRISVLYSELQELERQFYRNPDPSIFKAMAERQAELDELVKKSPCEL
Physico‐chemical
properties
protein length:1473 AA
molecular weight: 160884,31350 Da
isoelectric point:4,94172
aromaticity:0,07332
hydropathy:-0,34623

Domains

Domains [InterPro]
DC_2295
STR
1–1255
Coil
Unmapped
5–25
IPR050999
Unmapped
1263–1418
SSF56399
Unmapped
1263–1409
IPR000768
RBD
1263–1418
XFA12127.1
1 1473
Architecture
STR
STR 1-1422 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Leptolyngbya phage Dor1
[NCBI]
3279181 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XFA12127.1 [NCBI]
Genbank nucleotide accession
PQ195596.1 [NCBI]
CDS location
range 19880 -> 24301
strand -
CDS
ATGTCTGACCCTATTCAAAAGCTGCGTGATGAGCAGAAAGAGTTTACCGCCATTCTGGATGGTGCGTCCCGCAAGATGCCCACCAAACAGTCAGCAGCGGCGGTAGAGGCTGCGGCACAACCAGCTCCTCCTCCTCCTCCTCCTCCTCCTACTGACCTTGTGCCTGAGCGTACAGAACTTCCACCTGCTCAATTGCAAACCCCCATTGATGCTTCAAGTATCGGTGAGGGGTGGAGTTTGGGAGGAAGAATTACCGAGGCACCCGCACCCCCTACACCACAGATTGGGGTCACCCCTACTGAGATACTTCAAGGTGTGGTGACGCCTAACGTAGAACAGGGCTTACAGTCACAGTTTGACCAGCGGGCTATCAACGACCTTGAGGCTTCACAGGCAACTCAAGCTGTAATGCCCTACGTCTACCAACCACCCTCACTTGACGCAGTACAGCAAAGCTTCGGTGAGACTGCTCGTTGGTCAATGCGAAACATTGAGCAGCAGAACATCCAAGCCAGAGCTAACCGCGACCTGCAACTTCAGCAGCAAGCTGAATGGTCTCGCCAAGCCCTTGAGTTCCTCCAGTCAGAAGAGGGGAAGAAAGGAACTACCGGAGACCCATTCGACTGGGTGAAAGATATTGTGGGGGTGAAAGAGAATGGGCGCACCTACCTCCAACCGTGGAACGACAAGCGTGGCTTTAGCGTTCCAGCCTCTTTACTCTACGGGTTAGGTGTTGTGCAGAACTCCGGAGTGGGGGCAATACTCGACGTCAAAGCGCTGACTCAGTTTGTCACTCGCTCTGCTCCACCTTGGGCGCAGGTTGACCCAGGGCGTTTACCTGGGTGGGCACAAGGTCTGCTCAATAGTGCTGACAAAGCTTTAAGTCAAACGTTAGGTGGGGCTAACGCCGCCATCCCCGCCCTTCTTAGTGGTGACCCCCGCCGTGGGCTATTCCGTGGGATTGCCGACTGGCTACGCACACCGGACACCCGCATCATTGACAAGAAGAGCAACGTCATTGAGGCTATCCGTGGTGCCCAGTACAGCTTTACCGATGAAGTCGGTACTGGTGTGGGCATCAAGGTAGACCGGGGAATCAGGGTGGGGGCTGCTCCAGGTAAAGGGTTTGGCTTCGACGTCAACCCTAGTGTGCTTGTTGGGTTTGGACTCGACGTGATAGCGGGCAACCGGGCAGACAAGATTATTGATACCGGTCGTATACTCTTCTCTCCTGTGAGGGGGGCATACCGGATGTTGAGGGGGAAACGCTCAGTCGAAGCAGTAGAGCAGGCGCTAGCTAACGTACCTGCACCCCCATCTCCCCCTCCTGTGCCCTTTGTACCTAAGCAGTTAGAGTTGTCTTTTCTACCTAACATGCCACAGGTTGTTAAGAAAAAGCCTGCAAGCGAGGCTAAGATTCTAGAACAAACATTTAGCAGCCAAGCTTTGGCAGCTTTCAAGAAAGCCAACCAACAGCAGGCTAAGAAGATTGTTCAGATGAAAAAAGCTCAAGCTGCTGCCGCTGCTAAGACAGAGCAGTTAAGTCTTGACCTTCAGTCTGTTACGCCAGTACGCGCCAACCAATTAGAGCTTGACTTAAAGGTAGCGTCTCGACCTCTTGACGATTTGCCCACTGTTAATGTGTCTGGTAGACGTTCGCGCACCCCTACACCTACTAAGCGTGTACAGGTTGAACCTCAGCAGTTAGAGTTGAATTTTAACGCAGCGTCTGACCCAGTTCGGGCTGCTCAACAGGTGTTAGAGAATCTACCTAAAACTGGCAACCCGGCAGCAGACGCTTATATGAGGGGGAGAGTTATCAACTCACTACTCGCGGAAGCTAAACAGACAAGCGAGTCAGCACAACAAGGGCTAGACATTACCCCAGATATCGGGCGTAAGTTTGTAGGTGACGCCCCGCCTCCCCCGCCTGCCGTGAATGTGCGGGTAGGGGAATTACCAACTGTAGCTGTACCTGACGCCCCTACCTTTCACGGTACCCGTGTGGAGGGGTTAAACCTCTCAGTGACTGACCCTGTGGAGGGGGCGTCTCGTAGCGAGTTGGGGACAGCCCATTACCTGACGACTGACCCTGACCAATCACGGGCGGCGTCGCTTGCTATCTCATCTGAGAACCTCCCGGATGTGGAGGGGCGGGTAATCAACACCCCCAGATTTGTCAACGCACAGGTTGAACCTAGCGCCCGTCTCATCGACGCTAAAACTCCATCCCCCCAGATTACCCGTATAGCTGACGCTGTTGGTCAAGAGTATGGGGTACGCTTTAGTCGCGAACCTATGACCCTCATAGACATGTTTGACGAAGCGTCGCGCCAGCTACCCGAAGTTGAAGCCCTCCAGTTCCAACGGGCGGTAGTTAAGACGCTGCGTGAGGCGGGATACGACGGGGCGGTAGCCGGACGGACAGTTGCAGTGTACAACCCCCAAGTTATACGGCAAGCAGGGGAGGCAATAGTCGATGAAGCTGAGGGTGTGATACCCAAGCTTGCAGCACGCGCAGATTTGGAGGGGCAAGCTGTAAATGAAACTGGGGCTGAGTTTGCTAAAGCAGCAAGTGTGGACTCTGAAGTACGACTGGCATCTCAGGTAGCCTATGAAGCTCAACGTTTAGCTGATGAAGTAGCAGGCGAAAGCGTACAGGCTAACGAACTAGCTAAGCTATGGGACGACCTTGAACTACCTGACACTAACACTCAAGTTTTAGACTTTGGTGATGACGTGTTCGAGACGTCTACCGAAGTGTTTTACAAAGCACCGATGCATGACGTAAACGCTTATGAGTACTTTGACATTCTGTCTTCCACCATCTACAAGATTGGCGACCCCACCTATAGCTCTAGTAAGATAGCCGCTGCGCTCGACATCGCAGAGCAAAGCCCCGACTTAGCAGAGTCTAAAGCTTTTAAGCAAGCACTAGGTGACGCTATTGAAAAAGACATGGGCTACTGGGAGACTGGGGGTACCATGTCAGAGGCGGAAGACGAATTGGTAGAGTCAGTGAAGAAACTCTTTGCCGCTATCGACGACATGCCGCTTGATGGCTACCCCATGAGTACCACCATGAAAGACCTAGGGCAGCAGTCTTTCAACCAGTTTGGTATGATGAGTGAAGATTGGTGGACAGTTGTGCACTATTACATGAACTCTAGTAATAGTGATTTAGCTAACGACTTAGCCTATAAGCTATCAGCATTTGCTAAAAGCGCCGACCCTGCCCTTCAGAACGAATTCTTCAACTTGGTCAAGTTAAACATCTCGACCATTAACGGGTTCACCCCCAACAAAATTATGACTGAGAATGCGCTACTCTCAGTGTTGACAGAATTAAAGGTGGGGGCAGCGGGAGACTACGTGAACGCAATGGGGGGAGACCCACAGGTTGCAAAGATGCTGGCGGATGTAGAGACATTTGCAGGTGCTCTAAAGACTGAGCAAACTATCTTGCTTAACAGTTTGCTCAACGACTTTAAGTATTACTACAACCTCTCCCCCACCAATAAAAGCTACTGGGACGATGCGTTAGGGCGGCTTAAGGATTACTGGTATGACCACAAGTCATTAATCCAAGGGTTCAACGCTGAGTACGAGGTCCAGAAAACTATCGCTGACAACATTAGTGTAGATAGCAGGCGCACTATTGAAGCGCTCATTCGTAAGTATGAACCAAGCTTTAACCCTGAACCTGCCTTTGGGTCAGCAGATGAAATCCGTGAGCTTATCATCAAAGTTAAGAACCCGCCACCACACGTCATAGAGCGCCTTAACGGGTTCAACCGCAACGAGCTAGTCATCTATGCTTACACGGATACTGAAACGTACGATGTTGTTAACCAATATCTGCGTACCGGTGTTGCTGCCACAGCGGAACCTTACACGTCTATGCTTCGACTATTGCCTGACTTAGACGTAGCAATCCGTACGCAGCCTACCGCCGGTGGTACACTCTACCGCGGTGTAGGGGGTTTAAAGTTTACCGACGCCCTTGAGAGATATAAACTGGGGGAGGAAGTCACTGAGACAATGTTCCTCAGTACCTCTACTAAGCAGAGTGTAGCCCAGAGTTTTGGGGCAGGTGGTACGCACTTCGTCATACTTGATGCAAAAGGCTACAAACTGCACAGCGTCGCTTCTAAGTTTTTAACGGGGGAGAGTGAGGTACTGTTGCCACGTAACACTAAGTTTGCAGTAGAGGGTATCGACGAATCAACCCGTACTATCACTTTGCGCCAAATTCCTAACCACGAGTTCACGAGCTACAACCGTATCTCGGTGCTGTACAGCGAACTACAAGAGCTAGAGCGTCAGTTCTACCGCAACCCTGACCCCTCAATCTTTAAGGCTATGGCTGAGCGTCAAGCTGAGCTAGACGAACTTGTCAAGAAATCACCCTGCGAGTTGTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
4784a1d1dbf18ad616d1b81bc7fd5ca44981e9c4198c880b23ca2f0e81015a36
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,4143
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50

Literature

Title Authors Date PMID Source
Isolation of a cyanophage induced from a fish pond Avrani,S. and Cattan-Tsaushu,E. 2025-02-11 GenBank