Genbank accession
QOR56158.1 [GenBank]
Protein name
tail fiber protein
RBP type
TF
Evidence GenBank
Probability 1,00
Protein sequence
MPLPDITVDPTEYGRVTFTGLISILDSISDPDDVPDKAAVTGAIIFKPSAGALKFLGASPVFTLFLSNREVQLVDAKVDEQGRKYVKLESNSAAAVPDQFTWTAVFSLSYNGVMLNIPPCTFALMPGQELDLSTVLNSSEVTYYTPIQVSAAVAAREGAEVARDETVTIKEEVTEVAETVDAKIGAIPITALPEAESDARYSPRIPTYQAQLLGKAMKKLRLGQPVKIVCRGDSTTYGHDTVSSDRVPAPDVTLPDGTKPTFTRSPVPFPQAMQNFLNQTYGEIVTVENQGHSGDWVQRGMTRWLNNVNADITVISYGINDALATGVPVEIRGNISSYIEATEKMILRDLEWGSAVVLMAPIRQRGPLGSPDVDAYRNALRGLADSYGLPLVDTEEFLITAPWDCWSDGNHLNTKGNGIMGARLAALFVGEGPLKKNVLEPGSKLLGRPTLDNVVLRGAVQTNSSGFGTPRDEAAMAAGTAVGFQGGGTAALDGVATWSFYTESPDVVIIPWSYINAGAGEAGAQISYELDFAVEQGQNYHVDVATPGESGNGSLAPSYKFHGPVAAGQAATFINDPATSPLAIRVATPGWHTIRAIYHRSVTASVAVTHMIEAFAWRTYQQMRKPIDFTPVIAALEPVNIRVMPNLDESADILSTKVHWPTLVQALHVKNWANQYYGAPIIKLTLRTYGVGVVQYAFLCTLRTDLPGADVAQRAVEGYGATEPSQGIAFVRKLGAGFATVSAGAPPETAISGRELAYISYEAATQSLVFTWRTVNSGDSTAKNMKKNFLMTFSLF
Physico‐chemical
properties
protein length:796 AA
molecular weight: 85469,79750 Da
isoelectric point:5,11837
aromaticity:0,08543
hydropathy:-0,03593

Domains

Domains [InterPro]
DC_1109
ATT
1–248
IPR051532
Unmapped
156–426
IPR036514
STR
213–428
SSF52266
STR
215–430
SSF52266
STR
225–428
cd00229
ENZ
228–427
IPR013830
ENZ
232–417
QOR56158.1
1 796
Architecture
ATT
STR
ATT 1-248 | STR 249-796
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Gordonia phage Linetti
[NCBI]
2777311 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QOR56158.1 [NCBI]
Genbank nucleotide accession
MT986029.1 [NCBI]
CDS location
range 11030 -> 13420
strand +
CDS
ATGCCTCTGCCTGACATCACCGTTGACCCAACCGAGTACGGTCGGGTTACCTTCACTGGACTCATCTCCATTCTCGACTCCATTTCCGATCCAGACGACGTGCCAGACAAGGCTGCCGTAACTGGTGCGATCATCTTCAAGCCCAGTGCTGGTGCACTGAAGTTCCTTGGCGCAAGCCCGGTGTTTACCCTGTTCCTATCGAATCGCGAGGTTCAGCTCGTCGATGCCAAGGTTGACGAGCAGGGCAGGAAGTACGTCAAGCTGGAATCCAACTCGGCTGCGGCCGTCCCCGACCAGTTCACCTGGACGGCGGTGTTCAGTCTTTCGTACAACGGGGTAATGTTGAATATCCCGCCATGTACGTTTGCACTGATGCCAGGCCAGGAGCTCGATCTGTCCACCGTGCTCAATTCGAGCGAGGTGACATACTACACTCCAATTCAGGTCTCGGCTGCTGTTGCGGCACGCGAGGGTGCCGAGGTTGCTCGCGACGAAACGGTCACCATCAAGGAAGAAGTCACCGAGGTAGCCGAAACTGTTGACGCAAAGATCGGCGCCATTCCGATCACTGCGCTACCGGAGGCAGAGTCGGATGCCCGATATTCCCCGCGCATTCCGACATACCAGGCTCAGCTTCTTGGTAAGGCTATGAAGAAGTTGCGTCTCGGTCAGCCCGTCAAGATTGTGTGTCGTGGCGACTCGACCACCTATGGTCACGACACGGTCTCTTCTGATAGGGTTCCCGCACCTGACGTGACGCTTCCCGATGGAACGAAGCCGACATTCACCCGGTCGCCAGTTCCATTCCCGCAGGCGATGCAGAACTTCTTGAACCAGACATACGGGGAGATTGTCACCGTAGAGAACCAGGGACACTCGGGGGACTGGGTTCAGCGAGGCATGACCCGCTGGCTCAACAACGTGAATGCCGACATCACAGTTATCAGCTACGGAATCAATGACGCTCTCGCCACCGGCGTGCCGGTCGAGATTCGAGGAAACATCTCGTCGTACATCGAGGCGACAGAGAAGATGATTCTTCGAGACCTGGAATGGGGGTCGGCCGTTGTACTCATGGCACCCATTCGCCAGCGTGGTCCACTCGGAAGCCCTGATGTTGACGCGTACCGGAACGCGCTGCGAGGACTCGCAGACTCCTACGGCCTTCCGCTTGTGGATACAGAAGAGTTCCTGATCACCGCGCCCTGGGACTGCTGGTCTGATGGCAACCACTTGAATACCAAGGGCAACGGAATCATGGGCGCACGACTTGCCGCTCTGTTTGTTGGCGAGGGTCCGCTCAAGAAAAATGTGCTGGAGCCGGGCAGTAAGTTGCTCGGACGTCCGACCCTGGACAATGTCGTTCTGAGGGGTGCGGTACAGACAAACTCGTCAGGCTTCGGAACACCTCGCGACGAAGCCGCGATGGCTGCTGGCACGGCAGTGGGGTTCCAGGGCGGCGGCACCGCGGCCCTGGATGGAGTGGCGACCTGGTCTTTCTACACAGAGTCTCCAGATGTGGTAATCATTCCGTGGTCTTACATCAACGCTGGCGCTGGAGAGGCAGGCGCTCAGATTTCCTACGAGCTTGACTTTGCTGTCGAGCAAGGTCAGAACTACCACGTTGATGTGGCTACTCCCGGCGAATCTGGAAATGGCTCTCTGGCTCCAAGTTACAAGTTCCATGGCCCAGTTGCCGCAGGTCAAGCTGCAACATTTATCAACGATCCGGCAACCAGCCCGCTGGCAATTCGAGTGGCGACCCCAGGTTGGCATACGATCCGAGCTATATACCACCGCTCGGTAACAGCTTCTGTCGCTGTGACTCACATGATTGAAGCCTTTGCCTGGCGCACCTATCAGCAGATGCGCAAGCCGATTGACTTCACTCCGGTGATCGCAGCGCTAGAGCCAGTGAACATTCGGGTGATGCCCAACCTGGACGAGTCTGCTGATATTCTCTCGACCAAGGTTCACTGGCCCACATTGGTTCAGGCATTGCATGTGAAGAACTGGGCCAACCAGTACTACGGTGCCCCGATCATCAAGCTCACACTCAGGACATACGGGGTGGGTGTTGTTCAGTACGCATTCTTGTGTACACTGCGCACCGACCTTCCCGGCGCGGACGTGGCGCAGAGAGCTGTTGAAGGATACGGTGCAACCGAACCCTCGCAGGGCATTGCGTTTGTCCGAAAGCTTGGAGCTGGGTTTGCAACAGTCTCCGCGGGGGCGCCACCCGAGACCGCAATAAGCGGTCGCGAGCTTGCGTACATCTCGTACGAGGCCGCTACCCAGTCGCTTGTGTTCACCTGGCGTACCGTTAACTCGGGAGACTCGACAGCAAAGAACATGAAGAAGAACTTCCTCATGACGTTCTCGCTGTTCTGA

Genome Context

Genome Context

Tertiary structure

PDB ID
1a650ee0b30e4a0de1343f66d204eef3ae8873989690f78c83af12ee045197b9
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6108
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50