Protein
View in Explore- Genbank accession
- QOR56158.1 [GenBank]
- Protein name
- tail fiber protein
- RBP type
-
TF
- Protein sequence
-
MPLPDITVDPTEYGRVTFTGLISILDSISDPDDVPDKAAVTGAIIFKPSAGALKFLGASPVFTLFLSNREVQLVDAKVDEQGRKYVKLESNSAAAVPDQFTWTAVFSLSYNGVMLNIPPCTFALMPGQELDLSTVLNSSEVTYYTPIQVSAAVAAREGAEVARDETVTIKEEVTEVAETVDAKIGAIPITALPEAESDARYSPRIPTYQAQLLGKAMKKLRLGQPVKIVCRGDSTTYGHDTVSSDRVPAPDVTLPDGTKPTFTRSPVPFPQAMQNFLNQTYGEIVTVENQGHSGDWVQRGMTRWLNNVNADITVISYGINDALATGVPVEIRGNISSYIEATEKMILRDLEWGSAVVLMAPIRQRGPLGSPDVDAYRNALRGLADSYGLPLVDTEEFLITAPWDCWSDGNHLNTKGNGIMGARLAALFVGEGPLKKNVLEPGSKLLGRPTLDNVVLRGAVQTNSSGFGTPRDEAAMAAGTAVGFQGGGTAALDGVATWSFYTESPDVVIIPWSYINAGAGEAGAQISYELDFAVEQGQNYHVDVATPGESGNGSLAPSYKFHGPVAAGQAATFINDPATSPLAIRVATPGWHTIRAIYHRSVTASVAVTHMIEAFAWRTYQQMRKPIDFTPVIAALEPVNIRVMPNLDESADILSTKVHWPTLVQALHVKNWANQYYGAPIIKLTLRTYGVGVVQYAFLCTLRTDLPGADVAQRAVEGYGATEPSQGIAFVRKLGAGFATVSAGAPPETAISGRELAYISYEAATQSLVFTWRTVNSGDSTAKNMKKNFLMTFSLF
- Physico‐chemical
properties -
protein length: 796 AA molecular weight: 85469,79750 Da isoelectric point: 5,11837 aromaticity: 0,08543 hydropathy: -0,03593
Domains
Domains [InterPro]
DC_1109
ATT
1–248
ATT
1–248
IPR051532
Unmapped
156–426
Unmapped
156–426
IPR036514
STR
213–428
STR
213–428
SSF52266
STR
215–430
STR
215–430
SSF52266
STR
225–428
STR
225–428
cd00229
ENZ
228–427
ENZ
228–427
IPR013830
ENZ
232–417
ENZ
232–417
1
796
Architecture
ATT 1-248 | STR 249-796
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Gordonia phage Linetti [NCBI] |
2777311 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QOR56158.1
[NCBI]
Genbank nucleotide accession
MT986029.1
[NCBI]
CDS location
range 11030 -> 13420
strand +
strand +
CDS
ATGCCTCTGCCTGACATCACCGTTGACCCAACCGAGTACGGTCGGGTTACCTTCACTGGACTCATCTCCATTCTCGACTCCATTTCCGATCCAGACGACGTGCCAGACAAGGCTGCCGTAACTGGTGCGATCATCTTCAAGCCCAGTGCTGGTGCACTGAAGTTCCTTGGCGCAAGCCCGGTGTTTACCCTGTTCCTATCGAATCGCGAGGTTCAGCTCGTCGATGCCAAGGTTGACGAGCAGGGCAGGAAGTACGTCAAGCTGGAATCCAACTCGGCTGCGGCCGTCCCCGACCAGTTCACCTGGACGGCGGTGTTCAGTCTTTCGTACAACGGGGTAATGTTGAATATCCCGCCATGTACGTTTGCACTGATGCCAGGCCAGGAGCTCGATCTGTCCACCGTGCTCAATTCGAGCGAGGTGACATACTACACTCCAATTCAGGTCTCGGCTGCTGTTGCGGCACGCGAGGGTGCCGAGGTTGCTCGCGACGAAACGGTCACCATCAAGGAAGAAGTCACCGAGGTAGCCGAAACTGTTGACGCAAAGATCGGCGCCATTCCGATCACTGCGCTACCGGAGGCAGAGTCGGATGCCCGATATTCCCCGCGCATTCCGACATACCAGGCTCAGCTTCTTGGTAAGGCTATGAAGAAGTTGCGTCTCGGTCAGCCCGTCAAGATTGTGTGTCGTGGCGACTCGACCACCTATGGTCACGACACGGTCTCTTCTGATAGGGTTCCCGCACCTGACGTGACGCTTCCCGATGGAACGAAGCCGACATTCACCCGGTCGCCAGTTCCATTCCCGCAGGCGATGCAGAACTTCTTGAACCAGACATACGGGGAGATTGTCACCGTAGAGAACCAGGGACACTCGGGGGACTGGGTTCAGCGAGGCATGACCCGCTGGCTCAACAACGTGAATGCCGACATCACAGTTATCAGCTACGGAATCAATGACGCTCTCGCCACCGGCGTGCCGGTCGAGATTCGAGGAAACATCTCGTCGTACATCGAGGCGACAGAGAAGATGATTCTTCGAGACCTGGAATGGGGGTCGGCCGTTGTACTCATGGCACCCATTCGCCAGCGTGGTCCACTCGGAAGCCCTGATGTTGACGCGTACCGGAACGCGCTGCGAGGACTCGCAGACTCCTACGGCCTTCCGCTTGTGGATACAGAAGAGTTCCTGATCACCGCGCCCTGGGACTGCTGGTCTGATGGCAACCACTTGAATACCAAGGGCAACGGAATCATGGGCGCACGACTTGCCGCTCTGTTTGTTGGCGAGGGTCCGCTCAAGAAAAATGTGCTGGAGCCGGGCAGTAAGTTGCTCGGACGTCCGACCCTGGACAATGTCGTTCTGAGGGGTGCGGTACAGACAAACTCGTCAGGCTTCGGAACACCTCGCGACGAAGCCGCGATGGCTGCTGGCACGGCAGTGGGGTTCCAGGGCGGCGGCACCGCGGCCCTGGATGGAGTGGCGACCTGGTCTTTCTACACAGAGTCTCCAGATGTGGTAATCATTCCGTGGTCTTACATCAACGCTGGCGCTGGAGAGGCAGGCGCTCAGATTTCCTACGAGCTTGACTTTGCTGTCGAGCAAGGTCAGAACTACCACGTTGATGTGGCTACTCCCGGCGAATCTGGAAATGGCTCTCTGGCTCCAAGTTACAAGTTCCATGGCCCAGTTGCCGCAGGTCAAGCTGCAACATTTATCAACGATCCGGCAACCAGCCCGCTGGCAATTCGAGTGGCGACCCCAGGTTGGCATACGATCCGAGCTATATACCACCGCTCGGTAACAGCTTCTGTCGCTGTGACTCACATGATTGAAGCCTTTGCCTGGCGCACCTATCAGCAGATGCGCAAGCCGATTGACTTCACTCCGGTGATCGCAGCGCTAGAGCCAGTGAACATTCGGGTGATGCCCAACCTGGACGAGTCTGCTGATATTCTCTCGACCAAGGTTCACTGGCCCACATTGGTTCAGGCATTGCATGTGAAGAACTGGGCCAACCAGTACTACGGTGCCCCGATCATCAAGCTCACACTCAGGACATACGGGGTGGGTGTTGTTCAGTACGCATTCTTGTGTACACTGCGCACCGACCTTCCCGGCGCGGACGTGGCGCAGAGAGCTGTTGAAGGATACGGTGCAACCGAACCCTCGCAGGGCATTGCGTTTGTCCGAAAGCTTGGAGCTGGGTTTGCAACAGTCTCCGCGGGGGCGCCACCCGAGACCGCAATAAGCGGTCGCGAGCTTGCGTACATCTCGTACGAGGCCGCTACCCAGTCGCTTGTGTTCACCTGGCGTACCGTTAACTCGGGAGACTCGACAGCAAAGAACATGAAGAAGAACTTCCTCATGACGTTCTCGCTGTTCTGA
Genome Context
Genome Context
Tertiary structure
PDB ID
1a650ee0b30e4a0de1343f66d204eef3ae8873989690f78c83af12ee045197b9
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50