Protein
View in Explore- Genbank accession
- UGO49431.1 [GenBank]
- Protein name
- tail protein
- RBP type
-
TF
- Protein sequence
-
MRTPSGILHVVDFKTDQIVAAIQPEDYWDDKRHWELKNNVDMLDFTAFDGTDHAVTLQQQNLVLKEVRDGRIVPYVITETEKNSDKRSITTYASGAWIQIAKSGIIKPQRIESKTVNEFIDLALLGMKWQRGITEYAGFHTMTIDEYMDPLTFLKKIASLFKLEIRYRVEIKGSRIIGWYVDMIQKRGHDTGKEIELGKDLVGVTRIEHTRNICTALVGFVKGEGDKVITIESINKGLPYIVDADAFQRWNEHGRHKFGFYTPETEELDMTPKRLLTLMEIELKKRVNSSISYEVGAQSIGRIFGLEHELINEGDTIKIKDTGFTPELYLEARVIAGDESFTDPTQDKYEFGDYREIVNQNEELRKIYNRILSSLGNKQEMIDQLDKLVQEANETASNAKKESEAAKTLAEKVQEDIKNNTVEIIESKNPPTTGLKPNKTLWRDISNGKPGVLKIWTGTAWESVVPDVESVKKETLEQVNKDIETTKIELNQKVQEAQNQATGQFNEVKEGLQGVSRTISNIENKQGEIDKKVTKFEQDSSGFKTSIESLTKKDTEISSKLNTVEQTVEGTKKTISEVQQTTNELTKTTTEIKEEAGKISTKLEQVEARTVGGENWLINTGRNQRPQTIGMSGGAQVNKAGQSFNEDYMIVECTDHTDSFYQFHLDNTKMGDYEKGKDMTFSIDLQNDVSIDLIVFQFINGVWTENLYSRFPVANWSRRSFTFKIDSRATGWGLRLRFERNENSKGKKFRFKKAKLEKGSIPTDFSKSTYELEQSVDGVKTTVSKVQDSQVGFEKRMTTVEQTASGLSSTVSNLNNVVSDQGKKLTEANTKLEQQATAIGAKVELKQVEDYVAGFKIPELKQTVNQNKQDLLNELANKLATEQFNQKMTLIDNRFTINEQGINAAAKKTEVYTRTQADGQFATDSYVRNMESRLQLTEKGVSISVKENDVIAAINMSKENIKLNAARIDLVGKVNAEWIKAGLLSGCQIRTSNTDNYVSLDDQFIRLYERGVARAFLGHYRRSDGAVQPTFILGSDEKTNAPEGTLFMSQAGAGWSGAYASIGISNGIVDGAVQKSVYWELQRNGLSVLNANDYHVFYAGNGSWYFRRGKPGLYQTSLVVEDNSTDSDLRLPNVTIRNSRAAGYTGVIQLKSPVTQNGWGAVQGNFMSPSLREYKSNIRDVSFSALEKIRNVRVRQFNYKNAVNELYKMREEKDSNDPPLTTEDIKTYYGVIVDECDEAFIDESGKGIHLYSYSSLTIKALQEVDTTVQEQEVEISNLKSQVASQENRIAQLEELLQQLIDKKPEQP
- Physico‐chemical
properties -
protein length: 1307 AA molecular weight: 147519,98440 Da isoelectric point: 5,57843 aromaticity: 0,07881 hydropathy: -0,59763
Domains
Domains [InterPro]
DC_1956
STR
1–678
STR
1–678
IPR007119
Unmapped
29–352
Unmapped
29–352
Coil
Unmapped
375–416
Unmapped
375–416
Coil
Unmapped
473–507
Unmapped
473–507
G3DSA:1.20.5.2280
RBD
484–554
RBD
484–554
1
1307
Architecture
STR 1-678 | RBD 752-1307
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Bacillus Phage vB_BanS_McSteamy [NCBI] |
2894779 | Uroviricota > Caudoviricetes > Wbetavirus > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
UGO49431.1
[NCBI]
Genbank nucleotide accession
OK499979
[NCBI]
CDS location
range 13363 -> 17286
strand +
strand +
CDS
ATGAGAACCCCAAGTGGAATTTTGCATGTTGTGGATTTTAAAACGGATCAAATCGTCGCAGCTATCCAGCCAGAGGACTATTGGGATGACAAACGGCATTGGGAACTTAAAAATAATGTTGACATGTTGGATTTCACCGCTTTTGATGGAACAGACCATGCAGTTACGTTACAACAACAGAATCTTGTTTTAAAAGAAGTTCGTGATGGAAGAATCGTACCATATGTTATTACAGAGACTGAAAAAAATTCCGATAAACGATCTATTACCACATATGCTTCAGGAGCTTGGATTCAAATTGCTAAATCAGGGATTATAAAACCACAGCGGATAGAGAGTAAGACGGTTAATGAGTTTATTGATTTAGCACTTTTAGGTATGAAGTGGCAACGTGGAATTACTGAATATGCTGGATTTCATACAATGACCATCGATGAATATATGGACCCACTCACTTTTTTAAAGAAGATTGCATCTTTATTTAAACTAGAAATTCGATATCGTGTTGAGATCAAAGGTTCAAGAATCATCGGTTGGTATGTAGATATGATTCAAAAGCGTGGGCATGATACAGGCAAAGAAATAGAATTAGGAAAAGATTTAGTCGGTGTTACGCGTATTGAACATACACGTAATATTTGCACTGCTTTAGTTGGATTTGTAAAAGGTGAAGGTGACAAAGTAATCACAATTGAAAGTATTAATAAAGGTCTACCCTATATCGTAGATGCAGATGCGTTTCAAAGATGGAATGAACACGGACGACATAAATTCGGTTTTTATACACCAGAAACAGAAGAACTAGACATGACTCCAAAACGTTTACTGACGCTTATGGAAATAGAATTGAAAAAGCGTGTCAATTCCTCAATCTCTTATGAAGTGGGAGCACAATCGATTGGTCGTATTTTTGGCCTAGAACACGAATTAATTAACGAAGGCGACACGATCAAAATTAAAGATACAGGGTTTACACCAGAATTATATCTTGAAGCGCGAGTAATAGCTGGAGATGAATCTTTTACAGACCCAACGCAAGATAAATATGAATTCGGAGATTATCGTGAGATTGTTAATCAAAATGAGGAATTAAGAAAAATTTACAATCGTATTCTTAGTTCGCTAGGCAATAAACAAGAAATGATAGATCAGCTAGATAAACTGGTTCAAGAAGCTAACGAAACAGCTAGTAATGCAAAGAAGGAGTCAGAAGCAGCAAAAACACTAGCTGAAAAAGTACAAGAGGATATTAAAAATAATACCGTTGAAATTATAGAATCGAAAAATCCACCAACAACAGGACTTAAACCTAATAAAACGCTTTGGCGCGATATTAGTAACGGAAAGCCCGGCGTTTTAAAAATATGGACAGGTACAGCTTGGGAATCGGTTGTACCAGATGTTGAATCCGTTAAGAAAGAAACACTTGAGCAGGTTAATAAAGATATCGAAACCACAAAAATAGAGTTAAATCAAAAGGTTCAAGAAGCACAGAATCAGGCGACAGGACAATTTAACGAAGTAAAGGAAGGTTTGCAGGGTGTTAGCCGTACAATTTCTAATATCGAAAATAAACAAGGTGAAATTGATAAGAAAGTAACTAAGTTTGAACAAGATTCAAGTGGATTTAAAACCTCTATTGAATCGTTAACGAAAAAAGATACTGAAATAAGCAGTAAATTAAATACAGTAGAGCAAACTGTGGAAGGTACAAAAAAGACAATATCCGAAGTACAGCAAACAACAAATGAATTAACTAAAACAACAACTGAAATTAAAGAAGAAGCTGGGAAGATTTCAACAAAGTTAGAACAGGTTGAAGCTCGTACTGTAGGCGGTGAAAACTGGCTAATTAATACTGGACGAAATCAAAGGCCACAAACAATTGGGATGTCTGGAGGCGCACAAGTCAATAAGGCTGGTCAATCGTTCAATGAGGATTACATGATTGTAGAGTGTACAGATCATACCGACTCTTTCTATCAATTCCATTTAGATAATACTAAGATGGGTGACTATGAAAAAGGGAAAGATATGACATTCAGTATTGATTTGCAAAACGATGTTTCGATTGATCTAATTGTATTCCAGTTTATTAATGGAGTATGGACAGAAAACTTGTACAGTAGATTCCCAGTCGCTAATTGGTCCAGAAGATCATTTACATTTAAGATTGATTCGCGTGCAACCGGATGGGGATTGCGATTAAGATTTGAAAGAAATGAAAATTCAAAGGGTAAGAAATTCCGTTTTAAGAAAGCTAAACTAGAAAAAGGTTCTATTCCAACAGACTTCAGCAAGTCAACATATGAGCTGGAGCAAAGTGTGGACGGTGTAAAAACTACTGTATCTAAGGTGCAGGATAGTCAGGTTGGATTCGAAAAGCGCATGACTACAGTTGAACAAACAGCAAGCGGATTGTCCTCCACAGTTAGTAATTTAAACAATGTAGTATCAGATCAAGGAAAGAAACTTACTGAAGCTAATACAAAACTTGAACAGCAAGCAACGGCAATCGGAGCAAAAGTTGAACTTAAACAAGTAGAGGATTATGTTGCTGGTTTTAAGATTCCAGAGCTGAAGCAAACGGTTAATCAGAATAAACAAGATTTACTAAATGAATTAGCCAACAAGCTTGCGACTGAACAATTTAATCAGAAGATGACTTTAATCGATAACCGCTTTACTATTAACGAACAGGGAATCAATGCAGCAGCAAAAAAGACAGAAGTATATACGAGAACGCAAGCAGATGGACAATTTGCTACAGATTCTTATGTAAGAAATATGGAGTCGCGCCTTCAGTTAACAGAAAAGGGTGTTAGCATATCTGTAAAAGAAAATGATGTAATAGCAGCCATTAACATGAGTAAAGAAAACATTAAGTTAAATGCTGCACGAATAGACTTAGTTGGTAAAGTGAATGCTGAGTGGATTAAAGCTGGATTGCTGAGCGGTTGCCAAATTAGAACATCAAATACGGATAACTACGTTAGTTTAGATGACCAATTCATACGTCTCTATGAAAGAGGAGTTGCTAGAGCGTTTCTGGGGCATTACAGAAGATCAGATGGTGCAGTACAACCGACTTTCATCTTAGGTTCAGATGAAAAGACTAACGCTCCAGAAGGTACTTTGTTTATGTCTCAAGCAGGTGCAGGATGGTCAGGGGCTTATGCGAGCATTGGTATTAGCAATGGCATAGTGGATGGTGCGGTCCAAAAGTCTGTGTATTGGGAGTTGCAAAGAAACGGACTAAGTGTTCTAAACGCTAATGATTACCATGTGTTTTACGCTGGAAATGGAAGTTGGTATTTCAGAAGAGGGAAACCAGGGTTGTATCAAACTTCGTTAGTCGTTGAAGATAATAGTACAGATTCTGATTTAAGATTACCTAATGTAACTATACGTAATAGCCGTGCAGCAGGATATACAGGAGTTATTCAATTGAAATCTCCTGTTACTCAAAATGGCTGGGGTGCTGTTCAAGGGAATTTTATGAGTCCTTCATTACGAGAATATAAATCTAACATTCGTGATGTTTCTTTTTCTGCCTTAGAAAAAATCAGGAATGTACGAGTGAGACAATTCAACTATAAGAATGCAGTAAACGAACTTTACAAAATGAGAGAAGAAAAAGATTCTAATGATCCTCCGTTGACAACAGAAGATATTAAAACATACTACGGGGTAATTGTAGATGAATGTGATGAAGCGTTTATCGATGAAAGTGGTAAAGGAATTCACTTATACTCATATTCGTCACTTACAATCAAAGCTTTACAGGAAGTTGATACAACGGTACAGGAGCAGGAAGTAGAAATATCAAACCTAAAATCACAAGTAGCTAGTCAAGAAAATCGGATAGCCCAATTAGAAGAGTTATTACAACAATTAATTGATAAGAAACCAGAGCAGCCATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
50b0b03fc915306fc03f903ea35d07ab0e8ab1f0738edbd956ba25efa2fed63d
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50