Protein
View in Explore- Genbank accession
- QVD49316.1 [GenBank]
- Protein name
- hypothetical protein
- RBP type
-
TSPTF
- Protein sequence
-
MPHVHELPSVSPQTVADLRNVTGIVLLEQTVQQVQTDLGEAQDLAQAASTAASTATTTANTAKTTADTAKTTADTAAGNASTALQAANVAVAAAAEASTAVEEAQDQIDTAVADAATAKTLATSANTAASAADTKATNAGTAASNAQTTATAAQTAAGNAQTAANTAQAKADAADTKANNLRTDLDSLTDTVQAIQDQIGGVNQVPVATPITIDVDEDTVNYQGSVFDHVVDPDGDDMVVVESTYNSTKFNAGTQFNTVYGTMLVAVNGNYTFTPNATAQALNDGETGTVAFAILVRDARGGTATWNLTIRVIGSTDEAGGGDDDNTTFDALYDPSFKLIENQNFYSRPTMSKPSKMTSYTQPSYTDPVFGTKIFGLTRVNDTSDNITNLRHVYSRQTAINADNTRSIVRAGNGWWHLYNLQTGQRILGGRTQTPGFGALVDFINECECVWHPTNPKKLWRTGNQGAGCIWYEYDIDTMTTTVLFDLNPLLQALGGAWANAGRAWFKGEGRPSNDGRWWGFQVETASYGMIGLIMYDRQTNTIVGSALTTNRPDHVSTSPLGNYIVPSWYGGTTETLASSATRPMNEANGARAYSRDFSSFTQLSSLGEHSDLAIDAQGNEVFVSVSYRGGTSGQEPDVADGGIYYRRMDNGVAYSLPGNAYQDSSDGGVHLSGLATKKPGWAVVSWYGGTPKTWKDGVVYAVELTPDNPKTLRICHHQTVAQGAEAYIAESHAVPSPDMSMILFASNYGGSVVEDYYVGLPSWAFGVAGAGRPPVNQTLPAVSGQVTPNAVLTCTAGMWSGVGITYSYQWYRDSGTIISGQTTNSFTIPSGAAAGTQYYCRVTATNATDTVYAESNKITVQVPSAPVNTAKPTITGGSAVGSLLTAQPGTWSGLPTPDFTYAWYRNGTALGVTTRTYTANDLGDYTVQVRAENTQGFATEMSTVKTIVAAADPKAAVGSPVNTTNTWQSSGSIAVPSVAVGDSILLVVSLDEGSGDGNLNSITATVLGKPLNLLYSTPLITLSSGRMVRQHYYVADKVTAAGTATINVTFEANTHYAMQAQRFTGGIATVDVTAPGGFNATAFATPHPTGTVSATIANSVEVISLVGATDMSNAALTLPSGFTSMGADNVGPLVAITGYRVRTTIGNIGGTITSMNGGYGSGWAASALNLY
- Physico‐chemical
properties -
protein length: 1172 AA molecular weight: 122558,75480 Da isoelectric point: 4,74273 aromaticity: 0,08020 hydropathy: -0,16852
Domains
Domains [InterPro]
PTHR47372
Unmapped
31–180
Unmapped
31–180
DC_1672
STR
90–417
STR
90–417
Coil
Unmapped
94–114
Unmapped
94–114
G3DSA:2.60.40.2700
RBD
775–858
RBD
775–858
DC_1007
ATT
852–976
ATT
852–976
1
1172
Architecture
STR 90-417 | STR 774-851 | ATT 852-976 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1172
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 393 | 393 | 0,7249 |
| Central domain | 394 | 608 | 216 | 0,8208 |
| C-terminal | 609 | 1172 | 563 | 0,4849 |
Note: Constraints were applied during segmentation.
Fixed 36 C-terminal predictions appearing before Central domain
Fixed 36 C-terminal predictions appearing before Central domain
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-393
1-393
Central
394-608
394-608
C-terminal
609-1172
609-1172
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Xanthomonas phage vB_XciM_LucasX [NCBI] |
2829408 | Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QVD49316.1
[NCBI]
Genbank nucleotide accession
MW825358
[NCBI]
CDS location
range 213340 -> 216858
strand +
strand +
CDS
ATGCCACACGTACACGAGCTACCGTCTGTTTCACCCCAGACCGTAGCCGATTTGCGCAATGTCACAGGGATTGTGCTGCTGGAGCAAACCGTACAGCAAGTACAAACGGATTTGGGTGAAGCCCAGGATCTGGCCCAAGCAGCATCAACTGCTGCCTCTACGGCCACCACTACGGCTAACACCGCCAAGACCACGGCCGATACGGCCAAGACCACCGCTGATACCGCAGCCGGCAATGCCAGTACTGCTTTACAAGCTGCCAACGTAGCGGTTGCCGCAGCTGCTGAGGCCAGCACTGCGGTGGAGGAGGCTCAAGATCAGATCGATACTGCTGTGGCCGATGCAGCAACAGCTAAGACCTTGGCGACCTCAGCCAATACGGCGGCCAGCGCTGCTGACACCAAAGCCACCAATGCAGGCACAGCTGCCAGTAATGCGCAGACCACAGCCACTGCAGCGCAGACCGCAGCAGGTAACGCACAGACGGCGGCCAACACTGCTCAAGCAAAGGCCGATGCTGCCGATACCAAGGCCAATAACCTGCGTACCGATTTGGATTCTCTGACCGATACGGTCCAGGCGATCCAAGATCAGATCGGTGGTGTCAACCAAGTCCCGGTGGCCACACCCATCACCATTGATGTGGATGAGGACACAGTCAACTACCAAGGTAGCGTGTTCGACCACGTAGTGGACCCTGACGGTGATGACATGGTGGTGGTGGAATCCACCTACAACAGCACCAAGTTCAATGCCGGCACCCAGTTCAATACTGTCTACGGCACGATGCTGGTGGCAGTCAACGGTAACTACACTTTCACCCCCAACGCCACCGCGCAAGCTTTGAATGACGGAGAGACCGGTACGGTTGCCTTTGCCATTCTCGTGCGTGATGCCCGCGGTGGTACGGCGACGTGGAACCTCACCATTCGTGTGATCGGTTCAACGGATGAGGCCGGCGGTGGAGATGATGATAACACCACCTTTGATGCCCTGTATGACCCCAGCTTCAAACTGATTGAAAATCAGAACTTCTACTCGCGCCCGACAATGTCCAAGCCGAGTAAGATGACCAGCTACACACAGCCGAGCTATACCGATCCGGTGTTTGGAACCAAGATCTTTGGTCTGACCCGCGTCAATGATACCTCGGACAATATCACCAACTTGCGCCACGTCTATTCGCGTCAAACGGCGATCAATGCCGATAACACGCGCTCGATCGTGCGTGCCGGTAACGGTTGGTGGCATTTGTATAACCTGCAAACCGGTCAGCGTATTTTGGGTGGACGTACCCAAACGCCAGGCTTTGGTGCGCTGGTGGATTTCATCAACGAATGCGAATGCGTCTGGCATCCGACCAACCCCAAGAAGCTGTGGCGTACCGGTAACCAAGGTGCGGGGTGCATCTGGTATGAATACGACATCGATACGATGACCACCACGGTCCTGTTTGACCTCAACCCGCTGCTGCAAGCGCTGGGTGGGGCTTGGGCCAATGCTGGGCGTGCCTGGTTCAAGGGCGAAGGTCGTCCTTCGAACGATGGTCGCTGGTGGGGCTTCCAGGTGGAAACGGCCAGCTATGGAATGATCGGCTTGATCATGTACGATCGCCAGACCAACACCATCGTCGGCAGTGCACTGACCACCAACCGTCCCGACCACGTTTCAACCTCACCGCTGGGTAACTATATCGTGCCATCTTGGTACGGTGGTACGACCGAAACGCTGGCGTCCTCGGCCACCCGTCCGATGAATGAAGCCAACGGTGCACGTGCTTACTCGCGTGACTTCTCTTCCTTTACGCAGCTGTCCTCGTTGGGTGAGCACTCAGACTTGGCCATCGATGCGCAAGGTAATGAAGTGTTTGTCTCGGTGTCCTACCGTGGCGGCACCTCAGGTCAAGAACCTGACGTGGCTGACGGTGGCATCTACTATCGCCGGATGGATAACGGTGTGGCCTACTCGCTGCCGGGTAATGCCTACCAAGACTCCTCTGACGGTGGTGTGCACTTGTCAGGCCTTGCCACCAAGAAGCCTGGTTGGGCGGTGGTATCCTGGTATGGCGGTACGCCTAAGACGTGGAAGGACGGTGTGGTCTATGCGGTGGAGCTGACCCCGGATAACCCCAAGACCTTACGTATCTGTCACCACCAGACGGTGGCCCAAGGTGCTGAGGCGTATATCGCCGAATCCCACGCAGTGCCCTCGCCTGATATGTCCATGATCCTGTTTGCCTCCAACTATGGTGGCAGCGTGGTGGAAGACTACTACGTGGGTCTGCCTTCGTGGGCCTTTGGTGTGGCAGGCGCAGGTCGCCCGCCGGTAAACCAAACCCTGCCGGCAGTCTCAGGACAAGTCACCCCCAATGCGGTGTTGACCTGTACGGCGGGCATGTGGTCCGGTGTGGGGATTACCTACAGCTACCAATGGTACCGTGACTCTGGTACGATCATCAGTGGTCAGACCACCAACAGCTTCACCATCCCTTCAGGGGCAGCGGCAGGTACGCAGTACTACTGCCGTGTGACAGCCACCAATGCCACCGATACGGTTTACGCTGAGTCCAACAAGATCACCGTGCAGGTTCCTTCTGCGCCGGTCAACACGGCCAAGCCCACCATCACCGGTGGTTCGGCAGTGGGTAGCTTGCTCACAGCGCAGCCGGGTACGTGGTCGGGTCTGCCGACGCCGGACTTTACCTATGCTTGGTATCGTAACGGGACAGCGCTGGGTGTCACCACGCGCACCTATACGGCCAATGATCTGGGTGACTACACGGTCCAAGTCCGGGCCGAGAACACCCAAGGTTTTGCAACGGAGATGTCCACGGTCAAGACGATCGTGGCCGCCGCAGATCCCAAGGCTGCGGTGGGTTCGCCGGTGAACACCACTAATACATGGCAGTCCTCCGGCAGTATTGCCGTACCGTCAGTGGCAGTGGGTGATTCGATTCTGTTGGTGGTGAGCCTGGATGAGGGCAGTGGTGATGGTAACTTGAACTCGATCACGGCCACCGTGCTCGGCAAGCCCTTGAACCTGCTCTACTCCACTCCGTTGATCACTCTGTCCTCTGGTCGTATGGTGCGTCAGCACTACTACGTGGCAGATAAGGTGACCGCGGCCGGTACAGCCACGATCAATGTGACCTTTGAGGCCAACACGCATTACGCTATGCAGGCCCAGCGCTTCACCGGTGGTATTGCCACGGTGGATGTCACAGCGCCGGGTGGCTTTAATGCCACAGCGTTTGCCACACCACATCCGACCGGTACGGTCAGTGCGACCATCGCCAACTCCGTTGAGGTCATCAGCTTGGTCGGCGCCACGGACATGTCCAATGCGGCATTGACTTTGCCCTCTGGCTTTACCTCGATGGGTGCAGACAACGTGGGTCCGTTGGTGGCGATCACTGGCTATCGCGTGCGCACCACAATCGGCAACATCGGCGGTACGATTACCTCGATGAATGGCGGTTATGGTTCGGGCTGGGCAGCTTCTGCCTTGAACTTGTACTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
e166770a58f99b8bd55f77443b8d21c2384f6396a0f3da6ab9d2a4dd44dd7bdd
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50