Protein
View in Explore- Genbank accession
- YP_007674157.1 [GenBank]
- Protein name
- hypothetical protein
- RBP type
-
TFTFTSPTSPTSP
- Protein sequence
-
MGLKSTFSTNEGKAEACAVDKYVNTAYDNMVIISDNIEALLEISDNLEYLTVYLGSYTTDPTERPDGTPLQDGDYYFNTLINALVYYDLAETNWFTVDPQELLDARDAAQAAQAAAETAEANALVSENNAAASELNASNSEAAALASEQAAAISEANASASETAAALSETNAAASEANALASENAAKASETAAALSETNAATSETNAANSASAALTSETNAAASETSAANSAVVAGGYAADAEAAFDNFNDLYLGAKTADPTLDNDGNPLQVGATYWNSVTNDLRYWNGVSWDIPEETAIQAANTAVAARDDAQISETNAAASAAAASTSETNAATSEANALASEQAAALSETNAATSASNAATSEFNAAQSASDAAGSAASAAQSEANIDVAVTEAQNDIIGGSIFKGSNGEHVQNGDTVPSGTTHLRVEIGGEPTIVAMYPKSSGDVSSLSDDGATIGGTQVTFFKEIEKSVVYASNWIGLTTTNVTEKLIEMHKYAYENRLQVIYDGNFSLEVDLSKTSTSQGGTPIFVDSDTDFGGVTFSFKNASSVGGGDDDEFMRFDAQDLIDISGFVNISEFGYGSTYAPSLAAYEDAYIFINTTKDLVKRNPSDTEFRTYAVNNKVHRFGQLQYPVNYDCSDATGFKSAVLRPSKNAITIKGGIIDCTGVNNARLFVTARNNTTLDGIKCVRSDSPLNTSNNIFYFDRCCDITYKNMKPLGQNSSGTGTYGISGDGAVNLTLDNVSAVVGWGAMGTNYVNGLNVIGGYLSRVDVHFMGENIEVTRTQLKGLNIQVGIGGGYLKVKDVSVVLGKDPQRNIVDANRLIYIRPDYGSTWKGDIDIDGVSIRVAKEYDVVDTAFDMVQNVFSDNDTLVSPEIHYPFGMSLSAKNVSILVYPVGGFMGLELFNCGTVGPQQSRMMLPLKIEMESFKSITRNSEVPIVLSRTFSFIFDNDPQLHWAHTQSKSNYSGSDVEIFISDIDAIGTRPNGYISRDQQRNLLCFLSRSIDYDAHPNLPRFSVKGEKLSNLGFTWENQGDVDIDNSHIIGVWNNSNTTAIIKVTGSRCEVMKNPNGDNAYRRSFGICFENCIFIPSVGSLNDTLRTDNIVSASKCLVHKDVNLLTGAGMRTRQEMFDGFVDDPNGLVSLT
- Physico‐chemical
properties -
protein length: 1145 AA molecular weight: 121980,64540 Da isoelectric point: 4,36463 aromaticity: 0,08210 hydropathy: -0,22035
Domains
Domains [InterPro]
DC_1362
ATT
4–180
ATT
4–180
Coil
Unmapped
102–122
Unmapped
102–122
1
1145
Architecture
ATT 4-180 | STR 181-316 | STR 325-499 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Tail Spike Domain Segmentation
Tail Spike Domain Segmentation
This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.
Domain Layout
1
1145
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 488 | 488 | 0,9970 |
| Central domain | 489 | 1133 | 646 | 0,9703 |
| C-terminal | 1134 | 1145 | 11 | 0,6869 |
Legend:
N-terminal
Central domain
C-terminal
3D Structure with Domain Coloring
The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).
Domain Coloring
N-terminal
1-488
1-488
Central
489-1133
489-1133
C-terminal
1134-1145
1134-1145
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Vibrio phage VBP47 [NCBI] |
754073 | Uroviricota > Caudoviricetes > Schitoviridae > Stoningtonvirus > Stoningtonvirus VBP47 |
| Host |
Vibrio parahaemolyticus RIMD 2210633 [NCBI] |
223926 | Bacteria > Proteobacteria > Gammaproteobacteria > Vibrionales > Vibrionaceae > Vibrio |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
YP_007674157.1
[NCBI]
Genbank nucleotide accession
NC_020848
[NCBI]
CDS location
range 53235 -> 56672
strand -
strand -
CDS
ATGGGTTTAAAATCAACCTTTAGTACAAATGAAGGTAAGGCAGAAGCATGTGCGGTGGACAAATATGTCAACACTGCATATGACAACATGGTTATCATCTCTGACAATATTGAAGCACTGTTAGAGATCTCAGATAATCTTGAGTACCTTACTGTTTATTTAGGTTCGTACACTACGGACCCTACAGAGCGTCCTGATGGAACTCCATTACAGGATGGTGACTACTACTTTAACACACTGATCAATGCATTGGTGTACTACGACCTTGCTGAAACAAACTGGTTTACAGTAGATCCTCAGGAACTTCTCGATGCTCGTGATGCAGCTCAGGCTGCTCAGGCAGCGGCAGAGACGGCTGAAGCTAATGCTTTAGTATCTGAGAACAATGCTGCGGCATCTGAACTTAATGCTTCCAATAGTGAGGCAGCTGCACTTGCATCTGAACAAGCTGCTGCGATCTCTGAAGCTAACGCTTCAGCTAGTGAGACTGCTGCTGCACTAAGTGAAACGAATGCTGCTGCAAGTGAAGCAAATGCACTAGCCTCTGAGAACGCCGCTAAGGCCTCTGAGACAGCTGCAGCTCTGAGTGAGACCAATGCTGCCACTTCAGAGACAAACGCTGCTAACAGCGCTTCTGCGGCCCTCACAAGCGAGACTAATGCTGCTGCGTCAGAAACGTCTGCTGCTAACTCTGCTGTAGTTGCTGGAGGTTATGCTGCGGATGCCGAAGCTGCTTTTGATAACTTCAATGATTTGTACTTAGGTGCGAAGACGGCTGACCCTACTCTAGATAACGACGGTAACCCGTTACAGGTAGGTGCTACTTACTGGAACTCTGTCACTAACGATCTTCGTTACTGGAACGGCGTTTCATGGGATATCCCAGAAGAGACAGCAATCCAAGCGGCTAATACTGCGGTAGCAGCTCGTGATGATGCACAGATCTCAGAGACTAATGCGGCGGCTAGTGCTGCGGCTGCAAGTACTTCTGAAACTAACGCTGCTACTTCTGAGGCTAATGCTCTTGCTAGTGAACAGGCGGCAGCTCTTTCGGAGACGAACGCGGCTACTTCTGCATCTAATGCAGCAACCTCAGAATTCAACGCAGCTCAAAGCGCATCCGATGCAGCAGGCTCAGCAGCAAGTGCAGCGCAGTCAGAAGCAAATATTGATGTAGCTGTAACTGAAGCACAAAACGACATTATAGGCGGTTCGATATTTAAAGGGTCGAATGGTGAGCATGTACAGAACGGCGACACTGTCCCGTCGGGCACCACTCATCTTCGTGTTGAGATTGGTGGCGAGCCTACGATTGTGGCGATGTATCCTAAGTCCAGTGGCGATGTATCTTCATTATCAGATGATGGAGCCACTATTGGTGGTACTCAAGTTACATTCTTCAAGGAGATAGAGAAAAGCGTTGTTTACGCATCTAATTGGATTGGCTTGACGACAACAAACGTTACAGAAAAACTAATCGAGATGCATAAGTATGCCTACGAGAATAGATTGCAAGTAATATATGACGGGAATTTCTCACTGGAGGTTGACCTGTCAAAGACGTCTACATCTCAAGGTGGTACGCCTATTTTTGTGGACTCTGACACTGATTTTGGTGGTGTTACTTTTTCATTCAAAAATGCATCATCTGTTGGTGGTGGAGATGATGATGAGTTCATGCGGTTCGACGCCCAAGACCTGATTGATATTTCTGGATTTGTAAACATATCCGAGTTTGGTTATGGGTCTACGTATGCTCCATCATTGGCAGCGTATGAGGATGCGTATATCTTTATAAATACAACTAAAGACCTGGTAAAACGAAACCCTTCTGACACAGAATTTAGGACATACGCAGTTAACAACAAAGTCCATCGTTTCGGCCAGCTTCAATACCCCGTTAACTACGACTGCTCTGATGCTACTGGTTTCAAGTCCGCCGTACTTAGACCAAGCAAAAACGCCATAACAATCAAGGGAGGTATTATTGATTGTACTGGCGTTAACAACGCAAGGTTGTTCGTTACAGCAAGGAATAACACAACACTAGACGGAATTAAGTGCGTTAGGTCTGATTCTCCACTTAATACATCAAACAACATTTTTTACTTTGATAGATGTTGCGACATAACTTACAAGAACATGAAGCCACTAGGTCAAAATTCTAGTGGGACAGGCACTTATGGAATATCTGGTGATGGTGCGGTAAATCTAACTTTAGATAATGTTTCTGCTGTCGTCGGCTGGGGAGCCATGGGCACTAACTATGTTAACGGACTAAATGTCATTGGTGGTTATTTGAGTCGCGTGGATGTTCACTTTATGGGTGAAAATATAGAGGTAACACGAACTCAGCTTAAAGGCCTGAACATCCAAGTCGGAATTGGCGGTGGATACCTTAAAGTCAAGGATGTATCGGTTGTTCTTGGTAAAGACCCACAAAGAAATATAGTTGACGCTAACAGGCTTATATACATTCGCCCTGACTACGGAAGCACATGGAAAGGCGACATTGACATAGATGGTGTTAGTATACGTGTCGCCAAGGAATACGACGTTGTGGACACTGCTTTCGATATGGTTCAGAACGTATTCAGTGATAATGACACCCTCGTCAGTCCCGAAATTCATTACCCGTTTGGTATGTCGCTATCAGCTAAGAATGTGTCAATCCTCGTTTACCCTGTTGGTGGATTTATGGGTCTCGAATTATTTAACTGTGGAACGGTCGGGCCGCAGCAATCAAGAATGATGCTTCCACTAAAAATTGAGATGGAATCATTCAAATCAATAACCAGAAACTCAGAAGTTCCAATTGTCTTGAGTAGAACTTTTAGTTTTATATTCGACAATGACCCACAACTTCATTGGGCGCACACTCAATCAAAATCTAACTATAGCGGTTCTGATGTTGAGATTTTCATTTCTGATATAGACGCAATAGGAACAAGACCGAATGGATATATATCTAGAGACCAGCAAAGAAACCTTCTTTGTTTCTTGAGTAGAAGTATAGATTACGACGCACACCCGAACTTGCCTAGATTCTCCGTGAAAGGTGAAAAGCTCTCAAATCTAGGGTTTACATGGGAGAATCAAGGTGATGTTGACATAGACAATAGCCATATTATTGGAGTTTGGAACAACTCGAACACCACAGCCATAATCAAGGTTACTGGCAGTCGGTGCGAGGTCATGAAGAATCCAAACGGAGACAATGCGTACAGAAGGTCATTTGGTATATGCTTTGAGAATTGTATTTTCATCCCTTCTGTTGGGTCATTAAACGACACATTGCGTACTGACAATATTGTTTCTGCAAGTAAATGTCTGGTGCATAAAGATGTGAACCTGCTTACTGGCGCTGGAATGAGAACAAGACAGGAAATGTTCGATGGTTTTGTAGACGACCCAAATGGTTTGGTTTCACTAACATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
3722fa57d9c3a8fc5947375524a83881b2acfdfa97df1298cf86b27b08d346f9
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50
Literature
| Title | Authors | Date | PMID | Source |
|---|---|---|---|---|
| The Genome Sequence of Vibrio phage VBP47 | Henn,M.R., Wharam,S., Gilg,I., Martinez Martinez,J., Wilson,W., Levin,J., Malboeuf,C., Casali,M., Russ,C., Lennon,N., Chapman,S.B., Erlich,R., Young,S.K., Yandava,C., Zeng,Q., Fitzgerald,M.F., Alvarado,L., Anderson,S., Berlin,A., Chen,Z., Freedman,E., Gellesch,M., Goldberg,J., Green,L., Griggs,A., Gujja,S., Heilman,E., Heiman,D., Hollinger,A., Howarth,C., Larson,L., Mehta,T., Neiman,D., Pearson,M., Roberts,A., Ryan,E., Saif,S., Shea,T., Shenoy,N., Sisk,P., Stolte,C., Sykes,S., White,J., Haas,B., Nusbaum,C. and Birren,B. | 2011-09-23 | — | GenBank |