deleteing data part-1
This commit is contained in:
parent
5336e607e2
commit
9706197655
|
@ -137,4 +137,5 @@ Coordinator将旧的输入段标记为未使用需要一段时间,因此您可
|
|||
|
||||
### 进一步阅读
|
||||
[任务文档]()
|
||||
|
||||
[段优化]()
|
|
@ -1,3 +1,76 @@
|
|||
<!-- toc -->
|
||||
|
||||
## 数据删除
|
||||
## 数据删除
|
||||
|
||||
本教程演示如何删除数据
|
||||
|
||||
本教程我们假设您已经按照[单服务器部署](../GettingStarted/chapter-3.md)中描述下载了Druid,并运行在本地机器上。
|
||||
|
||||
### 加载初始数据
|
||||
在本教程中,我们将使用Wikipedia编辑数据,并使用创建每小时段的索引说明
|
||||
|
||||
这份说明位于 `quickstart/tutorial/deletion-index.json`, 它将创建一个名称为 `deletion-tutorial` 的数据源
|
||||
|
||||
现在加载这份初始数据:
|
||||
```
|
||||
bin/post-index-task --file quickstart/tutorial/deletion-index.json --url http://localhost:8081
|
||||
```
|
||||
当加载完成后,在浏览器中访问[http://localhost:8888/unified-console.html#datasources](http://localhost:8888/unified-console.html#datasources)
|
||||
|
||||
### 如何永久删除数据
|
||||
|
||||
永久删除一个段需要两步:
|
||||
1. 段必须首先标记为"未使用"。当用户通过Coordinator API手动禁用段时,就会发生这种情况
|
||||
2. 在段被标记为"未使用"之后,一个Kill任务将从Druid的元数据存储和深层存储中删除任何“未使用”的段
|
||||
|
||||
现在让我们通过使用Coordinator API按时间间隔和段id删除一些段。
|
||||
|
||||
### 通过时间间隔禁用段
|
||||
|
||||
让我们在指定的时间间隔内禁用段。这会将间隔中的所有段标记为"未使用",但不会将它们从深层存储中移除。让我们禁用间隔 `2015-09-12T18:00:00.000Z/2015-09-12T20:00:00.000Z`中的段,即在18到20小时之间
|
||||
|
||||
```
|
||||
curl -X 'POST' -H 'Content-Type:application/json' -d '{ "interval" : "2015-09-12T18:00:00.000Z/2015-09-12T20:00:00.000Z" }' http://localhost:8081/druid/coordinator/v1/datasources/deletion-tutorial/markUnused
|
||||
```
|
||||
|
||||
该命令完成后,您应该看到第18和19小时的段已被禁用:
|
||||
![](img-9/tutorial-deletion-02.png)
|
||||
|
||||
请注意,第18小时和第19小时的数据段仍在深层存储中:
|
||||
|
||||
```
|
||||
$ ls -l1 var/druid/segments/deletion-tutorial/
|
||||
2015-09-12T00:00:00.000Z_2015-09-12T01:00:00.000Z
|
||||
2015-09-12T01:00:00.000Z_2015-09-12T02:00:00.000Z
|
||||
2015-09-12T02:00:00.000Z_2015-09-12T03:00:00.000Z
|
||||
2015-09-12T03:00:00.000Z_2015-09-12T04:00:00.000Z
|
||||
2015-09-12T04:00:00.000Z_2015-09-12T05:00:00.000Z
|
||||
2015-09-12T05:00:00.000Z_2015-09-12T06:00:00.000Z
|
||||
2015-09-12T06:00:00.000Z_2015-09-12T07:00:00.000Z
|
||||
2015-09-12T07:00:00.000Z_2015-09-12T08:00:00.000Z
|
||||
2015-09-12T08:00:00.000Z_2015-09-12T09:00:00.000Z
|
||||
2015-09-12T09:00:00.000Z_2015-09-12T10:00:00.000Z
|
||||
2015-09-12T10:00:00.000Z_2015-09-12T11:00:00.000Z
|
||||
2015-09-12T11:00:00.000Z_2015-09-12T12:00:00.000Z
|
||||
2015-09-12T12:00:00.000Z_2015-09-12T13:00:00.000Z
|
||||
2015-09-12T13:00:00.000Z_2015-09-12T14:00:00.000Z
|
||||
2015-09-12T14:00:00.000Z_2015-09-12T15:00:00.000Z
|
||||
2015-09-12T15:00:00.000Z_2015-09-12T16:00:00.000Z
|
||||
2015-09-12T16:00:00.000Z_2015-09-12T17:00:00.000Z
|
||||
2015-09-12T17:00:00.000Z_2015-09-12T18:00:00.000Z
|
||||
2015-09-12T18:00:00.000Z_2015-09-12T19:00:00.000Z
|
||||
2015-09-12T19:00:00.000Z_2015-09-12T20:00:00.000Z
|
||||
2015-09-12T20:00:00.000Z_2015-09-12T21:00:00.000Z
|
||||
2015-09-12T21:00:00.000Z_2015-09-12T22:00:00.000Z
|
||||
2015-09-12T22:00:00.000Z_2015-09-12T23:00:00.000Z
|
||||
2015-09-12T23:00:00.000Z_2015-09-13T00:00:00.000Z
|
||||
```
|
||||
|
||||
### 通过段ID禁用段
|
||||
|
||||
让我们按段id禁用一些段。这将再次将段标记为“未使用”,但不会将它们从深层存储中移除。您可以从UI中看到完整的段id,如下所述。
|
||||
|
||||
在"Segments"视图中,单击左侧的箭头以展开段条目:
|
||||
![](img-9/tutorial-deletion-01.png)
|
||||
|
||||
### 运行Kill任务
|
Binary file not shown.
After Width: | Height: | Size: 43 KiB |
Binary file not shown.
After Width: | Height: | Size: 429 KiB |
Loading…
Reference in New Issue