modify hudi.doc
This commit is contained in:
parent
baeb788c21
commit
9d07ffb63a
|
|
@ -4,7 +4,7 @@
|
|||
|
||||
Apache Hudi是一个快速迭代的数据湖存储系统,可以帮助企业构建和管理PB级数据湖。它提供在DFS上存储超大规模数据集,同时使得流式处理如果批处理一样,该实现主要是通过如下两个原语实现。
|
||||
|
||||
- **Update/Delete记录**: Hudi支持更新/删除记录,使用文件/记录级别索引,同时对写操作提供事务保证。查询可获取最新提交的快照来产生结果。
|
||||
- **Update/Delete记录**: Hudi支持更新/删除记录,使用文件/记录级别索引,同时对写操作提供事务保证。查询可获取最新提交的快照来产生结果。(在文件中随机存取记录,记录的地址即为文件/记录索引)
|
||||
- **Change Streams**: Hudi也支持增量获取表中所有更新/插入/删除的记录,从指定时间点开始进行增量查询。
|
||||
|
||||
### 支持的表格类型和查询类型
|
||||
|
|
|
|||
Loading…
Reference in New Issue