From 9d07ffb63a23ba681203deb64f59884dab54f852 Mon Sep 17 00:00:00 2001 From: w00515084 Date: Sat, 28 Aug 2021 12:42:26 +0800 Subject: [PATCH] modify hudi.doc --- hetu-docs/zh/connector/Hudi.md | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/hetu-docs/zh/connector/Hudi.md b/hetu-docs/zh/connector/Hudi.md index 29e73d4ca..87d8b246f 100644 --- a/hetu-docs/zh/connector/Hudi.md +++ b/hetu-docs/zh/connector/Hudi.md @@ -4,7 +4,7 @@ Apache Hudi是一个快速迭代的数据湖存储系统,可以帮助企业构建和管理PB级数据湖。它提供在DFS上存储超大规模数据集,同时使得流式处理如果批处理一样,该实现主要是通过如下两个原语实现。 -- **Update/Delete记录**: Hudi支持更新/删除记录,使用文件/记录级别索引,同时对写操作提供事务保证。查询可获取最新提交的快照来产生结果。 +- **Update/Delete记录**: Hudi支持更新/删除记录,使用文件/记录级别索引,同时对写操作提供事务保证。查询可获取最新提交的快照来产生结果。(在文件中随机存取记录,记录的地址即为文件/记录索引) - **Change Streams**: Hudi也支持增量获取表中所有更新/插入/删除的记录,从指定时间点开始进行增量查询。 ### 支持的表格类型和查询类型