diff --git a/hetu-docs/zh/connector/Hudi.md b/hetu-docs/zh/connector/Hudi.md index 29e73d4ca..87d8b246f 100644 --- a/hetu-docs/zh/connector/Hudi.md +++ b/hetu-docs/zh/connector/Hudi.md @@ -4,7 +4,7 @@ Apache Hudi是一个快速迭代的数据湖存储系统,可以帮助企业构建和管理PB级数据湖。它提供在DFS上存储超大规模数据集,同时使得流式处理如果批处理一样,该实现主要是通过如下两个原语实现。 -- **Update/Delete记录**: Hudi支持更新/删除记录,使用文件/记录级别索引,同时对写操作提供事务保证。查询可获取最新提交的快照来产生结果。 +- **Update/Delete记录**: Hudi支持更新/删除记录,使用文件/记录级别索引,同时对写操作提供事务保证。查询可获取最新提交的快照来产生结果。(在文件中随机存取记录,记录的地址即为文件/记录索引) - **Change Streams**: Hudi也支持增量获取表中所有更新/插入/删除的记录,从指定时间点开始进行增量查询。 ### 支持的表格类型和查询类型