Apache Hudi重磅特性解读之全局索引

1. 摘要 Hudi表允许多种类型操作,包括非常常用的upsert,当然为支持upsert,Hudi依赖索引机制来定位记录在哪些文件中。 当前,Hudi支持分区和非分区的数据集。分区数据集是将一组文件(数据)放在称为分区的桶中的数据集。一个Hudi数据集可能由N个分区和M个文件组成,这种组织结构也非
posted @ 2020-07-06 18:42  leesf  阅读(2751)  评论(0编辑  收藏  举报