跳到正文
#
拾穗
beta
登录
加入会员
最新
资讯
方法
观点
专题
职场认知
职业成长
商业洞察
数据工程
AI
数据分析
数据治理
求职面试
视听
播客
视频
知识库
专属
咨询
关于
#
拾穗
beta
最新
资讯
方法
观点
专题
视听
知识库
专属
咨询
关于
登录
加入会员
最新
资讯
方法
观点
专题
职场认知
职业成长
商业洞察
数据工程
AI
数据分析
数据治理
求职面试
视听
播客
视频
知识库
专属
咨询
关于
全部标签
小文件
#
小文件
共 1 篇文章
数据工程
·
方法
把数据湖换成 Iceberg 前,先找出最值得迁的 3 张表
Grab 把 Hive Parquet 迁往 Apache Iceberg 后,部分查询从约 70 秒降到 6 秒,部分 S3 API 成本最多下降约 95%。但普通数据开发不该先问要不要全湖迁移,而应从小文件、查询频率、元数据等待和人工补分区里找出最值得先动的 3 张表。
未在播放
✕
0:00
0:00
✕
喜欢这里的内容?
加入社区免费交流,或升级会员解锁全部深度内容。
免费加入社区
了解会员