首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >集群在BigQuery中的工作原理

集群在BigQuery中的工作原理
EN

Stack Overflow用户
提问于 2019-09-17 11:22:45
回答 1查看 835关注 0票数 0

我有一个表UNITARCHIVE,按日期分区,并按单元、DUID进行集群。

表892 Mb的总大小。

当我尝试此查询时

代码语言:javascript
复制
SELECT * FROM `test-187010.ReportingDataset.UNITARCHIVE` WHERE duid="RRSF1" and unit="DUNIT"

Bigquery告诉我,它将处理892MB,我认为集群应该减少扫描的大小,我理解当我过滤每个日期时,大小大大减少,但我需要整个日期范围。是故意的,还是我做错了什么?

EN

回答 1

Stack Overflow用户

回答已采纳

发布于 2019-09-17 11:29:25

为了从集群中获得最大的好处,每个分区都需要有一定数量的数据。

例如,如果集群的最小大小是100MB (由BigQuery内部决定),而您每天只有100MB的数据,那么查询100天将扫描100*100MB -与集群策略无关。

作为这种数据量的替代方案,不是按天分区,而是按年分区。然后,您将以每天较少的数据量从集群中获得最大的好处。

请参阅Partition by week/year/month to get over the partition limit?以获取显示这一点的参考表。

票数 0
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/57966914

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档