Hive调优
2020/1/21小于 1 分钟
Hive调优
Hive调优是大数据领域的核心技术,它为海量数据的存储和处理提供了强大的支持。
本文介绍了Hive调优的原理和应用场景,帮助你进入大数据领域。
查看逻辑,更多用 EXPLAIN EXTENDED
二、限制调整LIMIT
三、JOIN优化
表足够小用map-side JOIN
四、本地模式
对于小数据集,单机或单线程执行时间比较短
hive> set oldjobtracker=${hiveconf.mapred.job.tracker};
hive> set mapred.job.tracker=local;
hive> set mapred.tmp.dir=/home/edward/tmp
hive> SELECT * from people WHERE firstname=bob;
hive> set mapred.job.tracker=${oldjobtracker};五、并行执行
hive.exec.parallell=true
六、严格模式
hive.mapred.mode=strict
(1)必须有WHERE
(2)对于ORDER BY 的语句必须有LIMIT
(3)限制笛卡尔基的查询