我在蜂巢工作,我是新手.我正面临一些关于hive查询性能的问题.
分配给我的工作的映射器数量非常低,即使有数百个映射器可用.我试过设置 mapred.map.tasks=200.但它只需要20到30个映射器.据我所知,映射器的数量取决于inputsplit.有没有其他选项来增加映射器?如果没有那么为什么mapred.map.tasks引入参数()?
mapred.map.tasks=200
mapred.map.tasks
是否有任何资源我可以理解将hive查询与map-reduce作业相关联,即查询的不同部分在哪里执行?
hadoop hive
hadoop ×1
hive ×1