小编nag*_*036的帖子

重新分区(1) 和合并(1) 之间的区别

在我们的项目中,我们正在使用repartition(1)将数据写入表中,我有兴趣知道为什么coalesce(1)不能在这里使用,因为repartitioncoalesce.

我知道repartition数据在分区之间均匀分布,但是当输出文件是单部分文件时,为什么我们不能使用coalesce(1)

apache-spark apache-spark-sql

8
推荐指数
2
解决办法
1万
查看次数

标签 统计

apache-spark ×1

apache-spark-sql ×1