ben*_*man 5 apache-spark spark-streaming
所以我正在kafka流中的同一个rdd上执行多个操作.是否缓存RDD会提高性能?
ban*_*ara 1
\n Spark 还支持将数据集拉入集群范围的内存缓存中。当重复访问数据时,例如查询小型 \xe2\x80\x9chot\xe2\x80\x9d 数据集或运行迭代算法(如 PageRank)时,这非常有用。\n
Spark 还支持将数据集拉入集群范围的内存缓存中。当重复访问数据时,例如查询小型 \xe2\x80\x9chot\xe2\x80\x9d 数据集或运行迭代算法(如 PageRank)时,这非常有用。
https://spark.apache.org/docs/latest/quick-start.html#caching
归档时间:
11 年,3 月 前
查看次数:
3044 次
最近记录: