有没有办法RDD在spark中连接两个不同s的数据集?
RDD
要求是 - 我使用具有相同列名的scala创建两个中间RDD,需要组合这两个RDD的结果并缓存访问UI的结果.如何在此处组合数据集?
RDD属于类型 spark.sql.SchemaRDD
spark.sql.SchemaRDD
scala distributed-computing apache-spark rdd apache-spark-sql
apache-spark ×1
apache-spark-sql ×1
distributed-computing ×1
rdd ×1
scala ×1