小编kwi*_*wng的帖子

使用Spark DataFrame获取分组后所有组的TopN

我有一个Spark SQL DataFrame:

user1 item1 rating1
user1 item2 rating2
user1 item3 rating3
user2 item1 rating4
...
Run Code Online (Sandbox Code Playgroud)

如何按用户分组,然后TopN使用Scala从每个组返回项目?

使用Python的相似代码:

df.groupby("user").apply(the_func_get_TopN)
Run Code Online (Sandbox Code Playgroud)

sql scala apache-spark apache-spark-sql

9
推荐指数
1
解决办法
5857
查看次数

标签 统计

apache-spark ×1

apache-spark-sql ×1

scala ×1

sql ×1