小编Kan*_*ans的帖子

Dynamodb 二级索引实时更新延迟

我想知道 Amazon Dynamodb Global 二级索引是否可用于写入量非常大的实时应用程序。例如:聊天应用程序。一旦主表写入/更新完成,全局二级索引就需要在亚毫秒延迟内更新。这可能吗?

amazon-dynamodb secondary-indexes

5
推荐指数
1
解决办法
2352
查看次数

使用spark'save'时出错,目前不支持存储

我有一个DataFrame要尝试partitionBy插入的列,按该列对其进行排序,并使用以下命令以拼花格式保存:

df.write().format("parquet")
  .partitionBy("dynamic_col")
  .sortBy("dynamic_col")
  .save("test.parquet");
Run Code Online (Sandbox Code Playgroud)

我收到以下错误:

reason: User class threw exception: org.apache.spark.sql.AnalysisException: 'save' does not support bucketing right now;
Run Code Online (Sandbox Code Playgroud)

是save(...)不允许的?只saveAsTable(...)允许将数据保存到Hive吗?

任何建议都是有帮助的。

partitioning apache-spark parquet apache-spark-sql

3
推荐指数
2
解决办法
1469
查看次数