我想知道 Amazon Dynamodb Global 二级索引是否可用于写入量非常大的实时应用程序。例如:聊天应用程序。一旦主表写入/更新完成,全局二级索引就需要在亚毫秒延迟内更新。这可能吗?
我有一个DataFrame要尝试partitionBy插入的列,按该列对其进行排序,并使用以下命令以拼花格式保存:
df.write().format("parquet")
.partitionBy("dynamic_col")
.sortBy("dynamic_col")
.save("test.parquet");
Run Code Online (Sandbox Code Playgroud)
我收到以下错误:
reason: User class threw exception: org.apache.spark.sql.AnalysisException: 'save' does not support bucketing right now;
Run Code Online (Sandbox Code Playgroud)
是save(...)不允许的?只saveAsTable(...)允许将数据保存到Hive吗?
任何建议都是有帮助的。