我有一个从S3读取的Spark Structured Streaming Job,转换数据然后将其存储到一个S3接收器和一个Elasticsearch接收器.
目前,我做了readStream一次,然后 writeStream.format("").start()两次.这样做似乎Spark从S3源读取数据两次,每个接收器一次.
readStream
writeStream.format("").start()
是否有更有效的方法写入同一管道中的多个接收器?
apache-spark spark-structured-streaming
apache-spark ×1
spark-structured-streaming ×1