我希望spark能够spark.readStream在文件出现在该目录中时连续监视目录并读取CSV文件.
请不要包含Spark Streaming的解决方案.我正在寻找一种方法来使用火花结构流.
我对 hive 在哪里存储数据感到有些困惑。
它是将数据存储在 HDFS 还是 RDBMS 中?Hive Meta 存储是否使用 RDBMS 来存储 Hive 表元数据?
提前致谢 !!
通过CLI在Java中传递参数时,我们通常像
java -cp jar classname "args[0]" "args[1]"
Run Code Online (Sandbox Code Playgroud)
我想传递诸如此类的参数
--host hostname --user username --password password。
请帮助我实现这一目标。
提前致谢 !!