我在azure中有两个集群,一个用于spark 2.0,另一个用于hbase。我可以完美地填充和使用hbase,现在我想将spark连接到hbase并进行一些计算。我想使用python,因为我不知道scala。
我的第一个问题是:做这件事的最好方法是什么?spark -> hive -> hbase还是spark直接到hbase?
我能有一个很好的插入和查询的例子吗?
谢谢?
发布于 2016-11-12 06:56:27
如果你对通过Spark- to -HBase连接器直接使用Spark to HBase很酷,詹张在http://hortonworks.com/blog/spark-hbase-dataframe-based-hbase-connector/上有一篇很好的博客文章提供了例子。
哈!
https://stackoverflow.com/questions/40529909
复制相似问题