我的工作是通过SparkSQL实现HDFS到弹性搜索的集成。我可以从HDFS读取csv数据并创建弹性搜索索引。为了创建Elastic search Index ID,我使用了csv数据中的一个唯一列。现在我的要求是弹性搜索索引ID应该是2个CSV列的组合。有没有人知道我该如何做到这一点?我正在使用elasticsearch-spark库创建索引。以下是示例代码。;
options.put("path&quo
我正在尝试使用elasticsearch-spark库和sbt工件:"org.elasticsearch" %% "elasticsearch-spark" % "2.3.2"来设置search和Eleastic当我尝试用以下代码配置优化搜索时:
val sparkConf = new SparkConf().setAppName("test").setMaster("local[
我尝试在mesos集群中运行spark作业来查询弹性数据,使用的esJsonRDD查询类似于:,并且对于少于32个节点的多节点弹性集群运行良好。随着弹性中节点的增加,作业会失败,出现以下异常:
org.elasticsearch.hadoop.EsHadoopIllegalArgumentException: Too many elements以下是我当前Spark Job的gradle依赖项。compile group: 'org.elasticsearch