腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
Spark
scala
使用
子
查询
与
limit
连接
mysql
、
sql
、
scala
、
apache-spark
我需要
连接
fake_id上的两个表,但是表2包含多个匹配的记录,因此我需要匹配记录where table2.end_time >= table1.event_time和table2.start_time
spark
.sql("select t1.fake_id, t1.attribute_1,t1.event_time,t22.end_time from table1 t1 left outer joinand t2.end_time >= t1.event_time and t2.start_time <= t1.event_t
浏览 59
提问于2020-08-29
得票数 0
回答已采纳
2
回答
创建一个SQL
查询
,该
查询
将从pyspark中的表中选择10的限制。
python
、
sql
、
pandas
、
dataframe
、
pyspark
' using your
spark
_ex and .createDataFrame
spark
_df.show()1#创建一个SQL
查询
,该
查询
从示例
浏览 4
提问于2021-09-23
得票数 0
回答已采纳
1
回答
对子文档的sparkR Mongo
连接
器
查询
mongodb
、
apache-spark
、
connector
我
使用
的是Mongo
连接
器--文档中的所有示例()都很好,但是如果我在一个有
子
文档失败的文档中测试
查询
,显然SQL还没有准备好进行此
查询
: at com.mongodb.
spark
.sql.MapFu
浏览 5
提问于2016-08-16
得票数 0
回答已采纳
1
回答
Spark
SQL:交叉
连接
和
子
查询
sql
、
apache-spark
、
subquery
、
pyspark
、
cross-join
我尝试在pyspark中运行以下SQL
查询
(在
Spark
1.5.0上):at org.apache.
spark
.sql.SparkSQLParser$$anonfun$org$apache$
spark
at org.apache.
spark
.sql.SQLCont
浏览 1
提问于2016-03-02
得票数 1
回答已采纳
1
回答
火花SQL
与
火花壳REPL的性能差异
apache-spark
Spark
问题:我在
spark
-sql和
spark
-shell中进行完全相同的
Spark
查询
。
spark
-shell版本大约需要10秒,而
spark
-sql版本大约需要20秒。星星之火-sql REPL直接获取
查询
:火花外壳REPL命令如下所示:
scala
> val df = sqlContext.sq
浏览 1
提问于2016-02-11
得票数 6
1
回答
子
查询
中具有多个值的
Spark
过滤器下推
apache-spark
、
hive
、
apache-spark-sql
、
hiveql
现在,我想
使用
分区修剪过滤由y
使用
来自adm的值进行分区的另一个表big。from adm a)select * from big b导致a和b之间的广播加入 即使我
使用
IN,如何将
子
查询
作为分区筛选器下推
浏览 0
提问于2019-12-13
得票数 2
1
回答
Apache问题: java.lang.RuntimeException:[1.517] failure:预期标识符
join
、
apache-spark
、
apache-spark-sql
根据我对
spark
的研究,了解到两个以上的表不能直接
连接
,我们必须
使用
子
查询
才能使它工作。因此,我
使用
子
查询
并能够
连接
3个表:
查询
浏览 0
提问于2015-02-09
得票数 0
1
回答
如何在
Spark
1.6中
使用
SQL
子
查询
mysql
、
apache-spark
、
apache-spark-sql
、
spark-hive
如何将以下
查询
转换为
与
不支持
子
查询
的
Spark
1.6兼容:FROM `table1` ne INNER JOIN `table2device_hostname LIKE 我读到它支持在FROM中指定的
子</e
浏览 16
提问于2018-01-22
得票数 1
2
回答
如何
使用
SQL
查询
在dbtable中定义表?
jdbc
、
apache-spark
、
apache-spark-sql
请注意,可以
使用
SQL
查询
的FROM子句中的任何有效内容。例如,您也可以
使用
括号中的
子
查询
来代替完整的表。当我
使用
代码时:USING org.apache.
spark
.sql.jdbc url "jdbc:postgresql
浏览 2
提问于2015-09-17
得票数 5
回答已采纳
1
回答
如何在停止上下文后强制关闭
与
mysql的
Spark
Hive metastore
连接
?
mysql
、
apache-spark
、
hive
、
metastore
我
使用
Spark
来
查询
配置单元,然后进行转换。我的
Scala
应用创建了多个
Spark
应用。只有在关闭前一个
spark
应用的SparkSession和
Spark
上下文后,才会创建新的
Spark
应用。但是,在停止sc和
spark
时,不知何故,
与
Hive Metastore (Mysql)的
连接
未正确销毁。对于每个,
Spark
App我可以看到大约5个Mysql
连接
被创
浏览 23
提问于2017-08-15
得票数 0
1
回答
如何在
Spark
中启用Postgis
查询
postgresql
、
apache-spark
、
postgis
我有一个带有Postgis扩展的PostgreSQL数据库,所以我可以执行以下
查询
:FROM poi_table
使用
Spark
,我可以在我的
Spark
应用程序(在
Scala
中)中
查询
表,如下所示例如,当我
使用
Postgis函数ST_Di
浏览 0
提问于2018-01-17
得票数 1
回答已采纳
1
回答
星星之交不适用于avtiva驱动程序
apache-spark
、
spark-submit
、
druid
我试图用简单的
查询
操作编写一个火花作业,
连接
到德鲁伊。根据,我
使用
avatica驱动程序
连接
到Druid。avatica:remote:url=http://<druidBrokerUrl>/druid/v2/sql/avatica/"} 在执行
scala
代码时,我能够
连接
到Drui
浏览 7
提问于2022-07-25
得票数 0
2
回答
从mysql读取火花外壳中的数据
mysql
、
apache-spark
、
integration
首先,我构建了
scala
应用程序,
使用
这一行代码从apache中的mysql表中读取数据。
scala
> var df =
spark
.read.format("jdbc").option("url","jdbc:mysql://127.0.0.1:3306").option("user","
scala
> df.show() <console>:26: error: valu
浏览 2
提问于2017-10-02
得票数 1
2
回答
R DBI Sparklyr DBWritetable正在运行,但没有结果
r
、
apache-spark
、
hive
、
sparklyr
、
r-dbi
没错,我尝试
使用
RStudio和R(有时
使用
rPython的python )来取代一些我过去
使用
T-SQL做的事情,以及一大堆我以前永远做不到的事情。sc <-
spark
_connect(mast
浏览 1
提问于2017-09-01
得票数 1
1
回答
如何
使用
AWS Glue和
Spark
SQL存储表?
apache-spark
、
aws-glue
<init>(Path.java:175) at org.apache.
spark
.sql.hive.client.HiveClientImpl$$anonfun$getDatabase$1$$anonfun$apply$2.apply(HiveClientImpl.
浏览 44
提问于2020-07-08
得票数 2
1
回答
火花SQL卡桑德拉如何处理时间戳空值?
cassandra
、
apache-spark
、
apache-spark-sql
我目前正在
使用
ApacheCassandra2.1.2集群和
Spark
1.2.0
连接
器。对于一些初始测试,我需要通过
Spark
命令从Cassandra表中选择一些行。我们在键空间 ks中
使用
了一个名为tabletest的表。例如,这个表包含一个id (bigint)和一个ts (时间戳)。cc = new CassandraSQLContext(sc)val rdd = cc.sql("SELECT id,ts FROM table
浏览 5
提问于2015-01-29
得票数 0
1
回答
:无法看到失败SQL
查询
的完整堆栈跟踪
scala
、
apache-spark
、
apache-spark-sql
、
spark-launcher
我正在
使用
SparkLauncher
连接
到
Spark
上的Yarn之上的集群模式。我正在
使用
Scala
运行一些SQL代码,如下所示: try { getNestedStackTrace(e.getCause, msg ++ e.getStackTrace.map(_.toString))现在,
浏览 3
提问于2020-05-25
得票数 1
回答已采纳
1
回答
使用
java读取
spark
sql中的复杂json
java
、
spark-streaming
我的json文件类似于下面的代码,我正在尝试
使用
以下代码读取majorsector_percent下的所有名称。sQLContext.sqlContext().cacheTable("logs");但是我得到了这个错误,因为类型转换,如何处理这种情况以及如何知道模式: java.lang.ClassCastException:
scala
浏览 0
提问于2016-04-06
得票数 1
2
回答
如何在ISIN操作符中传递数据
apache-spark
、
hadoop
、
apache-spark-sql
、
bigdata
我想将具有一组值的dataframe传递给新
查询
,但失败了。( 1)在这里,我选择特定的列,以便在下一个
查询
中通过ISINmanagerIdDf: org.apache.
spark
.sql.DataFrame = [manager_id: bigint
与
下面一样,当我
浏览 0
提问于2018-10-02
得票数 3
回答已采纳
1
回答
在
spark
函数中创建本地数据的错误
scala
、
apache-spark
:67)at org.apache.
spark
.sql.execution.CollectLimitExec.readMetrics(
limit
.
scala
:51) at org.apache.
spark
.sql.execution.CollectLimitExec.metrics$lzyc
浏览 6
提问于2021-01-13
得票数 0
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券